04
主线 04 · 原创研究
实验室
我们用 AI 构建真实应用,为每一步埋点,并公布原始数据。实验、拆解,以及炒作背后诚实的数字 —— 附带方法论,任何一项你都能复现。
42
个应用
120h
小时录屏
14
款工具
从这里开始 一条 3 篇的路径,带你看懂我们怎么做实验
全部实验
实验笔记
给 GUI Agent 演示一次,然后验证它学到的是流程
实验笔记
AI Agent 有空档,不代表额外推理就值得买单
实验笔记
公开榜单只负责筛选模型,真正的产品评测才负责做决定
实验笔记
研究 Agent 交出了报告,先审它的决策,不要只审文档
实验笔记
AI Agent 突然失忆时,先检查状态层,再怀疑模型
实验笔记
当多个 AI 队友共用一台电脑,先测试它们并不存在的边界
实验笔记
AI 安全回退减少 85% 后,边界两侧都要重测
实验笔记
模型同名,不等于产品同版
实验笔记
让 AI 技能学会你的语气之前,先确认它能不能忘掉你
实验笔记
语音 Agent 的真实负载,往往比 CPU 曲线显示的更高
实验笔记
证明变绿,不等于验证链已经走完
实验笔记
Agent 很忙,但价值信号缺席了
实验笔记
OpenRouter Classifiers 能给 AI 支出贴标签,但先证明标签可信
实验笔记
AgentForger 已修复,但你的 Agent Builder 仍需要控制面发布测试
实验笔记
Cursor Router 隐藏了模型选择,但发布证据不能一起消失
实验笔记
Manager Coercion Benchmark 提醒我们:每个智能体都需要诚实退出
实验笔记
Qwen Audio 3.0 与 Seed Audio 1.0:别比 Demo,先做生产验收
实验笔记
当 AI 开始生成整个页面,就要按整个页面来测试
实验笔记
AI Agent 每一步都像做对了,为什么整个流程仍然失败
每个实验都跑在 Y Build 上
运行你自己的构建 —— 免费开始
继续探索