基于 Y Build 构建 每个实验都跑在 Y Build 上 —— 从提示到部署上线,无需服务器。 免费开始
构建上线对比实验室关于 开始构建 →
04
主线 04 · 原创研究

实验室

我们用 AI 构建真实应用,为每一步埋点,并公布原始数据。实验、拆解,以及炒作背后诚实的数字 —— 附带方法论,任何一项你都能复现。

42
个应用
120h
小时录屏
14
款工具
从这里开始 一条 3 篇的路径,带你看懂我们怎么做实验

全部实验

实验笔记
给 GUI Agent 演示一次,然后验证它学到的是流程
Aug 19, 2026 · Jordan Park · 21 分钟
阅读 →
实验笔记
AI Agent 有空档,不代表额外推理就值得买单
Aug 18, 2026 · Maya Chen · 20 分钟
阅读 →
实验笔记
公开榜单只负责筛选模型,真正的产品评测才负责做决定
Aug 17, 2026 · Alex Liu · 20 分钟
阅读 →
实验笔记
研究 Agent 交出了报告,先审它的决策,不要只审文档
Aug 15, 2026 · Noah Bennett · 20 分钟
阅读 →
实验笔记
AI Agent 突然失忆时,先检查状态层,再怀疑模型
Aug 13, 2026 · Elena Torres · 18 分钟
阅读 →
实验笔记
当多个 AI 队友共用一台电脑,先测试它们并不存在的边界
Aug 12, 2026 · Jordan Park · 20 分钟
阅读 →
实验笔记
AI 安全回退减少 85% 后,边界两侧都要重测
Aug 8, 2026 · Maya Chen · 17 分钟
阅读 →
实验笔记
模型同名,不等于产品同版
Aug 7, 2026 · Alex Liu · 16 分钟
阅读 →
实验笔记
让 AI 技能学会你的语气之前,先确认它能不能忘掉你
Aug 6, 2026 · Noah Bennett · 21 分钟
阅读 →
实验笔记
语音 Agent 的真实负载,往往比 CPU 曲线显示的更高
Aug 4, 2026 · Elena Torres · 20 分钟
阅读 →
实验笔记
证明变绿,不等于验证链已经走完
Aug 2, 2026 · Jordan Park · 20 分钟
阅读 →
实验笔记
Agent 很忙,但价值信号缺席了
Jul 31, 2026 · Maya Chen · 20 分钟
阅读 →
实验笔记
OpenRouter Classifiers 能给 AI 支出贴标签,但先证明标签可信
Jul 25, 2026 · Alex Liu · 20 分钟
阅读 →
实验笔记
AgentForger 已修复,但你的 Agent Builder 仍需要控制面发布测试
Jul 24, 2026 · Noah Bennett · 20 分钟
阅读 →
实验笔记
Cursor Router 隐藏了模型选择,但发布证据不能一起消失
Jul 23, 2026 · Elena Torres · 19 分钟
阅读 →
实验笔记
Manager Coercion Benchmark 提醒我们:每个智能体都需要诚实退出
Jul 22, 2026 · Jordan Park · 18 分钟
阅读 →
实验笔记
Qwen Audio 3.0 与 Seed Audio 1.0:别比 Demo,先做生产验收
Jul 21, 2026 · Maya Chen · 18 分钟
阅读 →
实验笔记
当 AI 开始生成整个页面,就要按整个页面来测试
Jul 20, 2026 · Alex Liu · 17 分钟
阅读 →
实验笔记
AI Agent 每一步都像做对了,为什么整个流程仍然失败
Jul 19, 2026 · Y Build Editorial · 20 分钟
阅读 →
每个实验都跑在 Y Build 上
运行你自己的构建 —— 免费开始
开始构建
继续探索
运行你自己的构建
免费 · 无需信用卡
免费开始 →