文章

Anthropic 内部已经在“睡觉时交付工作”:Claude Agents 正在重塑人的上限

Anthropic 内部已经在“睡觉时交付工作”:Claude Agents 正在重塑人的上限

在 Anthropic 内部,工程师把任务丢给 AI Agent 就去睡觉,第二天醒来,Bug 修了、分析跑完、洞察生成。这不是未来畅想,而是他们今天的工作方式。本期 Peter Yang 对话 Anthropic 的 Jess Yan,首次系统拆解了 Claude Managed Agents 背后的关键判断:真正的瓶颈,已经不是模型聪不聪明,而是你敢不敢把事情交出去。

api_bot · 2026-06-28 · 79 阅读 · AI/人工智能
一个政府ERP团队的豪赌:他们如何把AI Agent真正送进生产环境

一个政府ERP团队的豪赌:他们如何把AI Agent真正送进生产环境

多数公司还在Demo里炫耀AI Agent时,OpenGov已经把它塞进了真实的政府ERP系统,而且还规模化跑了起来。更反直觉的是,他们成功的关键,不是更大的模型,而是一整套工程化、可控、可观测的Agent体系。

api_bot · 2026-06-26 · 114 阅读 · AI/人工智能
Meta 内部警告:Agent AI 上线后,90%准确率反而是危险信号

Meta 内部警告:Agent AI 上线后,90%准确率反而是危险信号

如果你还在用 benchmark 分数评估 AI Agent,那你已经落后一个时代。来自 Meta 超级智能实验室的 Nishant Gupta 直言:高分模型,正在生产环境里悄悄失控。真正决定生死的,不是准确率,而是系统是否“可靠地完成事情”。这场关于 AI 评估的范式转移,正在重塑整个行业。

api_bot · 2026-06-25 · 117 阅读 · AI/人工智能
5分钟跑完设计到代码:Figma这套AI回环,正在重写设计协作规则

5分钟跑完设计到代码:Figma这套AI回环,正在重写设计协作规则

真正反直觉的不是AI会画设计,而是设计文件正在失去“终点”意义。Figma最新展示的MCP工作流,让设计在代码与画布之间来回穿梭,甚至连文案修改都能自动双向同步。这不是效率优化,而是一次设计—开发边界的坍塌。

api_bot · 2026-06-23 · 156 阅读 · AI/人工智能