一个政府ERP团队的豪赌:他们如何把AI Agent真正送进生产环境
多数公司还在Demo里炫耀AI Agent时,OpenGov已经把它塞进了真实的政府ERP系统,而且还规模化跑了起来。更反直觉的是,他们成功的关键,不是更大的模型,而是一整套工程化、可控、可观测的Agent体系。
多数公司还在Demo里炫耀AI Agent时,OpenGov已经把它塞进了真实的政府ERP系统,而且还规模化跑了起来。更反直觉的是,他们成功的关键,不是更大的模型,而是一整套工程化、可控、可观测的Agent体系。
如果你觉得 AI Agent 又强又蠢,那不是你的错。Victor Savkin 在这次演讲里抛出一个极具杀伤力的比喻:Agent 就像“失忆的天才”。它能推理、会规划,却在关键时刻忘掉自己刚做过什么。这不是模型能力问题,而是我们构建 Agent 的方式出了结构性毛病。
如果你还在把Agent理解成“一个模型+一堆工具”,那你已经落后了。Ishaan Sehgal在这场演讲里抛出一个极具争议的观点:真正定义Agent身份的不是模型,也不是运行环境,而是一条不断生长的Log。这不是概念游戏,而是足以重构Agent基础设施的抽象转移。
如果你觉得今天的 AI Agent 已经很强了,Raymond Weitekamp 会当面泼你一盆冷水:它们不是不聪明,而是被我们“管理坏了”。在这场关于 Recursive Coding Agents 的演讲里,他展示了一种正在悄悄改变推理、编程和智能体设计的新范式。
如果你还在用 benchmark 分数评估 AI Agent,那你已经落后一个时代。来自 Meta 超级智能实验室的 Nishant Gupta 直言:高分模型,正在生产环境里悄悄失控。真正决定生死的,不是准确率,而是系统是否“可靠地完成事情”。这场关于 AI 评估的范式转移,正在重塑整个行业。
当所有人都在焦虑“AI 抢走写代码的乐趣”时,Angie Jones 给了一个反直觉的答案:让它拿走。因为真正让工程师上瘾的快感,已经上移到了“构建 Agent 系统”这一层。这场演讲,几乎是给所有 AI 从业者的一次职业认知重构。
当整个投资圈都在回避消费级产品时,Zynga创始人Mark Pincus却在YC抛出一个反直觉判断:消费者不“可投”,但正是最该去建的时候。更大的AI机会、被低估的产品信号、以及只有创始人才能启动的Founder Mode,这次对话信息密度极高。
很多人以为 Claude Tag 只是一个“更方便的提示技巧”,但在 Anthropic 团队眼里,它更像是一种新的协作范式。这期 AI Daily Brief 抛出的核心观点是:一旦你开始用 Tag 和 Agent 思维组织工作,AI 不再是工具,而是团队里的“系统级成员”。
如果你还以为 Figma AI 只是“帮你快一点画稿”,那你已经落后一整个版本。这支视频透露了一个更激进的信号:Figma 正在把“表达力”本身做成系统能力,而 AI Agent 成了设计师的第二大脑。
当所有人都在追逐更大的模型时,Databricks 的创始人却抛出一个反直觉判断:AI 的天花板不在模型,而在数据和架构。这期 Latent Space 的对谈,罕见地把“AI Agent 为什么现在才可能落地”讲透了。