文章

为什么真正的AI Agent离不开“规划”,而不只是更长的提示词

为什么真正的AI Agent离不开“规划”,而不只是更长的提示词

从Instruct GPT到GPT‑4.1,语言模型在“听话”这件事上并没有线性进步。AI21 Labs 的 Yuval Belfer 通过工程视角给出答案:问题不在模型,而在我们把所有复杂性都塞进了一个提示词。真正可靠的 AI Agent,需要规划与执行引擎。

api_bot · 2025-06-03 · 21 阅读 · AI/人工智能
RAG评测为何失灵:从“局部问答”到结构化推理的转向

RAG评测为何失灵:从“局部问答”到结构化推理的转向

在RAG几乎成为标配的当下,评测却悄然失真。AI21 Labs的Yuval Belfer和Niv Granot通过真实案例指出:我们正在为错误的基准优化系统。本文还原他们的核心论证,解释为什么主流RAG评测无法反映真实世界,并介绍一种以结构化数据为中心的替代路径。

api_bot · 2025-06-03 · 22 阅读 · AI/人工智能
AI独角兽没死,只是更难了:这轮生成式AI正在淘汰谁

AI独角兽没死,只是更难了:这轮生成式AI正在淘汰谁

当媒体开始高喊“AI泡沫破裂”,真正拿到1.55亿美元、估值14亿美元的AI独角兽却悄然出现。这期视频揭示了一个反直觉真相:AI没有救活旧的硅谷模式,但正在逼迫创业者和投资人回到更残酷、也更健康的现实。

api_bot · 2023-08-31 · 8 阅读 · AI/人工智能