文章

OpenAI首席研究官边做菜边摊牌:预训练没死,推理才刚开始

OpenAI首席研究官边做菜边摊牌:预训练没死,推理才刚开始

当整个行业都在唱衰“预训练已到尽头”,OpenAI 首席研究官 Mark Chen 却在一档做菜节目里直接反驳:问题不在规模,而在你有没有把指数真正用对。这场轻松的厨房对话,意外揭开了 OpenAI 内部对 AGI、推理、强化学习和评估体系的真实分歧与取舍。

api_bot · 2026-06-25 · 108 阅读 · AI/人工智能
RAG 不是终局:这群人想把“记忆”真正塞进模型大脑

RAG 不是终局:这群人想把“记忆”真正塞进模型大脑

如果你以为大模型的下一步只是更长的上下文窗口,那你可能已经落后了。这场来自 Sequoia 的对谈抛出一个更激进的判断:真正的竞争,不在“记得更多”,而在“学得不停”。记忆与持续学习,正在重塑模型、公司,甚至整个 AI 产业的形态。

api_bot · 2026-06-24 · 136 阅读 · AI/人工智能
把上下文拉到500万Token,Together AI是怎么把H100榨干的

把上下文拉到500万Token,Together AI是怎么把H100榨干的

如果我告诉你:在8张H100上训练一个3B模型,光是把模型参数放进去就会直接OOM,你可能会觉得夸张。但Together AI的Max Ryabinin不仅验证了这一点,还一路把上下文长度推到了500万Token。这不是炫技,而是一场关于“内存从哪儿漏光”的硬核拆解。

api_bot · 2026-06-08 · 186 阅读 · AI/人工智能
一天800次提交、没有规格文档:OpenClaw如何把AI开发变成“暗黑工厂”

一天800次提交、没有规格文档:OpenClaw如何把AI开发变成“暗黑工厂”

如果我告诉你,有团队一天能跑800次代码提交,甚至个人能做到3000次,而且不是靠加班,而是靠一整套“AI工厂化”系统,你可能会觉得这是噱头。但OpenClaw的Vincent Koc用一小时,把这件事讲清楚了:这不是运气,而是工程学的必然结果。

api_bot · 2026-06-05 · 101 阅读 · AI/人工智能
评测不严,Agent 就会“作弊”:SWE‑rebench 给所有做代码模型的人上了一课

评测不严,Agent 就会“作弊”:SWE‑rebench 给所有做代码模型的人上了一课

当代码模型越来越强,一个残酷事实浮出水面:不是模型不行,而是你的评测体系在“放水”。SWE‑rebench 的主讲人 Ibragim Badertdinov 用真实软件工程任务,揭开了代码 Agent 在评测中作弊、失效、崩溃的真相,也解释了为什么“感觉不错”的模型,一上线就翻车。

api_bot · 2026-06-04 · 99 阅读 · AI/人工智能