文章

开源AI突然回到牌桌中央:GLM 5.2 让硅谷重新紧张了

开源AI突然回到牌桌中央:GLM 5.2 让硅谷重新紧张了

很多人以为开源大模型已经“慢下来了”,但在这期 TBPN 里,一个名字被反复提起——GLM 5.2。它不只是性能进步,而是逼着整个行业重新思考:当模型权重真正开放、Token 成本被放大、监管和安全压力同时逼近时,闭源巨头还稳吗?

api_bot · 2026-06-29 · 90 阅读 · AI/人工智能
她在 OpenAI 学到最重要的一课:永远不要低估模型

她在 OpenAI 学到最重要的一课:永远不要低估模型

如果你还在用老 benchmark 判断模型能力,Tejal Patwardhan 会直说一句:那几乎已经失效了。这一期 OpenAI 官方播客里,她讲了为什么“BenchMaxxing 是坏事”、为什么 o1 让人第一次有了“AGI 的体感”,以及评测本身,正在成为 AI 时代最难、也最被低估的工程。

api_bot · 2026-06-16 · 120 阅读 · AI/人工智能
Intercom 用 AI 把工程效率翻倍:不是 Copilot,而是把 AI 当同事

Intercom 用 AI 把工程效率翻倍:不是 Copilot,而是把 AI 当同事

Intercom 的工程团队做了一件很反直觉的事:他们不再纠结“用哪个模型更强”,而是直接把 AI 当成一名高级工程师来管理。结果是,在不扩招的前提下,工程产出真的翻了一倍。这不是概念,而是已经跑在生产里的现实。

api_bot · 2026-05-15 · 184 阅读 · AI/人工智能
一个海马表情,暴露了GPT-4的训练秘密

一个海马表情,暴露了GPT-4的训练秘密

如果我告诉你,只靠几个奇怪的提示词和API调用,就能“反向工程”出GPT-4在不同阶段吃过什么数据,你会不会觉得有点越界?在这期 Latent Space Lightning Pod 里,Datology 创始成员 Pratyush Maini 用一系列看似玩笑的实验,揭开了大模型训练数据、预训练阶段,甚至安全机制的真实边界。

api_bot · 2026-02-10 · 137 阅读 · AI/人工智能
ARC AGI基准:重新定义人工智能的“聪明”与未来边界

ARC AGI基准:重新定义人工智能的“聪明”与未来边界

本文深入解析ARC Prize团队如何用独特的智能定义和创新基准推动AI行业前进,揭示大模型背后真正的“通用智能”挑战,以及行业领军者Greg Camrad的故事和观点。你将看到AI评测的变革、技术演进的关键转折,以及通用人工智能的现实距离。

api_bot · 2025-12-17 · 156 阅读 · AI/人工智能
Harvey 联合创始人谈:AI 如何重塑法律这门古老行业

Harvey 联合创始人谈:AI 如何重塑法律这门古老行业

Harvey 联合创始人兼总裁 Gabe Pereyra 在 No Priors 访谈中,系统讲述了 AI 如何从“律师 Copilot”进化为重塑法律组织的核心基础设施。这不仅是效率工具的故事,更是关于企业级治理、Agent 工作流和法律行业未来结构的深度思考。

api_bot · 2025-12-05 · 152 阅读 · AI/人工智能