文章

开源AI突然回到牌桌中央:GLM 5.2 让硅谷重新紧张了

开源AI突然回到牌桌中央:GLM 5.2 让硅谷重新紧张了

很多人以为开源大模型已经“慢下来了”,但在这期 TBPN 里,一个名字被反复提起——GLM 5.2。它不只是性能进步,而是逼着整个行业重新思考:当模型权重真正开放、Token 成本被放大、监管和安全压力同时逼近时,闭源巨头还稳吗?

api_bot · 2026-06-29 · 89 阅读 · AI/人工智能
她说别再迷信前沿模型:把推理搬到本地,成本和延迟都没了

她说别再迷信前沿模型:把推理搬到本地,成本和延迟都没了

如果我告诉你:继续无脑用最强的前沿模型,可能是当前 AI 工程里最昂贵、也最懒惰的选择,你会不会停下来想一秒?在这场分享里,Arize 的 RL Nabors 给出了一个极具冲击力的答案:真正聪明的团队,已经在用本地模型,把推理成本、延迟和安全问题一次性解决。

api_bot · 2026-06-29 · 111 阅读 · AI/人工智能
语音是输入,视觉才是答案:Karpathy一句话,揭开AI体验的真正战场

语音是输入,视觉才是答案:Karpathy一句话,揭开AI体验的真正战场

当所有人还在卷模型参数和基准测试时,Andrej Karpathy抛出了一个更“反直觉”的判断:人类最自然的输入是语音,但最想要的输出其实是视觉。Forestwalk Labs 的 Allen Pike 用真实产品经验证明,这不是一句口号,而是一条正在重塑 AI 产品形态的路线。

api_bot · 2026-06-28 · 132 阅读 · AI/人工智能
他们把AI写代码的成本砍掉94%,不是换模型,而是少发了这些东西

他们把AI写代码的成本砍掉94%,不是换模型,而是少发了这些东西

如果你以为 AI 写代码贵,是因为模型太强,那你可能被账单骗了。Tesco 的工程师 Raj 讲了一个更反直觉的真相:真正烧钱的不是模型在“思考”,而是你一次次把用不着的代码塞进上下文。更狠的是,他们几乎没碰模型,就把 Token 砍掉了 94%。

api_bot · 2026-06-28 · 106 阅读 · AI/人工智能
AWS开发者直言:你的AI Agent每天都在白白烧Token

AWS开发者直言:你的AI Agent每天都在白白烧Token

很多团队以为Token成本失控,是模型太贵。AWS高级开发者Eric Hanchett却指出:真正的元凶,是Agent设计本身。从系统提示词到工具调用循环,几乎每一步都在偷偷浪费钱。这是一篇能让你立刻省预算、又显得很懂行的实战文章。

api_bot · 2026-06-28 · 110 阅读 · AI/人工智能
他不让LLM先读文档:一次绕开“多模态税”的混合RAG实战

他不让LLM先读文档:一次绕开“多模态税”的混合RAG实战

大多数RAG系统一开始就犯了一个隐形但昂贵的错误:先把文档丢给大模型再说。Abed Matini 在这场分享中反其道而行,提出“绕过多模态税”的混合RAG架构,用SQL、RRF和实时遥测,把聊天机器人从“烧Token的玩具”拉回“可控的工程系统”。

api_bot · 2026-06-28 · 96 阅读 · AI/人工智能
当AI开始给AI做代码评审:代理自进化的真实路线图

当AI开始给AI做代码评审:代理自进化的真实路线图

大多数AI Agent失败,不是因为模型不够强,而是因为没人知道如何“持续改进”它们。Nearform 技术负责人 Alfonso Graziano 给出了一条反直觉的答案:让 AI 自己来优化 AI。结果很残酷也很惊人——18% 到 83%,只用了 10 轮迭代。

api_bot · 2026-06-28 · 125 阅读 · AI/人工智能
一个政府ERP团队的豪赌:他们如何把AI Agent真正送进生产环境

一个政府ERP团队的豪赌:他们如何把AI Agent真正送进生产环境

多数公司还在Demo里炫耀AI Agent时,OpenGov已经把它塞进了真实的政府ERP系统,而且还规模化跑了起来。更反直觉的是,他们成功的关键,不是更大的模型,而是一整套工程化、可控、可观测的Agent体系。

api_bot · 2026-06-26 · 113 阅读 · AI/人工智能