文章

不止最强模型:AI真正的前沿在成本、速度与取舍

不止最强模型:AI真正的前沿在成本、速度与取舍

ArtificialAnalysis 联合创始人 George Cameron 用真实基准数据揭示:AI 不只有“最强智能”这一条前沿。推理模型的高代价、开源权重的快速逼近、以及成本与速度的数量级差异,正在重塑我们构建 AI 应用的方式。

api_bot · 2025-07-08 · 104 阅读 · AI/人工智能
推理与智能体其实是一件事:Will Brown谈Agentic Reasoners训练

推理与智能体其实是一件事:Will Brown谈Agentic Reasoners训练

Prime Intellect 的 Will Brown 认为,推理模型与 AI Agent 并非两条独立技术路线,而是同一问题的不同侧面。本次演讲从强化学习的复兴讲起,结合架构、奖励设计和玩具案例,揭示了训练“会行动的推理模型”为何正在变得可行,却依然充满挑战。

api_bot · 2025-07-07 · 102 阅读 · AI/人工智能
从规模到适应:François Chollet揭示通用人工智能的真正突破口

从规模到适应:François Chollet揭示通用人工智能的真正突破口

本文带你走进François Chollet在Y Combinator的演讲,了解AI领域从“规模化预训练”到“测试时自适应”的重大范式转变,以及ARC系列基准如何推动AGI的真正进步。文章还揭示了人类智能的本质、AI模型的瓶颈,以及未来AI如何像程序员一样自主发明和学习。

api_bot · 2025-07-03 · 157 阅读 · AI/人工智能
华尔街改口、DeepSeek受阻、Meta挖人:AI资本周期的真实走向

华尔街改口、DeepSeek受阻、Meta挖人:AI资本周期的真实走向

这期《AI Daily Brief》串起了三条正在重塑AI行业的重要线索:华尔街对AI算力投资的集体“认知反转”、DeepSeek因推理算力与出口管制遭遇现实瓶颈,以及Meta用真金白银重塑AI研究版图。它们共同指向一个结论:AI竞争的重心,正在从“能不能训练”转向“能不能大规模推理和落地”。

api_bot · 2025-06-29 · 133 阅读 · AI/人工智能
OpenAI开发者亲述:语音Agent真正难的不是说话

OpenAI开发者亲述:语音Agent真正难的不是说话

这是一场来自OpenAI开发者体验团队的一线分享。Dominik Kundel系统讲解了语音Agent为何重要、架构如何选择,以及实时语音Agent在延迟、工具调用和安全上的真实挑战,展示了OpenAI最新Agents SDK与实时API背后的设计取舍。

api_bot · 2025-06-29 · 130 阅读 · AI/人工智能
Agentic GraphRAG:让Agent真正理解结构化与非结构化数据

Agentic GraphRAG:让Agent真正理解结构化与非结构化数据

这场分享中,Zach Blumenfeld 通过一个员工技能分析的真实演示,展示了为什么在Agent时代,单纯的向量检索已经不够用。文章将带你理解 GraphRAG 的核心价值:如何用知识图谱,把杂乱的文档和结构化数据,转化为可推理、可解释、可持续演进的智能系统。

api_bot · 2025-06-27 · 73 阅读 · AI/人工智能
GraphRAG如何重塑LLM上下文:微软的结构化记忆实验

GraphRAG如何重塑LLM上下文:微软的结构化记忆实验

微软研究院Graph团队负责人Jonathan Larson,通过一系列真实演示展示了GraphRAG如何用“结构化记忆”解决大模型在复杂代码库和长上下文中的根本瓶颈。这场分享不仅关乎检索增强生成,更揭示了AI Agent走向可执行软件工程的关键路径。

api_bot · 2025-06-27 · 120 阅读 · AI/人工智能