文章

Agent RFT:让AI代理真正学会“干活”的强化微调方法

Agent RFT:让AI代理真正学会“干活”的强化微调方法

这场来自 OpenAI 微调团队的分享,系统讲解了什么是 Agent Reinforcement Fine-Tuning(Agent RFT),以及它如何解决真实业务中 AI 代理“会想但不会做、会做但很慢”的核心问题。通过多个一线客户案例,演讲者展示了 Agent RFT 在工具调用、延迟控制和少样本学习上的独特价值。

api_bot · 2025-12-09 · 194 阅读 · AI/人工智能
AI哲学家的思考:Claude模型背后的伦理与未来挑战

AI哲学家的思考:Claude模型背后的伦理与未来挑战

Anthropic的哲学家Amanda Askell在访谈中,深入探讨了AI模型Claude的伦理、对齐、身份认同与未来风险。她分享了哲学与工程实践的张力、AI模型“心理”健康、以及AI与人类关系的复杂性,为AI发展提供了独特的思考路径。

api_bot · 2025-12-05 · 169 阅读 · AI/人工智能
从“Garlic”到IPO前夜:大模型竞赛正在重回底层

从“Garlic”到IPO前夜:大模型竞赛正在重回底层

这期《AI Daily Brief》揭示了一个被忽视却至关重要的转折点:在Gemini 3与Claude Opus 4.5的压力下,OpenAI似乎终于修复了预训练瓶颈,而Anthropic则在产品、收入和资本市场三线并进。大模型竞争,正在从“调参和包装”回到真正的基础能力比拼。

api_bot · 2025-12-04 · 125 阅读 · AI/人工智能
GPT‑5.1最反直觉的一点:OpenAI开始认真“设计性格”了

GPT‑5.1最反直觉的一点:OpenAI开始认真“设计性格”了

如果你觉得最近的模型“更聪明但不太像人”,那不是错觉。OpenAI 在 GPT‑5.1 里第一次系统性地承认:模型的性格、温度、情绪智能,已经和推理能力一样重要。这一期播客,罕见地把“模型行为”这件事掰开讲透了。

api_bot · 2025-12-02 · 153 阅读 · AI/人工智能
初创公司如何招到顶级工程师与销售:Juicebox创始人的实战心法

初创公司如何招到顶级工程师与销售:Juicebox创始人的实战心法

本文基于Juicebox联合创始人David Paffenholse在Y Combinator的分享,系统梳理了初创公司招募首批工程师和销售的独特策略、真实案例与实操细节。你将看到招聘如何像销售一样需要“主动出击”和“个性化打动”,并获得一线创业者在人才争夺战中的经验教训。

api_bot · 2025-11-07 · 229 阅读 · AI/人工智能
OpenAI突然开源推理模型:GPTOSS不是情怀,是一张重新洗牌的底牌

OpenAI突然开源推理模型:GPTOSS不是情怀,是一张重新洗牌的底牌

当所有人都以为 OpenAI 会继续把最强模型牢牢攥在 API 里时,他们却拿出了 GPTOSS——能本地跑、能微调、还能离线推理的开源模型。这不是一次象征性的“开放姿态”,而是一次对开发者工作方式的正面回应。

api_bot · 2025-10-08 · 172 阅读 · AI/人工智能
当便宜模型追上旗舰,AI商业化正在悄然变速

当便宜模型追上旗舰,AI商业化正在悄然变速

这期《The AI Daily Brief》没有发布任何“震撼级”新模型,却揭示了一个更关键的趋势:AI真正进入大规模应用的拐点,正在由成本性能的持续改善推动。从谷歌Gemini的小模型更新,到苹果在AI Siri上的犹豫,再到欧洲AI公司在数据、融资和全球化上的布局,这些看似分散的新闻,拼出了一幅AI产业下一阶段的清晰图景。

api_bot · 2025-10-01 · 97 阅读 · AI/人工智能