Vol.2002026年7月19日 · 星期日
AI 日报Builders Digest
Claude Fable 5 明日全面开放订阅计划;GPT-5.6 Sol 获极高评价;OpenAI 重置付费用户用量限制
今日主线

Claude Fable 5 明日起纳入所有订阅计划;GPT-5.6 Sol 被确认为极优模型;OpenAI 紧急重置用量限制

Anthropic 官方账号宣布:自 7 月 20 日起,Claude Fable 5 将以 50% 用量上限纳入所有 Max 和 Team Premium 订阅计划。Pro 和 Team Standard 用户将继续通过用量积分使用 Fable,并获得一次性 $100 积分补偿。Anthropic 坦言「Fable 的需求难以预测」,因此采用分阶段开放策略,随着容量扩充多次延长访问权限。这条推文获得超 2.8 万赞,是本周最热 AI 动态之一。

与此同时,OpenAI Codex 和 ChatGPT 负责人 Thibault Sottiaux 确认 GPT-5.6 Sol 为「极优模型」,并随即宣布为所有 Codex 和 ChatGPT Work 付费用户重置用量限制。他写道:「又来了……享受吧,周末愉快!」这条推文获超 9000 赞。此前他还补充称「可能也重置了其他速率限制,待观察。」——两大巨头同步释放容量信号,AI 基础设施竞赛正在加速。

在应用层,AI Agent 的交互范式正在悄然转变。Claude Code 工程师 Thariq 指出「先构建原型再投入大量 token」是避免浪费的最佳策略;OpenClaw 创始人 Peter Steinberger 则展示了 Codex 通过浏览器操控上传图片到 GitHub PR 的场景,感叹「既神奇又痛苦」;Peter Yang 则表达了对语音 Agent 的期待:「在户外边走边用语音指挥 Agent 工作、接收状态更新——第一个实现这个的实验室会赢。」

本期播客

OpenAI 算力负责人:我们的建设速度远远不够

The MAD Podcast with Matt Turck · YouTube · 2026-07-16

Matt Turck 采访了 OpenAI 工业算力负责人 Sachin Katti——这可能是当下科技界最令人瞩目的职位之一。Katti 曾是斯坦福教授、多次创业者,最近担任英特尔 CTO,如今领导着人类历史上最大规模的基础设施建设。

Katti 的核心观点是:「每当你以为算力够了想放慢节奏,结果总是令人后悔——我们不应该放慢。」他透露需求远远超过算力供应,任何上线的算力都会被立即消耗。关于 AI 递归设计,他表示「AI 设计自己所需的训练和推理系统的那一天并不遥远」。节目还深入讨论了液冷超级计算机、电网约束、核能微电网的潜力,以及 OpenAI 自研芯片 Jalapeno 的进展。

收听原片 ↗
建造者观点
Thibault Sottiaux @thsottiaux

OpenAI Codex 和 ChatGPT 负责人确认 GPT-5.6 Sol 为「极优模型」,随后宣布为所有 Codex 和 ChatGPT Work 付费用户重置用量限制。他写道:「又来了……感谢以光速迭代的团队,以及在我们以前所未有的速度扩展时维持基础设施运转的所有人。周末愉快!」此前他还透露可能也重置了其他速率限制。两条推文合计获超万赞。 原推 →

Claude @claudeai

Anthropic 官方宣布:Claude Fable 5 将于 7 月 20 日起纳入所有 Max 和 Team Premium 计划(50% 用量上限)。Pro 和 Team Standard 用户继续通过积分使用,并获一次性 $100 积分。Anthropic 解释称 Fable 需求难以预测,因此采用分阶段开放策略。这条推文获超 2.8 万赞、4000+ 转发,是近期最受关注的 AI 产品动态。 原推 →

Swyx @swyx

技术社区领袖 Swyx 提出一个被大量转发的观点:「如果你还没有把 Codex/Claude/Gemini/Devin 的自动化设置为每周自动研究如何改进你的 SEO/AEO,你真的在错过免费的、理应商品化但奇怪地无人利用的 alpha。」他还探讨了 on-policy AEO(Claude 优化的 AEO 在 Claude 上是否特别有效)vs 通用 AEO 的区别。 原推 →

Madhu Guru @realmadhuguru

Meta AI 高级总监深度分析企业 AI 为何难以超越基础聊天机器人:「根本原因是人才缺口——构建 harness 和 eval 体系需要三个要素:一、严格定义用例并构建离线/在线评估体系;二、建立独立于模型的 harness(路由、多 Agent 编排、上下文管理、工具调用、记忆);三、能在前沿构建这一切的人才——这是最稀缺的。」他还指出 Kimi 对 Google 的冲击有限,因为企业仍需通过 Google Cloud 获取安全、合规和芯片保障。 原推 →

Thariq @trq212

Claude Code 工程师 Thariq 分享了一条实用建议:「构建原型——无论是 mockup、schema、数据模型还是概念验证——是避免在不想要的输出上浪费大量 token 的最佳方式。」这条推文获 634 赞,反映出开发者在 Agent 工作流中对 token 效率的日益关注。 原推 →

Aaron Levie @levie

Box CEO Aaron Levie 对 AI 成本下降趋势发表深度评论:「AI 越便宜,整个生态——尤其是终端客户——受益越多。一切都受限于能否成功且经济高效地在真实工作负载中部署 AI。」他补充道,效率提升反而可能导致前沿模型支出增加,因为你可以在更多任务上经济高效地部署 AI。「唯一受威胁的是利润率,但这是公平的——智能最终应该收敛到基础设施堆栈的利润率。」 原推 →

Peter Steinberger @steipete

OpenClaw 创始人 Peter Steinberger 记录了一个既神奇又痛苦的场景:Codex 使用浏览器 + computer use 打开 Chrome、进入他的 PR、点击评论、与 macOS 选择器搏斗——「全都是为了上传一张图片。GitHub 没有 API 也挡不住任何人。」他还抛出一个引发 475 条讨论的问题:「我们还在讨论循环(loops),还是已经转向图(graphs)了?」 原推 →

Zara Zhang @zarazhangrui

独立开发者 Zara Zhang 分享公开构建心得:「如果做内容让你觉得是额外工作,就展示产品内部正在发生的工作——一个小小的录屏、第一个版本、或改变了你设计的用户行为。推理论证比制作水准更重要。」她还观察到一个文化转变:「几年前很多人对录会议感到不适,现在默认所有商务会议都会被录制——不是为了人,而是为了 Agent。技术真的改变了文化。」 原推 →

官方博客

Anthropic Engineering 三连发:Claude Code 质量复盘、Managed Agents 架构、自托管沙箱

Anthropic Engineering Blog · 2026-07-19

Anthropic 工程博客发布了一篇关于 Claude Code 质量问题的深度复盘。团队追溯了过去一个月用户反馈的质量下降问题,发现三个独立变更分别影响了 Claude Code、Claude Agent SDK 和 Claude Cowork(API 未受影响):3 月 4 日将默认推理努力从 high 改为 medium(已回滚)、3 月 26 日的上下文清理 bug 导致 Claude 表现得健忘和重复(4 月 10 日修复)、4 月 16 日的简洁性指令与其它 prompt 变更叠加伤害了编码质量(4 月 20 日回滚)。Anthropic 坦言:「我们从不故意降级模型。」

另一篇博文介绍了 Managed Agents 的架构哲学:将 Agent 的三个核心组件——session(追加日志)、harness(调用循环)、sandbox(执行环境)——虚拟化,使其可独立替换。文章类比操作系统的抽象层:「几十年前,操作系统通过将硬件虚拟化为进程、文件等抽象来解决'为尚未想到的程序设计系统'的问题。」最新更新还支持自托管沙箱(Cloudflare、Daytona、Modal、Vercel)和 MCP 隧道(研究预览),让 Agent 执行留在企业边界内。

这三篇博文共同描绘了 Anthropic 在 Agent 安全和可靠性方面的系统性工程实践,为行业提供了重要参考。

阅读原文 ↗