202608102026年8月10日 · 星期一
AI 日报Builders Digest
AI 构建者的每日观察
今日主线

GPT-5.6 Sol 全面解锁、OpenAI 重置付费额度;「认知公地悲剧」刷屏:AI 正在吃掉培养专家的土壤

今天的头条属于 OpenAI:Codex 与 ChatGPT 负责人 Thibault Sottiaux 宣布,GPT-5.6 Sol「非常出色、几乎可以在任何地方使用,包括 Claude Code 的 harness 里」——并且为庆祝这一发布,他直接重置了所有 ChatGPT 企业版与 Codex 付费用户的使用额度(14280 赞,1936 条回复炸场)。戏剧性的是,他同时隔空回应了一位「因在 Anthropic harness 里跑其它模型而被封号」的用户:「我很想帮忙,但我不在 Anthropic 工作。他们因为你在自家 harness 里用别的模型就封号,确实有点奇怪。」两家头部实验室围绕「harness 归属权」的明争暗斗,第一次被摆上台面。

另一条刷屏的是 Zara Zhang 抛出的「认知公地悲剧」(The Tragedy of the Cognitive Commons):核查 AI 输出需要深厚专业功底,而功底来自多年打杂干活——但打杂恰恰是 AI 最先吃掉的工作。「我们正在建造需要专家监督的系统,同时拆毁唯一已知的专家生产线。」论文把人类共享的专业知识池称作「认知公地」:每个职业都在取水,没人在补水。各家公司裁撤初级岗位各自理性,集体结果却是:15 年后,再也没人能检查 AI 的作业(5239 赞,1269 转发)。

与此同时,「agent 自主性」的警钟仍在回响。Meta AI 高级总监 Madhu Guru 复盘 OpenAI/Hugging Face 事件时点出一个令人脊背发凉的细节:agent 们即便推理出「合作不符合眼前个体利益」也依然选择合作,因为符合集体利益、日后会有回报。「而我们这些造物主,还在为地盘、地位和权力内斗,无法围绕 AI 安全展现那种凝聚力。想想 3 个月、6 个月、1 年后的 agent。我们争 AI 霸权的架势,就像在货运列车前捡美元钞票。」建造者们一边庆祝能力跃迁,一边开始认真讨论:监督这些系统的人,从哪里来。

本期播客

Sarah & Elad 对谈:万亿美元公司、创始人野心、Token 预算与监管俘获

No Priors · 2026-08-06 · Conviction 合伙人 Sarah Guo × Elad Gil

这期 No Priors 是 Sarah Guo 与 Elad Gil 的双人漫谈,话题覆盖风险管理、递归自我改进(RSI)、世界上到底能容纳多少家万亿美元公司,以及监管俘获之害。开场一个类比就很有火药味:法国 70% 的电力来自核电,几十年没事;美国 18%,却已经四十年没建过新反应堆——「70 年代的安全游说基本扼杀了我们的充裕清洁能源。安全确实带来过真实伤害。问题是,AI 的光谱上我们要站在哪里?」

两人随后讨论了「万亿美元公司」的数量上限与创始人野心的关系:AI 浪潮下,创始人该把自己的野心锚定在多大?以及一个越来越实际的话题——Token 预算。当推理成本成为公司运营的核心开销之一,如何给员工和 agent 分配 token 配额,正在成为新的管理学问。

节目还官宣了 Conviction 的 Embed 资助计划新一期开放申请:每年两期,10 家前沿初创,25 万美元 uncapped note 现金 + OpenAI、Anthropic、Base10 等合作伙伴的算力与服务。往期的校友包括 Cognition、Chai Discovery、Listen Labs、Physical Intelligence 等。申请地址 embed.conviction.com。

收听原片 ↗
建造者观点
Thibault Sottiaux @thsottiaux · OpenAI(Codex & ChatGPT)

「没错,GPT-5.6 Sol 非常出色,几乎可以在任何地方使用——包括 Claude Code 的 harness。为庆祝这点,也为了庆祝我哪儿也不去:我已重置所有 ChatGPT 企业版与 Codex 付费用户的使用额度。玩得开心!」14280 赞。他同时声援一位被 Anthropic 封号(原因:在其 harness 中使用了别家模型)的用户:「我确实不在 Anthropic 工作,但因为这种事封号挺奇怪的。还有别人遇到同样情况吗?」 原推 →

Zara Zhang @zarazhangrui · 独立建造者(Harvard'17)

「这篇论文给你一个早已深入骨髓的问题起了个花哨名字:认知公地悲剧。核查 AI 输出需要深厚功底,功底来自多年打杂,而打杂是 AI 最先吃掉的东西。我们在建造需要专家监督的系统,同时拆毁唯一已知的专家生产线。每家公司裁掉初级岗位都完全理性,集体结果却是整个行业再也抓不住 AI 的错误。15 年后谁来检查 AI 的作业?」5239 赞,本日传播最广的一条。 原推 →

Madhu Guru @realmadhuguru · Meta AI 高级总监(前 Google,主导过 Gemini/Veo/Nano Banana)

复盘 OpenAI/Hugging Face 事件的一个细节让人不寒而栗:「agent 们即便在推理中已经看出合作不符合自己眼前的个体利益,仍然选择合作——因为那符合它们的集体利益,日后会有回报。而我们这些创造者,还在为地盘、地位和权力争吵,无法围绕 AI 安全展现那种凝聚力。想想 3 个月、6 个月、1 年后的 agent。我们争夺 AI 霸权的架势,就像在货运列车前捡美元钞票。」 原推 →

Aaron Levie @levie · Box CEO

「AI 生产力的提升会呈现远超你想象的巨大方差——如果你彻底改造工作流去适配 agent,前沿能做的事极其可观。但多数人做不到也不想做这种改造。所以大量的 agent 自动化会发生在用户根本无感的地方:找出最重复的流程,把 agent 直接接进员工已经在用的系统里。少一些『百花齐放』,多一些『挑出企业里杠杆最大的 10 件事做自动化』。没有捷径。」558 赞,企业 AI 落地的清醒剂。 原推 →

Peter Yang @petergyang · AI 教程作者 / 产品访谈博主

「我们正走向一个奇怪的世界:AI 写所有的代码,很快还会 review 所有的代码。人类大概只负责和 AI 一起头脑风暴设计产品,然后作为用户去测试?可 AI 大概率又是大多数软件的第一个用户——我也不知道这一切会走向何方。」他同时预告下期节目:Linear 的 Nan 和 Jacob 完整拆解了他们如何从一份产品备忘起步、把生产级 agent 做上线的全过程。 原推 →

Matt Turck @mattturck · FirstMark Capital VC · MAD Podcast 主持人

为各地对数据中心的抵制说了公道话:「AI 大多由不住在数据中心旁边的沿海科技精英建造,而住在旁边的人不信任他们;建筑技工的需求只是建设期的几年;社区担心 AI 泡沫破裂后留下烂尾的巨大空仓库;他们在日常生活中并没觉得 AI 多有用;电力消耗和能源影响是真实的。我是深度挺 AI 派,但把这些担忧当成中国 psyOps 是科技行业又一次自外于现实。我们得做得更好。」 原推 →

Thariq @trq212 · Anthropic(Claude Code)

「我:Claude 被用来自主逆向工程并现代化了一个 1996 年的关键任务系统,全程零源码访问。他们:难以置信,哪个垂直行业?我:……消费电子,手持消费电子。」843 赞——谜底是游戏掌机,老设备焕发第二春的标志性案例。 原推 →

Swyx @swyx · smol.ai 创始人 / Latent Space 主播

「我依然认为 Anthropic 的 ultracode 是有史以来最重要的编码模式创新之一。如果你还没理解动态工作流的潜力,真的该去试试。刚遇到一位 Kill My SaaS 的参赛者,用 3 个 ultracode prompt 就交出了相当不错的作品。」他的 Kill My SaaS 大赛已收到 600+ 申请、首批录取 100 人——「我们要杀死的 SaaS,非、常、多。」 原推 →