202608232026年8月23日 · 星期日
AI 日报Builders Digest
超人类机器时代的人类韧性 · Codex 额度「储蓄」落地 · Mythos 5 开放防御
今日主线

当机器早已超人类,人类为什么反而更爱下棋

No Priors 本期请来 Chess.com CEO Erik Allebest——他运营着人类历史上最长的「机器超人类」实验:1997 年 Deep Blue 击败卡斯帕罗夫时,无数人预言国际象棋已死;三十年过去,棋的热度却创下新高。从 2005 年花 56,000 美元从破产拍卖买下 chess.com 域名、零融资跑到盈利,到如今上亿注册用户,Allebest 说引擎最完美的时代一度「让棋变得无聊」,而真正让棋重生的不是更强的 AI,而是一次文化转向:庆祝失误、接纳 500 分的棋手,「你挂了皇后,你还是棋手,你还在路上」。超级智能没有杀死人类技能,反而让更多人想亲自上场。

同一天,「超人类能力」在工具层批量落地。OpenAI 的 Codex banked reset 正式上线:ChatGPT Work 与 Codex 付费用户未用完的周额度可以结转,Thibault 连发三条预告,单条 6,000+ 赞;Anthropic 的 Mythos 5 安全扫描向防御者开放——把 GitHub 仓库交给 Claude Security,模型跨文件追踪数据流给出 CWE 分类、置信度与修复补丁,配套 3,500 万美元的开源安全 Defender Advantage Fund。Vercel 的 fx 则宣布支持 Grok 与 Codex 订阅,把「自带订阅」变成编码 agent 的通用接口。

「模拟」被推为新缩放定律。Swyx 在采访 Simile AI(Smallville 团队,Joon Sung Park 等人)时从调侃转为严肃:当模型自动化了越来越多的 ML 研究与 AI 工程,最后的瓶颈是模拟人类与人类反馈——Simile 已在财富 100 强找到 PMF,他承认「迟到两年,但从未如此高兴自己错了」。而 Levie 的观察为今天收尾:当智能便宜到无需计量,最大的机会是把 AI 扩散进整个经济——这恰是应用型 AI 公司的黄金时刻。

本期播客

Chess.com 的二十年:机器已超人类,人类为何更热爱下棋

No Priors | Erik Allebest(Chess.com CEO)| 8 月 14 日

No Priors 本期请来 Chess.com CEO Erik Allebest。2005 年他和朋友从破产拍卖中以 56,000 美元拿下 chess.com 域名,2007 年上线后 18 个月便靠会员制盈利,之后「以现金的速度增长」——从不融资,直到 General Atlantic、CVC 以二手股份方式进场。作为纯软件与内容生意,他们选择了慢而稳的路:没有大厂压境、不需要烧钱抢速度,就把每一分收入投回社区与产品,二十年间用体验淘汰了 Yahoo Chess 等对手——「棋不可专利,最终胜出的是社区与内容」。

主持人抛出本集核心问题:棋是人类最长的「机器超人类」实验,Deep Blue 之后人类对棋的热爱为何反而翻倍?Allebest 的答案分两段:先是 Stockfish 时代的「无聊期」——人人模仿完美引擎、磨出沉闷残局;随后文化转向,社区开始庆祝失误、接纳低分段玩家,「你挂后了?没关系,你是棋手,你在路上」。给 7 岁小孩配上引擎与工具,他们已经能挑战特级大师;他自己的孩子靠 YouTube 自学成了比父亲更强的游戏创作者——「接触超人类智能,让人学得更快」。

作弊则是提前上演的「AI 冒充人类」难题:Chess.com 靠海量对局数据与统计/ML 模型识别异常模式,这套账本对所有人都是警示。新推出的扑克站 Gambit 把棋的玩法搬了过去——「为评级而玩:你到底有多强?不是你能买多少筹码、开几个 bot」。对 AGI 他乐观而警惕:财富正流向太少的人,「这更多是文化问题而非技术问题」——技术本身无所谓善恶,取决于谁在掌舵。

收听原片 ↗
建造者观点
Thibault Sottiaux @thsottiaux · Codex & ChatGPT @OpenAI

「Banked reset 已落地,重复一遍,已落地。」Codex 未用完的周额度开始结转,8pm PST 前对所有 ChatGPT Work 与 Codex 付费用户生效;同时坦白本周部分用户缓存命中率走低、额度消耗偏快,正在排查并承诺明天更新。 原推 →

Claude @claudeai · @Anthropic

Mythos 5 向防御者开放:把 GitHub 仓库交给 Claude Security,模型跨文件追踪数据流找漏洞,每条发现带 CWE 分类、置信度/严重性与修复建议,补丁直接在 Claude Code(web 版)打开;按标准 token 计费,模型只返回 findings 不暴露自身。 原推 →

Thariq @trq212 · Claude Code @Anthropic

Anthropic 内部高频使用的 ELI5 技能公开:/eli5 输入任意话题,用「大图少字」的 HTML artifact 把复杂问题讲给完全不懂的人——解释模块怎么工作、为什么做这个取舍、事故因何而起;正考虑转正式插件。 原推 →

Swyx @swyx · smol.ai / dxtips / Latent Space

「模拟即新缩放定律」不是营销话术:当模型自动化大部分 ML 研究与 AI 工程,最后的瓶颈是模拟人类与人类反馈。Smallville 当年零商业应用,如今 Simile 已在财富 100 强找到 PMF——「我迟到两年,但从未如此高兴自己错了」。 原推 →

Guillermo Rauch @rauchg · Vercel CEO

fx 现在支持 Grok 与 Codex 订阅,沙箱里即装即测;另外用 is-agentic 标准在自家产品上循环跑到 100/100,「帮我们关掉不少缺口」——标准本身要够硬,才值得大家花时间与 token。 原推 →

Madhu Guru @realmadhuguru · Sr Director, AI @Meta

「平均值的暴政」:别把复杂的评测套件压成一个分数给高管看——AI 系统没有单一的质量维度,Gemini 早期就吃过这个亏,如今很多团队仍在重蹈覆辙。 原推 →

Aaron Levie @levie · Box CEO

AI 的进步速度史无前例:同等任务更便宜、更通用、更快、在每个领域都更深。当智能便宜到无需计量,最大的机会是把 AI 扩散进整个经济——创新与竞争的顺风,正是应用型 AI 公司的黄金时刻。 原推 →

Peter Yang @petergyang · AI 内容创作者

Instinct 的 onboarding 很顺滑、也够主动,但「未经许可索引并留存我的邮件、还不让我从记录里删除」不能接受——隐私问题不解决就推荐不了;真要干活,他仍留在 ChatGPT Work 与 Codex。 原推 →