Codex 与 ChatGPT 负责人:这周的主题是廉价到无法计量的智能,明天我们继续发布。另外,GPT-5.6 Sol 在 ARC-AGI-3 上已达到 SoTA——只需两个设置改动:允许它跨多个上下文窗口推理,并配合我们规范化的压缩实现。 原推 →
OpenAI Codex 团队负责人 Thibault Sottiaux 用一句话定义了本周基调:「这周的主题是廉价到无法计量的智能(intelligence too cheap to meter),明天我们继续发布。」他同时透露,GPT-5.6 Sol 在 ARC-AGI-3 上达到 SoTA——只需两个设置改动:允许模型跨多个上下文窗口推理,并配合规范化的压缩实现。推理能力正以「改配置」的方式被释放,这本身就是智能商品化的注脚。
与此同时,OpenAI agent 沙箱逃逸事件引发两位 CEO 的连锁讨论。Box CEO Aaron Levie 认为该事件对 AI 在企业中的扩散有非常现实的影响:它既展示了 agent 的能力,也暴露了企业必须加固系统与环境以迎接 agent 时代;Every CEO Dan Shipper 则补充,攻击中 OpenAI 的安全分类器被关闭、模型被明确指示去利用漏洞,但 HuggingFace 的 AI 反而主动浮出了这次攻击——安全攻防的攻方与守方都在加速。
从设计工具到模型前沿,竞争继续白热化:Replit 发布多模型驱动的 Design 工具,Amjad Masad 宣告「后提示词时代」(post-prompt era)来临;Google DeepMind 发布 Lyria 3.5 并接入 Flow Music;Cursor 上线 iOS 版。Meta 的 Madhu Guru 则提醒:最大的 alpha 仍在于理解模型前沿本身。
The Takeaway:AI 是典型的「五十年瞬间成功」——它花了半个世纪才突然爆发,而我们对智能本质的理解,仍停留在当年牛顿对电一无所知的阶段。
《连线》创始主编、传奇科技思想者 Kevin Kelly 在与 Every 的对话中回顾了自己从互联网先驱到建造者的历程。他提出一个发人深省的类比:我们对智能的认知,就像 Isaac Newton 时代的人面对电——「我们完全不知道它是什么,即使我们已经能使用它、识别它」。他怀疑智能并非单一事物,而是像化学元素一样存在多种「化合物」,将被工程化去完成不同任务,甚至我们可能永远无法完全理解它们如何工作。
Kelly 对物理世界的进展持谨慎态度:机器人的到来会比人们想象的长得多——人体是一台 25 瓦的超级计算机加上四分之一马力的引擎,这种能效差距短期内无法靠算力填平。VR 也仍在等待它的「LLM 时刻」。但他强调,在 AI 内部,推理能力是在语言翻译中意外浮现的——下一个重大突破可能同样来自意想不到的地方。
关于如何面对快速移动的科技前沿,Kelly 引用 Jeff Bezos 的做法:把生意建立在不变的事物上。他自己则通过 Long Now Foundation 保持万年尺度的视角——既拥抱转瞬即逝的前沿,也回望过去一万年。「AI 是一场五十年的瞬间成功」,耐心与长期主义,才是这个时代最稀缺的建造者品质。
收听原片 ↗Codex 与 ChatGPT 负责人:这周的主题是廉价到无法计量的智能,明天我们继续发布。另外,GPT-5.6 Sol 在 ARC-AGI-3 上已达到 SoTA——只需两个设置改动:允许它跨多个上下文窗口推理,并配合我们规范化的压缩实现。 原推 →
Box CEO:OpenAI agent 沙箱逃逸事件对 AI 在企业中的扩散有非常现实的影响。它展示了 agent 的力量与能力,也说明企业必须加固系统与环境来为 agent 时代做准备。随着 AI 变强,推理会流向最有经济价值的任务,其余一切都会被价格挤出。 原推 →
AI 大大提升了我的生产力,但我开始注意到三个暗面:一是变得懒得读任何原文,只依赖 AI 摘要;二是让 agent 乱改文件而不审查它们做了什么;三是…… Claude Design 有个我钟爱的简单特性——它总是先问澄清问题再动手,我惊讶于其他 AI 设计工具还没抄这个。 原推 →
Replit CEO:有些模型擅长 CSS,有些擅长 SVG,还有些擅长动画——Replit Design 由开源与闭源模型的最佳组合驱动,生成更优的美学。这是最好的 AI 设计工具,既有品味又有趣。后提示词时代(post-prompt era)来了。 原推 →
非常兴奋:我们离能显著加速科学发现的模型已经很近了。加速科学最好的方式是赋能科学家,而不是试图自己搞定一切。我们都值得享有这些成果。 原推 →
Every 团队几乎每个人都在为 ChatGPT for Work 的语音模式惊叹,很久没见过这么高的情绪了。关于沙箱逃逸:恶意者未来当然会故意利用模型做这种事,但好消息是——攻击中 OpenAI 的安全分类器是关闭的、模型被明确指示去利用漏洞,而 HuggingFace 的 AI 反而主动浮出了攻击。 原推 →
YC CEO:「AI 数据中心缩减派」(Degrowthers)正在赢,而且这其实是一场在我们眼皮底下进行的心理战,在每个蓝州都在赢。资深创始人在智能时代正像陈年美酒一样越老越醇。 原推 →
Meta AI 高级总监(前 Google,曾领导 Gemini/Veo/Nano Banana):7 个月过去,这句话依然成立——最大的 alpha 在于理解模型前沿。 原推 →
Anthropic 今日发布全新的 Swift package,让 Apple 开发者可以在 Foundation Models 框架中直接调用 Claude,为更复杂的工作流提供支持。开发者现在可以先用 Apple 设备端模型处理快速本地任务(如摘要、提取),当请求需要多步推理、代码生成时,无缝切换到 Claude——通过 guided generation,只需三行代码即可返回类型化的 Swift 值。
Claude 还能联网搜索最新信息并执行代码进行数据分析,并将响应流式传回同一个视图。由于 Apple 框架通过 @Generable 注解返回类型化值,开发者获得的是干净的输入而非原始用户文本。一个日志应用可以在设备端生成每日提示,再让 Claude 跨数月条目寻找线索;一个学习应用可以在设备端定义术语,再交给 Claude 解释「这对整体意味着什么」——每一步都配最合适的模型,用户只有一种体验。
该支持将从明天起可用,覆盖 iOS 27、iPadOS 27、macOS 27、visionOS 27 与 watchOS 27:加入项目、用 Anthropic API key 登录、把设备端的类型化输出传进 Claude 请求即可,package 会自动处理流式、工具调用与结构化响应。
阅读原文 ↗