过去夏天我们全力冲刺安全优先事项——能力与安全必须同步推进。Astra 已训练完成,能力与对齐均有显著提升,但我们决定放缓后续模型节奏以确保安全标准到位。「AI 正变得极其强大,没有人完全理解其后果。管理这一过渡期,优化安全性和对人类有益的结果,应该是全球最高优先级之一。」 原推 →
Anthropic 正式发布 Claude Fable 5.1,这是其旗舰模型的一次重要迭代。最大的亮点在于安全与体验的精细平衡:企业客户的安全干预(safeguards)在 Fable 5.1 中对良性请求的误判率较前代降低了 60%,基础生物学和医学问题的回退率更是下降了 85%。与此同时,Anthropic 还推出了 Enterprise Frontier Safeguards(EFS)——这是在零数据保留(ZDR)基础上的升级版,既保持企业数据不出云的安全承诺,又能在 Agent 运行过程中持续监控风险模式,被视为企业级 Agent 部署的基础设施新标准。价格方面,Fable 5.1 的企业缓存读取降至每百万 token 0.25 美元,典型 Claude Code 会话成本下降最高 38%。
OpenAI CEO Sam Altman 在同日发表长文,深入探讨了能力进展与安全节奏之间的张力。他透露,名为 Astra 的新模型已完成训练,能力与对齐均有显著提升,但因安全标准考量,后续模型的发布节奏已主动放缓。Altman 明确表示:「我们正在进入一个阶段,认为谨慎是必要的」——这不是对进展的担忧,而是对影响的理解不足。他强调,「将 AI 过渡到一个拥有丰富且强大 AI 的世界,优化安全性和对人类有益的结果,应该是世界上最高的优先级之一。」这一表态为行业设定了安全优先的基调,也暗示未来数周内 OpenAI 可能有重要发布。
在企业 AI 赛道,Box CEO Aaron Levie 分享了 Fable 5.1 在企业工作负载上的实测数据:金融服务业 (+17%)、科技行业 (+37%)、公共部门 (+16%) 均有显著提升,尤其在需要复杂推理和多步骤操作的长程 Agent 工作流中表现突出。Meta AI 总监 Madhu Guru 则从方法论角度提出,企业构建自训练系统的五个核心要素——清晰的指标定义、产品策略与路线图、历史决策知识库、内部系统连接、以及了解产品全流程的 harness——正在成为企业 AI 竞争的新壁垒。
本期播客聚焦 AI 在城市建设与安全领域的应用。Peregrine 是一家专注于利用技术改善城市、县、州层面的治理与安全的公司,其核心理念是:在金字塔的底层,安全是最重要的——人们既需要客观的安全,也需要感到安全。当这种稳定性存在时,才可能有更多可能。
Nick Noone 曾负责 Palantir 的 SOCOM 部门,在危险的高风险情报行动中长期部署。他与 Ben Rudolph 探讨了如何将 AI 技术用于消除复杂组织中信息的错误处理,同时保留个人隐私。他们的目标是构建现代城市的骨干基础设施——在保护隐私与促进社区联结之间找到平衡,而非走向 Surveillance State。
收听原片 ↗过去夏天我们全力冲刺安全优先事项——能力与安全必须同步推进。Astra 已训练完成,能力与对齐均有显著提升,但我们决定放缓后续模型节奏以确保安全标准到位。「AI 正变得极其强大,没有人完全理解其后果。管理这一过渡期,优化安全性和对人类有益的结果,应该是全球最高优先级之一。」 原推 →
Fable 5.1 的写作质量更高、语气更自然,我们听到了关于减少「Claude-speak」的反馈,已取得实质进展。安全方面:生物学安全干预较 Fable 5 降低 85%,Claude Code 用户的网络干预减少约 60%。价格调整:企业缓存读取降至 $0.25/百万 token(原 $1),典型 Claude Code 会话成本最高降低 38%。 原推 →
让 Agent 变得「不那么烦人」蕴含着巨大价值——如果用户要频繁 rage quit,就无法触达价值。我认为 UX 设计师的一个重要未被挖掘的机会是成为对话/修辞设计师(conversation/rhetoric designer)。这不是小事,但能产生巨大影响。 原推 →
Fable 5.1 新增的 Enterprise Frontier Safeguards (EFS) 是我最兴奋的 non-model 发布之一。传统 ZDR(零数据保留)无法识别 Agent 跨会话的风险模式——EFS 是 ZDR++,为 Agent 时代构建的可观测性与风险缓解层。企业数据留在自己云端,自动化监控层标记风险模式。我预计这将成为企业运行强大 AI 的标配要求。 原推 →
Box 使用 Fable 5.1 在企业复杂工作负载评测中测试:金融服务业 +17%(正确应用资本 allowances 顺序)、科技行业 +37%(识别模糊指标并计算两种形式)、公共部门 +16%(完整加权均值方法不崩溃)。这些是企业级长程 Agent 工作流能力的重大跃升。AI for cyber 即将垂直化——模型越来越擅长发现和利用漏洞,自动化修复+人工监督是唯一出路。 原推 →
自改进产品是每个公司都应该实施的核心思路。五个必要要素:①清晰的指标定义(primary/secondary/guardrail);②产品策略、路线图与重点指标;③历史决策与原则的知识库;④与内部产品系统(dashboards/APIs/MCPs/tools)的连接;⑤了解端到端产品开发流程的 harness。复杂产品可以从小原型开始,复用现有 SWE Agent。 原推 →
我不喜欢安装太多零散 skills。现在我只保留了十几个(主要是自己的),并定期删除不再使用的。我也尽量让 skills 保持精简。同时推荐运行 /claude-api prompt-audit 来清理 skills 中的冗余规则——针对最新模型做了大量优化。 原推 →
Fable 5.1 现已在 Vercel AI Gateway 上线。Fluid 平台实现了 Vercel 的行业领先构建性能、沙箱可靠性和 30 分钟函数时长——统一的 Dockerfile、安全边界、网络和文件系统让 Builds、Functions 和 Servers 可以在同一安全计算边界内协作。未来是单一的全球统一计算平台。 原推 →
使用 Fable 5.1,我们的团队开始承担以前需要数月才能完成的大胆项目。通过 Claude Code、Claude Cowork、Claude Tag 都可以体验。Fable 5.1 在复杂企业任务中展现出显著的能力跃升。 原推 →
Fable 5.1 是一个非常好的模型,我花了大量时间深入研究。对低难度任务使用更低 effort 模式效果更好——切换 effort 不再打断 prompt cache,这是一个实用的改进。 原推 →
WebMCP 被严重低估——现在可以给 Agent 提供工具调用直接交互你的网站,包括完整的 UI/UX 支持和交互式元素来构建自定义视图。Demo 展示了 Agent 如何与 El Niño 情况追踪器互动:创建自己的视图、保留人工编辑、生成可分享的链接。 原推 →
Every 团队完成了 Fable 5.1 的 Vibe Check,详细报告已发布。从低阶代码到 AI 生成代码的转变持续加速——「还记得我们以前需要手写低级代码的日子吗?」 原推 →