Claude Code 团队负责人发布了 /checkup 命令,可一键完成七项环境维护:清理未使用的 skills/MCP/plugins、去重 CLAUDE.md、拆分根配置、关闭慢速 hooks、自动更新、启用 auto mode、预批准只读命令。每项操作执行前都会与用户确认。该推文获得 6,631 次点赞和 519 次转发,是今日互动量最高的帖子。 原推 →
今日最重磅的产品更新来自 Anthropic——Claude Code 团队的 Boris Cherny 发布了全新命令 /checkup,这条推文获得了惊人的 6,631 次点赞和 519 次转发。/checkup 可以一键完成七项环境维护操作:清理未使用的 skills/MCP/plugins 以节省 context、去重本地与已签入的 CLAUDE.md、将根 CLAUDE.md 拆分为嵌套结构和 skills、关闭慢速 hooks、自动更新到最新版本、默认启用 auto mode、以及预批准常用的只读命令。每一步操作都会在执行前与用户确认。这标志着 AI 编程工具从「功能堆砌」转向「体验维护」——当开发者的 Agent 配置越来越复杂时,「健康检查」成为了刚需。
在模型生态层面,Grok 4.5 本周成为焦点。Vercel CEO Guillermo Rauch 宣布 Grok 4.5 已对所有 Vercel 客户开放,Cursor 设计负责人 Ryo Lu 则宣布用户可在 Cursor 中直接使用 Grok 4.5,称之为「一个新纪元的开始」。Box CEO Aaron Levie 对此评价道,最新一批 AI 模型在处理复杂知识工作者任务方面变得「疯狂地好」,尤其是在法律、专业服务和医疗等高门槛领域,Grok 4.5 在成本和性能的平衡上尤为出色。多模型共存正在成为企业 AI 的新常态。
一个有趣的行业暗线是「打磨感」(polished)正在与「AI 味」(slop)产生关联。Nikunj Kothari 引用了一篇关于这个趋势的分析并预言:「打磨感正在以你想象不到的速度与 slop 产生关联——我们将看到一次向原始和人性的重大回归。」这与播客中作家 Greg 的观点形成呼应:他在一台专门用来写作的笔记本电脑上屏蔽了一切互联网连接,因为他认为「如果不建立这些屏障,我将失去与自身最有价值部分的连接」。与此同时,OpenAI 的 Thibault Sottiaux 透露团队深夜仍在密集发货,暗示 OpenAI 正在酝酿新动作。Anthropic 的 Cat Wu 则预告了一场关于 Claude Tag(多人协作模式)的深度演示——AI 正从「单人工具」进化为「团队基础设施」。
Every CEO Dan Shipper 的播客节目本期邀请了一位特殊的嘉宾——一位坚持用 AI 辅助写作但绝不让 AI 代笔的作家。他的核心理念可以用一句话概括:「我醒来的第一件事是不碰互联网——在午餐后很久之前,我不会看手机、不会上网。一旦触碰手机,我就感受到化学反应的变化,无法再进入深度思考。」这不是技术恐惧症,而是一种刻意的注意力管理策略。
他对 AI 工具的态度同样充满矛盾感:「使用 AI 感觉非常像多巴胺驱动——我强烈相信你可以用它完成不可思议的工作,但它同时也是一个老虎机。」为此,他专门准备了一台「只能用来写作」的笔记本电脑——上面屏蔽了一切有趣的网站和应用。他的理由是:「不会有太多人去思考或写作我被吸引去写的那些奇怪的书。作为一个人类,这感觉是一件值得投入精力的有价值的事情。」
这个故事之所以在今天尤其有意义,是因为整个行业正在经历「打磨 vs. 真实」的审美转向。当 AI 生成的内容越来越精致时,刻意的粗糙和人性反而成为了稀缺品。正如 Nikunj Kothari 所说:「我们将看到一次向原始和人性的重大回归。」这位作家的工作方式——用 AI 作为工具但绝不让它取代思考——或许代表了一种正在浮现的新范式:不是人 vs. AI,而是人在 AI 的帮助下成为更极致的人。
收听原片 ↗Claude Code 团队负责人发布了 /checkup 命令,可一键完成七项环境维护:清理未使用的 skills/MCP/plugins、去重 CLAUDE.md、拆分根配置、关闭慢速 hooks、自动更新、启用 auto mode、预批准只读命令。每项操作执行前都会与用户确认。该推文获得 6,631 次点赞和 519 次转发,是今日互动量最高的帖子。 原推 →
AI 基础设施领域活跃评论人分享了两个观点。其一,称赞 Cognition 团队在处理中文模型方面做了「困难的事」——构建了多语言宣传与审查评估体系,并在后训练中成功校正,同时以 1000 tok/s 的速度低价服务。其二,赞赏 Theo 主题演讲中使用 Excalidraw 手绘风格幻灯片而非千篇一律的 AI 生成风格,认为这「立刻传达了人性、思考和精炼」。 原推 →
Google 副总裁向社区抛出一个直击痛点的问题:「有什么事情是你惊讶 Gemini 做不好、而我们早就应该修复的?」这条推文获得 1,165 次点赞和超过 1,500 条回复,成为一次大规模用户需求征集。这种公开征集反馈的姿态在大厂高管中并不常见,暗示 Google 可能在为 Gemini 的下一轮改进做准备。 原推 →
OpenAI Codex 和 ChatGPT 团队成员透露了两条信息。其一,分享了一张深夜 11 点办公室门口堆满寿司和墨西哥卷饼外卖的照片:「你知道 OpenAI 在认真搞事情的时候,就是寿司和墨西哥卷饼在办公室门口堆成山的时候。奇怪的是,我们需要吃饭才能搞研发。」其二,预告团队「上周在调整,这周在发货」,并邀请社区关注 10 点的直播。 原推 →
Anthropic Claude Code + Cowork 团队预告了一场深度技术演示:从「单人模式 Claude Code」到「多人模式 Claude Tag」的演进历程。她描述了 Claude Tag 的核心能力:「AI 曾经帮你补完句子,然后帮你写整个功能。现在,Claude Tag 可以监控你的频道、为你做主动工作、整个团队都可以引导它,而且它记得你上周告诉它的事情。」 原推 →
Replit CEO 提出了一个尖锐的问题:「我们什么时候停止将自主 Agent 与手写代码做比较?你不会看到编译器拿自己和工程师手写汇编做对比。」这条推文引发广泛讨论,核心观点是:当 Agent 的能力达到一定阈值后,与传统编程的比较框架已经失效,行业需要新的评价维度。他还发起了一个投票,询问是否应该在 Replit 中加入 CAD 3D 建模功能。 原推 →
Claude Code 团队成员提出了一个重要观点:「这应该是你软件工程模型中的一个重大更新——重写可以是好的、便宜的、快速的。当然大多数应用不像 Bun 那样可测试和可验证,但模型会继续进步来填补这些差距。」这条推文获得 762 次点赞,核心信息是 AI 时代「重写」的经济学已经彻底改变。 原推 →
独立 Builder 分享了一个发人深省的观察:一位创始人给全团队购买了 Codex Max,所有人整天通过与 Codex 对话完成工作。副作用是——人们不再互相交谈,会议被取消,协作降到最低,团队文化恶化。「我们不能只停留在人-AI 协作,而要推进到人-人-AI 协作。」她还吐槽 Codex 的前端设计能力是阻碍她更频繁使用的最大障碍。 原推 →
Anthropic Engineering 博客发布了关于 Claude Managed Agents 的深度架构文章。核心设计哲学是借鉴操作系统的虚拟化思想——将 Agent 的三个核心组件(session、harness、sandbox)分别抽象化,使得每一层的实现可以独立替换而不影响其他层。文章举了一个生动的例子:Claude Sonnet 4.5 在接近 context 限制时会「焦虑」地提前结束任务,团队通过在 harness 中加入 context reset 来解决;但同样的 harness 在 Claude Opus 4.5 上运行时,发现这个行为已经消失——reset 变成了「dead weight」。
文章强调了「频繁质疑 harness 的假设」的重要性:harness 编码了关于 Claude 自身能力不足的假设,但这些假设会随着模型进步而过时。Managed Agents 将 session 定义为「所有发生过的事情的只追加日志」,将 harness 定义为「调用 Claude 并将工具调用路由到相关基础设施的循环」,将 sandbox 定义为「Claude 可以运行代码和编辑文件的执行环境」。这种解耦设计使得企业可以在自己的基础设施上运行 sandbox,同时让 Anthropic 负责 Agent 的编排和上下文管理。
配套更新方面,Claude Managed Agents 现已支持自托管沙箱和 MCP tunnels(研究预览)。沙箱可在 Cloudflare、Daytona、Modal 或 Vercel 等托管提供商上运行,Agent 执行的敏感文件、包和服务保持在企业自身基础设施内,网络策略、审计日志和安全工具均在企业边界内运行。
阅读原文 ↗