AI Builders Digest 0709:Claude Code /checkup 爆火,Anthropic Agent 架构深度解析
- Claude Code /checkup 命令以 6631 赞爆火,自动清理无用 Skills、MCP 和插件并去重配置
- Anthropic 提出 Managed Agents 架构:将 session、harness、sandbox 解耦为独立接口
- OpenAI 预告新一轮发布,Grok 4.5 登陆 Vercel 和 Cursor,模型竞争加速
- 作家 Greg 将 AI 作为研究助理,但拒绝让 AI 碰自己的写作以保持声音
今天的 AI Builders Digest 覆盖了过去 24 小时最有价值的动态:Claude Code 全新 /checkup 命令意外爆火、Anthropic 三篇工程博客深挖 Agent 架构演进、OpenAI 预告新一轮发布、Grok 4.5 全面登陆 Vercel 和 Cursor,以及一位作家如何使用 AI 却拒绝让 AI 碰他的文字。
今日总结
主线:Agent 工具链从「能用」走向「可维护」,架构层与用户层同时加速。
Claude Code 的 /checkup 命令以 6631 赞成为今天最大爆点。 Boris Cherny 发布的这个命令能自动清理无用 Skills、MCP 和插件,去重本地与仓库中的 CLAUDE.md,并将根级配置拆分为嵌套结构。6631 赞说明一个问题在群体中酝酿已久:Agent 配置在快速迭代中积累了大量的碎片和冗余,终于有人动手收拾了。
Anthropic 连发三篇工程博客,从架构层面展示 Agent 系统设计的深度思考。 Managed Agents 的「decouple brain from hands」架构:将 session、harness、sandbox 虚拟化为独立接口,本质上是把操作系统级别的抽象思想引入 Agent 世界。同时发布的 self-hosted sandbox 和 MCP tunnel 让企业客户可以在自有基础设施上运行 Agent 工具执行,兼顾安全与灵活性。
模型层的竞争进入新阶段。 OpenAI 的 Thibault Sottiaux 用「This week we are SHIPPING」和深夜 sushi/taco 照片暗示即将发布。Grok 4.5 同时登陆 Vercel 和 Cursor,被评价为「handling complex knowledge worker tasks」变得极好。而 Sam Altman 的几条轻松推文也拿到 2000+ 赞,暗示着某种行业情绪的好转。
今日关键词: /checkup · Managed Agents · OpenAI 预告 · Grok 4.5 · 解耦架构
官方博客
Anthropic Engineering:Claude Code 质量事故完整复盘
Anthropic 发布了一篇详细的事后分析,追溯了过去一个月用户反馈的 Claude Code 质量下降问题。调查确认了三次独立变更导致了问题,API 和推理层从未受影响。
- 3 月 4 日:将 Claude Code 默认推理努力从 high 改为 medium,以解决 UI 冻结感问题。这是错误权衡,4 月 7 日回退。
- 3 月 26 日:对闲置超 1 小时的会话清除旧思考内容以降低延迟,但 bug 导致后续每轮都在清除,使 Claude 显得健忘和重复。4 月 10 日修复。
- 4 月 16 日:添加系统提示指令降低冗余,但与其他提示变更组合后损害了编码质量。4 月 20 日回退。
Anthropic 表示这三种变更各自影响不同流量切片和不同时间表,「聚合效果看起来像是广泛而不一致的质量下降。」从 4 月 23 日起为所有订阅者重置了用量限制。
🔗 https://www.anthropic.com/engineering/april-23-postmortem
Anthropic Engineering:Scaling Managed Agents — 将大脑与双手解耦
这是本周最重要的工程文章。Anthropic 详细阐述了 Managed Agents 的架构设计哲学:将 Agent 的「大脑」(Claude 及 harness)与「双手」(sandbox 和工具执行)和「会话」(事件日志)解耦为独立接口。
核心洞察:harness 会编码对 Claude「不能做什么」的假设,但这些假设会随模型能力提升而过期。例如,Sonnet 4.5 会在接近上下文限制时提前收尾(「context anxiety」),需要通过 context reset 解决;但 Opus 4.5 根本没有这个行为,reset 变成了「死重」。
架构演进的核心决策:从单体容器(pet)转向解耦架构(cattle)。一旦容器崩溃,harness 会将其捕获为工具调用错误,让 Claude 决定是否重试。安全层面,凭证永远无法从 sandbox 内部访问:Git 令牌在初始化时注入本地 git remote,Agent 从未直接接触凭证。
「这些抽象层会超越任何特定实现,就像 1970 年代的 read() 命令在现代 SSD 上依然有效。」—— Anthropic Engineering
🔗 https://www.anthropic.com/engineering/managed-agents
Claude Blog:Managed Agents 新功能 — 自托管 Sandbox 与 MCP Tunnel
Claude Managed Agents 新增 self-hosted sandbox(公开 beta)和 MCP tunnel(研究预览)。Agent 工具执行可以在企业自有基础设施或托管提供商(Cloudflare、Daytona、Modal、Vercel)上运行,而编排、上下文管理和错误恢复仍留在 Anthropic 基础设施上。
每个提供商各有特色:Cloudflare 用 microVM 和轻量级 isolate 运行 sandbox;Daytona 提供长时间运行、有状态的完整可组合计算机;Modal 的容器运行时可在毫秒内启动任意镜像;Vercel 结合 VM 安全、VPC peering 和百万级 sandbox 并发。
🔗 https://claude.com/blog/claude-managed-agents-updates
播客精选
AI & I by Every:作家如何用 AI 而不失去自己的声音 — Greg(作家、摄影师)
Greg 是一位以写作、摄影和构建「n of one software」闻名的创作者。他与 Dan Shipper 的对话充满反直觉的见解:他每天醒来直到午后才接触互联网,有一台专门用于写作的笔记本电脑,禁止一切「有趣」的操作。
Greg 在 Fable 5 上花费了整整四天重构代码库。「Opus 4.8 已经足够好到能构建任何东西了。如果你告诉我余生只能用 Opus 4.8,我会说:太好了。」但他坚决不让 AI 碰他的写作——「那是我的意义所在,就是身在那片混乱之中。」AI 在他工作流中的角色是研究助理和文化敏感性检查工具。
他重建了 Campaign Monitor 的替代品,将年费从 67000 美元降到约 150 美元。他还为会员构建了一个叫「The Good Place」的社交网络:每天只能发 2 条,照片默认为黑白,一周后所有内容消失。「整个互联网应该每两周删除一次」是他的异端观点之一。
「AI 在按照标准操作流程执行方面非常出色。但品味和对卓越的追求仍然需要指导和方向。」—— Natalia(上期嘉宾,被 Greg 引用)
🔗 https://www.youtube.com/watch?v=7ND0lQmLJlA
X/Twitter 动态
Boris Cherny(Anthropic Claude Code 团队):/checkup 命令,6631 赞
这是今天数据量最大的推文。Boris 发布了 Claude Code 的全新 /checkup 命令,功能包括:清理未使用的 Skills、MCP 和插件以节省上下文;去重本地 CLAUDE.md 与仓库中的 CLAUDE.md;将根级 CLAUDE.md 拆分为嵌套结构加 Skills;关闭缓慢的 hooks。6631 赞和 519 转说明 Agent 配置管理的痛点有多普遍。
Cat Wu(Anthropic Claude Code + Cowork):Claude Tag 多人协作直播预告
「AI 曾经只能帮你完成句子,然后它开始写整个功能,现在它将改变你与团队协作的方式。」Cat 宣布将于 7 月 9 日上午 10 点 PT 直播演示从单人 Claude Code 到多人 Claude Tag 的演进,并深入讲解 Claude Tag 的底层原理。481 赞,AI 协作的下一阶段正在展开。
Thibault Sottiaux(OpenAI Codex & ChatGPT 团队):OpenAI 即将发布
两条推文叠加出强烈信号:「We were resetting last week. This week we are SHIPPING. Tune in for the livestream at 10am.」(2442 赞)。随后深夜 sushi/taco 照片:「You know OpenAI is cooking when the sushi and tacos orders pile at the entrance of the office at 11pm.」(2030 赞)。OpenAI 新一轮发布已在倒计时。
🔗 https://x.com/thsottiaux/status/2074885402918601082
🔗 https://x.com/thsottiaux/status/2075103845114663325
Thariq(Anthropic Claude Code):软件重写可以又好又便宜又快速
Thariq 提出一个观点:「这对你关于软件工程的认知应该是一次重大更新:重写可以做到又好、又便宜、又快速。」他承认大多数应用没有 Bun 那样的可测试性和可验证性,但模型会持续填补这些缺口。762 赞。
Guillermo Rauch(Vercel CEO):Grok 4.5 登陆 Vercel + 所有软件都将 Native
Rauch 宣布 Grok 4.5 对全体 Vercel 客户可用(495 赞),并分享了一条更宏大的宣言:「AI will make all software Native. Uncompromising performance and platform affinity.」(646 赞)。他还演示了个人生产力 Agent 的完整栈:「the blissful sound of all the pieces of the agent stack clicking together.」
🔗 https://x.com/rauchg/status/2074920996201796067
🔗 https://x.com/rauchg/status/2075018147330232707
Ryo Lu(Cursor 设计):Grok 4.5 在 Cursor 上可用
「the start of a new era — try Grok 4.5 in Cursor and let us know how it feels!」模型之争正在从 API 层渗透到每一个开发者工具。497 赞。
Amjad Masad(Replit CEO):Agent 代码不应与手写代码比较
「我们什么时候才能停止将自主 Agent 与手写代码进行比较?你不会看到编译器与手写汇编进行比较。」Masad 同时发起了一个有趣的投票:「Should we add CAD 3D modeling to Replit?」(369 赞),暗示 Replit 正在探索更广阔的创作边界。
🔗 https://x.com/amasad/status/2075080984211624154
🔗 https://x.com/amasad/status/2075003156745089264
Zara Zhang(Builder):Agent 化团队的意外副作用
Zara 分享了一个真实的 Agent-pilled 创始人的故事:「他给所有团队成员买了 Codex Max,每个人几乎整天通过跟自己的 Codex 对话完成所有工作。副作用是:人们不再互相说话了。会议被取消,协作降到最低,团队文化变差。」238 赞,这是 Agent 化进程中一个被低估的代价。
Peter Steinberger(OpenClaw 创始人):OpenAI 雇佣了我,不是 OpenClaw
Steinberger 宣布 OpenClaw 基金会独立,拥有赞助商而非所有者,并首次有了全职维护团队。「OpenAI hired me, not OpenClaw. The OpenClaw Foundation is independent, with sponsors rather than owners.」1518 赞,47 转,这条推文厘清了个人与开源项目之间的边界。
Josh Woodward(Google VP Gemini):公开征集 Gemini 不足
「What’s something that you’re surprised Gemini App can’t do well, and we should have fixed a long time ago?」1165 赞,59 转。Google VP 直接向用户征集最痛的点,这种做法本身就是一个信号。
Aditya Agarwal(South Park Commons GP):别浪费这个时刻
「每个我见到的创始人都担心错过这个时刻。最好的创始人担心的是浪费它。」Agarwal 列出三种浪费方式:忽视世界已经改变、认为纯软件还能像 5 年前一样创造价值、只构建小东西。255 赞,49 转。
Matt Turck(FirstMark VC):世界杯上的 AI 内容进化
「This also has been the World Cup of AI content going from slop to ‘wait, this kinda slaps’.」974 赞,82 转。AI 生成内容的质量曲线正在快速上升,从「垃圾」到「等等,这还不错」。
数据采集时间:2026-07-09 07:28 CST
评论互动