跳转到内容

Scaling Managed Agents-Decoupling the brain from the hands

这是一篇 Anthropic 关于 Claude Managed Agents 的工程文章。它关心的不是“某个 harness 怎么设计”,而是如何把长时运行 agent 系统中的核心部件抽象成稳定接口,使底层 harness、sandbox 和恢复机制可以持续演化,而不把整套系统绑死在某一代实现细节上。

  • 文章的出发点是一个 Anthropic 已经反复强调的判断:harness 会随着模型能力提升而持续过时,因此不应该把整套系统绑定到当前一代 harness 假设上。
  • Managed Agents 的核心抽象是把 agent 系统虚拟化成三个组件:sessionharnesssandbox
  • session 是 append-only 的事件日志,负责 durably 记录发生过什么;harness 是调用 Claude、路由工具和管理循环的“脑”;sandbox 是代码执行和文件编辑发生的“手”。
  • 文章的关键架构动作是把“brain” 从容器里搬出来,并和 “hands” 与 “session” 解耦。
  • 在旧架构里,session、harness 和 sandbox 都绑在一个容器里,容器成了必须被人工护理的 pet;容器挂掉时,session 也一起丢,调试还会碰到用户数据与系统状态缠在一起的问题。
  • 解耦之后,harness 不再假设自己和 sandbox 同居。它只通过统一接口调用手:execute(name, input) -> string
  • 这让 sandbox 变成可替换的 cattle。如果某个 sandbox 挂了,Claude 看到的只是一个 tool-call error,系统可以按 provision({resources}) 的标准流程再起一个新的。
  • session 独立出来后,harness 自己也可以是 cattle。崩了就用 wake(sessionId) 拉起新 harness,再通过 getSession(id)emitEvent(id, event) 从外部 durable log 继续跑。
  • 这篇文章也把安全边界重新画了一遍。问题不只是“prompt injection 会不会骗 Claude 做错事”,而是以前不受信任代码和凭据在同一容器里,导致一旦被拿下,攻击者能直接读环境变量和令牌。
  • 新架构的做法是把 credential 拿出 sandbox:Git token 在 sandbox 初始化时被预先接入 remote;MCP 工具的 OAuth token 则放进外部 vault,由代理按 session token 取用,harness 甚至不直接知道真实 credential。
  • 文章还给了一个很重要的上下文观点:session 不是 Claude 的 context window。它更像一个可持久查询的外部事件对象,Claude 或 harness 可以通过 getEvents() 按位置切片、回看、重组,而不是把所有历史都塞进当前上下文。
  • 这使 context engineering 和 durable storage 分离:哪些内容进入当前上下文,由 harness 决定;历史是否可恢复、如何被重新查询,由 session 保证。
  • 在性能上,brain/hand 解耦也解决了 TTFT 问题。以前每个 brain 都要先等容器拉起、仓库 clone 和环境初始化;现在只有需要手的时候才 provision 手,因此 p50 TTFT 下降约 60%p95 TTFT 下降超过 90%
  • 文章最后把这一整套抽象命名为 meta-harness:不是为某个特定任务预设唯一 harness,而是提供一层足够稳定的接口,让未来不同的 harness 都可以挂载其上。

ℹ️ Conflict:

  • 把系统做成 meta-harness 能提高演化能力,但也会把复杂度从“单一容器内部”转移到“跨 session / harness / sandbox / proxy / vault 的接口设计”。
  • execute(name, input) -> string 这类统一接口很强大,但也意味着模型要理解更多“手”的分布和差异;当 agent intelligence 不足时,这种抽象反而可能成为负担。
  • durable session 和外部 credential vault 提升了恢复性和安全性,但也让系统更依赖 event log、一致性和代理层;这些基础设施一旦出问题,失效模式会比单机脚本更复杂。
  • Anthropic, “Scaling Managed Agents-Decoupling the brain from the hands”.
  • 原文摘录:[llm-wiki/raw/anthropic/Scaling Managed Agents-Decoupling the brain from the hands](/raw/anthropic/Scaling Managed Agents-Decoupling the brain from the hands.md)