Scaling Managed Agents-Decoupling the brain from the hands
这是一篇 Anthropic 关于 Claude Managed Agents 的工程文章。它关心的不是“某个 harness 怎么设计”,而是如何把长时运行 agent 系统中的核心部件抽象成稳定接口,使底层 harness、sandbox 和恢复机制可以持续演化,而不把整套系统绑死在某一代实现细节上。
- 文章的出发点是一个 Anthropic 已经反复强调的判断:harness 会随着模型能力提升而持续过时,因此不应该把整套系统绑定到当前一代 harness 假设上。
- Managed Agents 的核心抽象是把 agent 系统虚拟化成三个组件:
session、harness、sandbox。 session是 append-only 的事件日志,负责 durably 记录发生过什么;harness是调用 Claude、路由工具和管理循环的“脑”;sandbox是代码执行和文件编辑发生的“手”。- 文章的关键架构动作是把“brain” 从容器里搬出来,并和 “hands” 与 “session” 解耦。
- 在旧架构里,session、harness 和 sandbox 都绑在一个容器里,容器成了必须被人工护理的
pet;容器挂掉时,session 也一起丢,调试还会碰到用户数据与系统状态缠在一起的问题。 - 解耦之后,
harness不再假设自己和 sandbox 同居。它只通过统一接口调用手:execute(name, input) -> string。 - 这让 sandbox 变成可替换的
cattle。如果某个 sandbox 挂了,Claude 看到的只是一个 tool-call error,系统可以按provision({resources})的标准流程再起一个新的。 session独立出来后,harness 自己也可以是cattle。崩了就用wake(sessionId)拉起新 harness,再通过getSession(id)和emitEvent(id, event)从外部 durable log 继续跑。- 这篇文章也把安全边界重新画了一遍。问题不只是“prompt injection 会不会骗 Claude 做错事”,而是以前不受信任代码和凭据在同一容器里,导致一旦被拿下,攻击者能直接读环境变量和令牌。
- 新架构的做法是把 credential 拿出 sandbox:Git token 在 sandbox 初始化时被预先接入 remote;MCP 工具的 OAuth token 则放进外部 vault,由代理按 session token 取用,harness 甚至不直接知道真实 credential。
- 文章还给了一个很重要的上下文观点:
session不是 Claude 的 context window。它更像一个可持久查询的外部事件对象,Claude 或 harness 可以通过getEvents()按位置切片、回看、重组,而不是把所有历史都塞进当前上下文。 - 这使 context engineering 和 durable storage 分离:哪些内容进入当前上下文,由 harness 决定;历史是否可恢复、如何被重新查询,由 session 保证。
- 在性能上,brain/hand 解耦也解决了
TTFT问题。以前每个 brain 都要先等容器拉起、仓库 clone 和环境初始化;现在只有需要手的时候才 provision 手,因此p50 TTFT下降约60%,p95 TTFT下降超过90%。 - 文章最后把这一整套抽象命名为
meta-harness:不是为某个特定任务预设唯一 harness,而是提供一层足够稳定的接口,让未来不同的 harness 都可以挂载其上。
ℹ️ Conflict:
- 把系统做成 meta-harness 能提高演化能力,但也会把复杂度从“单一容器内部”转移到“跨 session / harness / sandbox / proxy / vault 的接口设计”。
execute(name, input) -> string这类统一接口很强大,但也意味着模型要理解更多“手”的分布和差异;当 agent intelligence 不足时,这种抽象反而可能成为负担。- durable session 和外部 credential vault 提升了恢复性和安全性,但也让系统更依赖 event log、一致性和代理层;这些基础设施一旦出问题,失效模式会比单机脚本更复杂。
- Meta-harness
- Agent scaffold
- Programmatic tool calling
- Model Context Protocol (MCP)
- Sandboxing for agents
- Anthropic
- Agentic engineering
- Anthropic, “Scaling Managed Agents-Decoupling the brain from the hands”.
- 原文摘录:[llm-wiki/raw/anthropic/Scaling Managed Agents-Decoupling the brain from the hands](/raw/anthropic/Scaling Managed Agents-Decoupling the brain from the hands.md)