Reasoning tools for agents
Reasoning tools for agents 指一类不直接获取外部信息、也不直接改变环境,而是专门为 agent 提供显式思考空间的工具设计模式。它的目标不是扩展行动能力,而是把“停下来梳理约束、检查信息缺口、复盘工具结果”这件事显式插入工具调用链中。
- 这类工具通常是 no-op:不访问数据库、不写文件、不改状态,只把一段 reasoning 记录到可见日志或 scratchpad 里。
- 它们最有价值的地方在于时机。相比回答前的预先思考,这类工具更适合在 agent 已经看到外部 tool result 之后,再基于新信息做局部再推理。
- 对政策重、步骤长、顺序性强的任务,这种“中途暂停”常能提高一致性,因为模型不必在收到新信息后立刻匆忙采取动作。
- 这类设计与 Tool ergonomics for agents 相关,因为它说明工具不一定只负责“对外做事”,也可以负责“整理认知过程”。
- 它也与 Agent scaffold 相连,因为是否给模型这样的 reasoning slot、何时鼓励使用、要不要在 prompt 里示范,都属于 scaffold 决策。
- 它和 Programmatic tool calling 有相邻关系,但不相同。程序化工具调用更像把控制流下沉到代码;reasoning tool 则是在自然语言工具链里显式插入一个思考节点。
- 这类工具通常需要 prompt 配合。只暴露工具本身可能略有收益,但在复杂领域里,“什么时候用”“在里面检查什么”往往决定了大部分增益。
- 从更广的视角看,这是一种把推理过程结构化的方式:不是单纯增加模型 token,而是给特定决策点增加一个专用认知动作。
ℹ️ Conflict:
- reasoning tool 不等于 extended thinking。前者偏响应中途的局部再思考,后者偏回答前的整体深思,两者适用时机不同。
- 随模型内生推理能力提升,这类外置 reasoning tool 的边际价值可能下降,甚至被更强的原生 thinking mode 吸收。
- 如果任务本身简单、工具链很短或没有复杂约束,这类工具往往只会增加额外 token 和系统复杂度。
- The “think” tool- Enabling Claude to stop and think in complex tool use situations
- Tool ergonomics for agents
- Programmatic tool calling
- Agent scaffold
- Anthropic
- Agentic engineering
- Anthropic, “The “think” tool- Enabling Claude to stop and think in complex tool use situations”, 2025-03-20.
- 原文摘录:[llm-wiki/raw/anthropic/The “think” tool- Enabling Claude to stop and think in complex tool use situations](/raw/anthropic/The “think” tool- Enabling Claude to stop and think in complex tool use situations.md)