跳转到内容

Reasoning tools for agents

Reasoning tools for agents 指一类不直接获取外部信息、也不直接改变环境,而是专门为 agent 提供显式思考空间的工具设计模式。它的目标不是扩展行动能力,而是把“停下来梳理约束、检查信息缺口、复盘工具结果”这件事显式插入工具调用链中。

  • 这类工具通常是 no-op:不访问数据库、不写文件、不改状态,只把一段 reasoning 记录到可见日志或 scratchpad 里。
  • 它们最有价值的地方在于时机。相比回答前的预先思考,这类工具更适合在 agent 已经看到外部 tool result 之后,再基于新信息做局部再推理。
  • 对政策重、步骤长、顺序性强的任务,这种“中途暂停”常能提高一致性,因为模型不必在收到新信息后立刻匆忙采取动作。
  • 这类设计与 Tool ergonomics for agents 相关,因为它说明工具不一定只负责“对外做事”,也可以负责“整理认知过程”。
  • 它也与 Agent scaffold 相连,因为是否给模型这样的 reasoning slot、何时鼓励使用、要不要在 prompt 里示范,都属于 scaffold 决策。
  • 它和 Programmatic tool calling 有相邻关系,但不相同。程序化工具调用更像把控制流下沉到代码;reasoning tool 则是在自然语言工具链里显式插入一个思考节点。
  • 这类工具通常需要 prompt 配合。只暴露工具本身可能略有收益,但在复杂领域里,“什么时候用”“在里面检查什么”往往决定了大部分增益。
  • 从更广的视角看,这是一种把推理过程结构化的方式:不是单纯增加模型 token,而是给特定决策点增加一个专用认知动作。

ℹ️ Conflict:

  • reasoning tool 不等于 extended thinking。前者偏响应中途的局部再思考,后者偏回答前的整体深思,两者适用时机不同。
  • 随模型内生推理能力提升,这类外置 reasoning tool 的边际价值可能下降,甚至被更强的原生 thinking mode 吸收。
  • 如果任务本身简单、工具链很短或没有复杂约束,这类工具往往只会增加额外 token 和系统复杂度。
  • Anthropic, “The “think” tool- Enabling Claude to stop and think in complex tool use situations”, 2025-03-20.
  • 原文摘录:[llm-wiki/raw/anthropic/The “think” tool- Enabling Claude to stop and think in complex tool use situations](/raw/anthropic/The “think” tool- Enabling Claude to stop and think in complex tool use situations.md)