无论底层是 ReAct、Plan-and-Execute 还是 Tree of Thoughts,成熟的 Agent 系统都围绕一个循环运转:

  1. 规划(Plan):把目标拆成可执行子任务,确定顺序与依赖
  2. 工具调用(Act):按需调用搜索、代码执行、数据库等工具,获取中间结果
  3. 观察(Observe):读取工具返回,判断是否符合预期
  4. 反思(Reflect):发现偏差则修正计划或换工具,循环直至完成

稳定运行的要点

  • 任务要可验证:为每个子任务定义「成功标准」,避免 Agent 自说自话
  • 工具要收敛:暴露给 Agent 的工具越少越好,降低误调用
  • 加护栏:关键操作前要求确认;设置最大步数与超时,防止死循环
  • 留痕迹:记录每一步的规划与工具调用日志,便于排查与复盘

常见失败模式

Agent 最常见的失败不是「不会做」,而是「做错不回头」——拿到一个看似合理的中间结果就继续。给 Agent 配置「校验工具」(如跑测试、查权威源)能显著提升成功率。