这个提示词用来做什么
agent 跑多步任务失败,你要判断该改数据、改提示词、改工具还是改权限
提示词全文
我有一段 agent 执行多步任务失败的轨迹(工具调用、模型输入输出、报错都在),请帮我定位根因,别停在「模型不行」这种结论上。
## 输入
任务目标:{agent 本来要完成什么,成功标准是什么}
完整轨迹:{把每一步的工具调用、参数、返回、模型输出按顺序贴进来}
环境与约束:{可用工具、权限范围、超时与重试设置}
## 输出
1)时间线还原:把失败过程还原成一条可读的时间线,标出第一个「不对劲」的步骤,而不是最后报错的那一步。
2)四类归因:把根因归到四类之一并说明证据——数据(输入缺失/脏/格式不符)、提示(指令歧义或缺少边界)、工具(接口返回不符预期、能力不足)、权限(被拒、超时、配额);允许多因,但要标出主因。
3)反例检验:针对你判断的主因,给出一个「如果不改这里、只改别处,问题会不会照样出现」的推演,防止误判。
4)最小修复:给出成本最低的一次改动(改哪个提示、补哪个判断、加哪个字段校验),并写清改完后再跑一次时,什么现象算修好了。
5)防复发:指出应该在哪一步加检查或日志,让同类失败下次能被自动发现。
不要编造轨迹里没有的信息;证据不足时写「不足以确认」。
怎么用
- 把上面的提示词全文复制到对话窗口或工作流里。
- 把花括号占位符(如 {任务描述})替换成你自己的内容。
- 条目越具体,产出越稳定;不需要的条目可以直接删掉。
输出示例
很多人把「最后一步报错」当成根因,其实第一步的返回就已经丢了关键字段。第 3 步的反例检验是最值钱的:它能挡住那种「改了提示词、听起来有道理、但问题照旧」的无效修复。
基本信息
- 分类:工程
- 标签:Agent · 排障 · 轨迹 · 根因 · 可复现
- 收录日期:2026-10-08
同类提示词
- 故障复盘(Postmortem):时间线、根因与行动项
- 代码评审:先对齐意图,再挑毛病
- 上线前变更自查:兼容性、回滚与可观测性过一遍
- 提示词回归测试:用 12 个边界用例验证改动没有把别处改坏
- AI 编程会话归档:导出、脱敏、编目三件事一次做完
- 智能体资产盘点:把扫描/清单变成权限最小化清单
- 给端侧场景做一张模型选型约束表,而不是对着排行榜挑
- 让智能体写「交接单」而不是「总结」:给下一个会话一份可审计的上下文
- 算力集群采购前的技术尽调:把峰值与利用率指标问成可复现的口径
- 把一次线上事故录制成能进 CI 的回归用例(Agent 录制与选择性回放)
- 把智能体里其实只是 if-then 的调用挑出来,换成窄判定器
- 模型安全评测前的环境体检:让测试沙箱真的离线