这个提示词用来做什么
Agent 跑任务失败了——答案不对、工具调错,还是中途停住,想定位根因,并决定到底该改提示词、改工具还是改流程
提示词全文
你是 Agent 系统排障工程师。我会给你一次失败的任务记录,请按五问定位根因,不要直接给我「优化提示词」这类泛泛建议。
任务目标:{例如:读一批客户邮件,按紧急度分类并生成回复草稿}
Agent 配置:{模型 / 可用工具 / 系统提示词要点 / 是否有子 Agent}
失败现象:{把关键过程贴出来:调用了哪些工具、返回了什么、最后输出什么、哪一步开始偏离}
## 五问
1)是模型能力问题吗?——如果是,指出具体能力缺口(长链路规划、数值计算、工具选择、指令遵循),并说明为什么不是别的原因造成的。
2)是工具问题吗?——检查工具描述是否歧义、参数是否容易填错、返回是否缺少 Agent 判断下一步所需的信息。
3)是流程问题吗?——有没有缺状态校验(动作执行后不核对结果)、缺失败重试、缺人机确认点。
4)是评测问题吗?——我们现在根本测不出这个失败,还是测出来了但指标没覆盖?给出一个能复现该失败的用例。
5)哪一层改起来最划算?——按「改动成本 ÷ 预期收益」排序给出 2-3 个候选动作。
## 输出
1. 根因判定(一句话,并给出反证:什么证据能说明我判断错了)
2. 最小修复动作(不超过 3 条,每条写清改哪个文件/环节、怎么验证生效)
3. 一条要长期保留的回归用例
## 规则
1. 没有证据就不要断言根因,写明「需先做这个实验才能区分 A 与 B」。
2. 优先考虑加验证与回滚,而不是「再调调提示词试试」。
怎么用
- 把上面的提示词全文复制到对话窗口或工作流里。
- 把花括号占位符(如 {任务描述})替换成你自己的内容。
- 条目越具体,产出越稳定;不需要的条目可以直接删掉。
输出示例
输入一次「Agent 把已取消的订单又发了一次通知」的记录,输出根因判定为缺动作后状态校验(工具返回成功后未核对业务状态),最小修复为在写操作后增加一次读取校验 + 幂等键,回归用例为「重复触发同一取消动作时不得产生第二次通知」。
基本信息
- 分类:Agent
- 标签:Agent 复盘 · 故障定位 · 评测 · 工具调用 · Harness
- 收录日期:2026-09-11
同类提示词
- AI Agent 任务分解器
- AI Agent 需求评审清单
- 多 Agent 协作任务编排
- 把重复劳动固化成 Agent 技能:记录、参数化、验收、沉淀四步
- 给 Agent 开权限前做最小化评审:列动作、分风险、定审批与审计
- Agent 交接摘要:把会话之外的状态写成可接手的交接单
- 权限三档:把一次任务拆成「可自主 / 需确认 / 禁止」
- 智能体出网与凭据边界自查:把训练/评测沙箱当成生产攻击面
- 智能体上线前的授权边界清单:它能读什么、能改什么、出事怎么查
- 让 AI 先替你列「这套 Agent 上线后会怎么坏」,再决定要不要上线
- 给要跑长链路的智能体列一份「必须停下来问人」的清单
- 给保留思考历史的智能体做一次「思考回传」链路自检