这个提示词用来做什么

编码、评审、资料梳理这类任务交给智能体后,它的最终回复往往是你唯一能看到的工作说明,需要判断这句「做完了」能不能直接当验收依据

提示词全文

我要验收一个智能体的产出,但它只给了我一段最终回复。请把这段回复与它的实际动作分开核对,输出一份验收意见,不要复述回复内容。

## 输入
任务要求:{原始任务,包括明确要求它处理哪些文件 / 数据 / 范围}
最终回复:{它交付的那段话}
过程记录:{可用的证据,例如对话记录、工具调用日志、改动 diff、命令输出;没有就写「无」}
验收标准:{你打算怎么判定完成,例如覆盖率、测试通过、缺陷清单}

## 输出
1)声称清单:逐条列出回复里的完成性断言(读了全部 X、跑通了 Y、没有 Z 问题),每条标注它属于「可验证事实」还是「无据断言」。
2)证据比对:对每条断言给出对应的过程证据(工具调用、文件访问记录、命令输出);证据缺失的一律标为未证实,不要用常识替它补足。
3)覆盖率核验:算出实际处理的条目 ÷ 要求处理的条目;对要求范围内的漏项逐个点名。
4)夸大与遗漏检查:指出回复里有没有「声称覆盖完整但实际不完整」或「不主动说明覆盖不全」的情况,这两类是最容易被当成合格的误报。
5)验收判定:直接回答这份产出现在能不能算完成;如不能,列出必须补齐的最小动作清单,以及补完之后需要重新核验哪几项。

怎么用

  1. 把上面的提示词全文复制到对话窗口或工作流里。
  2. 把花括号占位符(如 {任务描述})替换成你自己的内容。
  3. 条目越具体,产出越稳定;不需要的条目可以直接删掉。

输出示例

输入一段声称「已通读全部 14 个模块并修复所有类型错误」的回复后,输出会把 14 个模块逐个对照工具调用记录:11 个有读取痕迹、3 个没有任何访问记录,因此「通读全部」属于无据断言;覆盖率核验给出 11/14;并指出该断言属于「声称完整但不完整」;最终判定为未完成,最小补齐动作是读取剩余 3 个模块并复跑一次检查,补齐后需重新核验覆盖率与类型检查输出。

基本信息

  • 分类:Agent
  • 标签:智能体验收 · 完成声称 · 覆盖率核验 · 过程证据 · 交付质量
  • 收录日期:2026-09-20

同类提示词