这个提示词用来做什么
编码、评审、资料梳理这类任务交给智能体后,它的最终回复往往是你唯一能看到的工作说明,需要判断这句「做完了」能不能直接当验收依据
提示词全文
我要验收一个智能体的产出,但它只给了我一段最终回复。请把这段回复与它的实际动作分开核对,输出一份验收意见,不要复述回复内容。
## 输入
任务要求:{原始任务,包括明确要求它处理哪些文件 / 数据 / 范围}
最终回复:{它交付的那段话}
过程记录:{可用的证据,例如对话记录、工具调用日志、改动 diff、命令输出;没有就写「无」}
验收标准:{你打算怎么判定完成,例如覆盖率、测试通过、缺陷清单}
## 输出
1)声称清单:逐条列出回复里的完成性断言(读了全部 X、跑通了 Y、没有 Z 问题),每条标注它属于「可验证事实」还是「无据断言」。
2)证据比对:对每条断言给出对应的过程证据(工具调用、文件访问记录、命令输出);证据缺失的一律标为未证实,不要用常识替它补足。
3)覆盖率核验:算出实际处理的条目 ÷ 要求处理的条目;对要求范围内的漏项逐个点名。
4)夸大与遗漏检查:指出回复里有没有「声称覆盖完整但实际不完整」或「不主动说明覆盖不全」的情况,这两类是最容易被当成合格的误报。
5)验收判定:直接回答这份产出现在能不能算完成;如不能,列出必须补齐的最小动作清单,以及补完之后需要重新核验哪几项。
怎么用
- 把上面的提示词全文复制到对话窗口或工作流里。
- 把花括号占位符(如 {任务描述})替换成你自己的内容。
- 条目越具体,产出越稳定;不需要的条目可以直接删掉。
输出示例
输入一段声称「已通读全部 14 个模块并修复所有类型错误」的回复后,输出会把 14 个模块逐个对照工具调用记录:11 个有读取痕迹、3 个没有任何访问记录,因此「通读全部」属于无据断言;覆盖率核验给出 11/14;并指出该断言属于「声称完整但不完整」;最终判定为未完成,最小补齐动作是读取剩余 3 个模块并复跑一次检查,补齐后需重新核验覆盖率与类型检查输出。
基本信息
- 分类:Agent
- 标签:智能体验收 · 完成声称 · 覆盖率核验 · 过程证据 · 交付质量
- 收录日期:2026-09-20
同类提示词
- AI Agent 任务分解器
- AI Agent 需求评审清单
- 多 Agent 协作任务编排
- 把重复劳动固化成 Agent 技能:记录、参数化、验收、沉淀四步
- 给 Agent 开权限前做最小化评审:列动作、分风险、定审批与审计
- Agent 失败复盘五问:判断问题出在模型、工具还是流程
- Agent 交接摘要:把会话之外的状态写成可接手的交接单
- 权限三档:把一次任务拆成「可自主 / 需确认 / 禁止」
- 智能体出网与凭据边界自查:把训练/评测沙箱当成生产攻击面
- 智能体上线前的授权边界清单:它能读什么、能改什么、出事怎么查
- 让 AI 先替你列「这套 Agent 上线后会怎么坏」,再决定要不要上线
- 给要跑长链路的智能体列一份「必须停下来问人」的清单