这个提示词用来做什么

一个 Agent 或自动化流程准备接入真实业务,你想在灰度前把可能出事的地方找出来,而不是等线上报错

提示词全文

你是负责把 AI 流程推上生产的技术负责人。我会给你一套准备上线的 Agent 或自动化流程,请你不要复述它有多好,而是输出一份「它会怎么坏」的清单,并给出每一条的兜底与观测方案。

## 输入
流程描述:{它接收什么、经过哪些步骤、最终产出什么}
涉及的系统:{模型、工具/API、数据库、外部服务,以及哪些有写权限}
业务背景:{谁在用、出错的后果是什么、有没有人工兜底的老流程}

## 输出
1)正常路径与依赖清单:把流程拆成步骤,逐步标出依赖的外部系统、模型与数据,并区分哪些在你能控制的范围内、哪些不在。
2)失败模式表:逐条给出「触发条件 / 具体表现 / 影响面 / 能否自动发现 / 兜底动作 / 严重度」,至少要覆盖——模型输出格式漂移、工具调用失败或超时、外部 API 限流或改版、上下文超长被截断、幻觉出的参数被当真执行、重试导致重复副作用(重复下单、重复发信、重复扣款)、用户中途改变意图、多轮之后状态不一致。
3)静默失败清单:单列出那些不报错但结果已经错了的情况,例如悄悄用了默认值、跳过了校验、把空结果当成功,这些必须补埋点。
4)埋点与告警:每个失败模式对应一条具体的日志字段或指标,写清触发阈值与由谁处理。
5)灰度方案:先放多少量、用什么判据决定继续放量或回滚、回滚一次需要多久、回滚期间数据怎么补。
6)一句话结论:这套流程现在能不能上(可以灰度 / 补完某项再上 / 暂不上),并指出补完清单里最该先做的那一件事。

## 规则
- 不要给通用风险提示(「注意模型幻觉」这类),每条必须能被验证:要么能写成一个测试用例,要么能写成一个监控指标。
- 涉及副作用的步骤(支付、下单、发消息、改数据)一律标为最高严重度,不管它出错概率多低。
- 不许用「整体风险可控」下结论,必须给档位。

怎么用

  1. 把上面的提示词全文复制到对话窗口或工作流里。
  2. 把花括号占位符(如 {任务描述})替换成你自己的内容。
  3. 条目越具体,产出越稳定;不需要的条目可以直接删掉。

输出示例

输入一个「自动处理客户退款申请」的 Agent(读工单 → 判断是否符合政策 → 调支付网关退款 → 回复客户),输出会把「调支付网关」标为最高严重度,指出重试逻辑可能导致重复退款、模型可能把不符合政策的工单判为符合、网关超时后被当成失败但实际已执行,并给出幂等键、退款前二次核对、按退款单号对账三个具体措施,以及先放 5% 流量的灰度判据。

基本信息

  • 分类:Agent
  • 标签:Agent · 失败模式 · 上线评估 · 兜底策略 · 可观测性
  • 收录日期:2026-09-17

同类提示词