这个提示词用来做什么
agent 流程越调越贵,改一个参数就有三个指标一起动,说不清现在这套配置是不是最优。把三项指标的关系做成可查的配置表,标出当前取值与可调范围,方便按场景取舍。给出当前配置与指标表现即可,可指定优先保证的指标。
提示词全文
请帮我把这条 agent 工作流的「取舍」写成一份能拿去做决策的说明。重点不是给一个推荐配置,而是指出哪些组合明显更差、哪些组合属于同一条前沿上。
## 输入
工作流做什么:{逐个步骤列出,标出每步用了哪个模型或工具}
现在用的配置:{每一步的模型、推理档位、重试次数、并发数}
要同时看的指标:{例如任务成功率、单次成本、P95 延迟,以及业务侧真正在意的那一个}
硬约束:{哪些是不能碰的底线,例如正确率不得低于某个值、延迟不得超过多少秒}
可调范围:{哪些能换、哪些不能换;预算与时间上限}
## 输出
1)指标定义:把每个指标写成可测量的形式,写清统计口径(按什么分位、统计多久的窗口、失败请求算不算进去)。
2)现状基线:按当前配置估算三个指标各自的数值,并标注哪些是实测、哪些是估算——估算的要给出依据。
3)可调项与影响:一行一个可调项,说明它主要影响哪个指标、影响方向与量级,以及代价是什么。
4)候选组合:给出一组候选配置(至少 5 个),每个标注三个指标的预期值,并指出哪些属于「同向前沿」(不存在一个指标更好而其它都不变差),哪些属于被支配(可以直接淘汰,并说明被谁支配)。
5)推荐与理由:给出两到三个推荐点,分别对应「最省」「最快」「最稳」,并说明各自在什么业务场景下才划算。
6)验证方法:给出一个能在一天内跑完的验证方案——样本量、对照组、判断标准,以及如果结果与预期不符该先怀疑哪里。
怎么用
- 把上面的提示词全文复制到对话窗口或工作流里。
- 把花括号占位符(如 {任务描述})替换成你自己的内容。
- 条目越具体,产出越稳定;不需要的条目可以直接删掉。
输出示例
典型输出会先把「成本」定义成按任务而非按 token 计量,因为多轮工具调用里 token 数与实际完成的工作量并不成正比;在可调项里会指出「降低推理档位」往往同时改善成本与延迟、但会拉低正确率,而「减少重试次数」只影响成本与延迟、对正确率几乎无害,因此优先动后者;候选组合里通常有一到两个配置被明确标为「被支配」;验证方案会要求把失败请求单独统计,否则平均延迟会被快速失败掩盖。
基本信息
- 分类:工程
- 标签:多目标优化 · 成本控制 · 延迟 · 取舍
- 收录日期:2026-10-02
同类提示词
- 故障复盘(Postmortem):时间线、根因与行动项
- 代码评审:先对齐意图,再挑毛病
- 上线前变更自查:兼容性、回滚与可观测性过一遍
- 提示词回归测试:用 12 个边界用例验证改动没有把别处改坏
- AI 编程会话归档:导出、脱敏、编目三件事一次做完
- 智能体资产盘点:把扫描/清单变成权限最小化清单
- 给端侧场景做一张模型选型约束表,而不是对着排行榜挑
- 让智能体写「交接单」而不是「总结」:给下一个会话一份可审计的上下文
- 算力集群采购前的技术尽调:把峰值与利用率指标问成可复现的口径
- 把一次线上事故录制成能进 CI 的回归用例(Agent 录制与选择性回放)
- 把智能体里其实只是 if-then 的调用挑出来,换成窄判定器
- 模型安全评测前的环境体检:让测试沙箱真的离线