这个提示词用来做什么
长任务 agent 跑到一半开始打转:重复已经完成的步骤、推翻自己刚做的工作,或者在一个死胡同里越走越深
提示词全文
请帮我把一个跑长任务的 agent 改成「worker 只管执行、控制层专门决定下一步做什么」的两层结构,而不是继续在提示词里堆「想清楚再动手」。请针对我的场景给出可落地的设计,不要写通用原则。
## 输入
任务类型:{例如长程编码、深度研究、多步数据处理;一次运行大概多少步、单步能验证什么}
现在的问题:{具体现象——重复劳动 / 推翻自己 / 死循环 / 提前收工,最好给一两个真实例子}
已有资源:{worker 用什么模型与工具、总预算(token / 时间 / 钱)、有没有持久记忆或外部状态}
可用的验收方式:{这一步的结果能不能自动验证,例如测试通过、字段齐全、数值复现}
## 输出
1)状态摘要格式:设计控制层每一步要读的那份「紧凑运行记录」必须包含哪些字段(已经确立了哪些结论、当前产物在哪、有哪些未解决的阻塞),并说明怎么把它控制在固定长度内(写死条数还是按预算截断)。
2)候选枚举:给出控制层每一步应该列出的候选动作类型(继续、重做、换路、停),以及每个候选必须附带的三个属性——预期收益、预计成本、失败的判据。
3)选择规则:把「按剩余预算评估值不值」写成可执行的判据,而不是交给模型感觉,例如收益低于多少就停、成本超过剩余预算的多少比例就先换更便宜的路。
4)交接契约:worker 与控制层之间传什么、不传什么;明确列出禁止传的东西(完整历史、原始日志),并说明为什么。
5)记账与回放:设计一份最小台账(每步选了哪个候选、花了多少、结果如何),以及怎么用它复盘是哪一类决策在浪费预算。
6)回退开关:如果这套结构在小预算任务上反而更慢,给出判断阈值和一键退回单层 agent 的做法。
怎么用
- 把上面的提示词全文复制到对话窗口或工作流里。
- 把花括号占位符(如 {任务描述})替换成你自己的内容。
- 条目越具体,产出越稳定;不需要的条目可以直接删掉。
输出示例
典型输出会把运行记录设计成「结论列表 + 产物指针 + 阻塞列表」三段各限 20 条,并说明禁止把完整对话历史交给控制层;候选枚举会要求每个候选都写清「如果这一步失败,我怎么知道」,把「重做」限定为只有在产物无法增量修补时才允许;选择规则会写成「预期收益低于剩余预算的 2% 直接停,单个候选成本超过剩余预算 30% 就先降级到更便宜的执行路径」;台账按候选类型分类,用来回答「预算到底花在继续上还是花在重做上」。
基本信息
- 分类:工程
- 标签:长任务 Agent · 控制层 · 预算分配 · 运行记录
- 收录日期:2026-10-01
同类提示词
- 故障复盘(Postmortem):时间线、根因与行动项
- 代码评审:先对齐意图,再挑毛病
- 上线前变更自查:兼容性、回滚与可观测性过一遍
- 提示词回归测试:用 12 个边界用例验证改动没有把别处改坏
- AI 编程会话归档:导出、脱敏、编目三件事一次做完
- 智能体资产盘点:把扫描/清单变成权限最小化清单
- 给端侧场景做一张模型选型约束表,而不是对着排行榜挑
- 让智能体写「交接单」而不是「总结」:给下一个会话一份可审计的上下文
- 算力集群采购前的技术尽调:把峰值与利用率指标问成可复现的口径
- 把一次线上事故录制成能进 CI 的回归用例(Agent 录制与选择性回放)
- 把智能体里其实只是 if-then 的调用挑出来,换成窄判定器
- 模型安全评测前的环境体检:让测试沙箱真的离线