这个提示词用来做什么
接入 Qwen3.8-Omni-Flash、Kimi K3 这类官方说明「在保留思考历史模式下训练」的模型后,框架如果不回传历史思考内容,输出质量会静默退化,而日志里什么都看不到
提示词全文
我在把一个「在保留思考历史模式下训练」的模型接进 Agent 框架,需要先确认历史思考内容有没有被正确回传,避免出现看不到报错的静默退化。请基于我给的链路信息产出一份可执行的自检方案,不要泛泛讲原理。
## 输入
模型与接入方式:{模型名,以及官方文档里关于思考历史回传的说明原文}
框架与调用链:{Agent 框架名称、消息如何拼装、历史轮次如何裁剪、中间层有没有改写消息}
任务类型:{多轮工具调用 / 长链路规划 / 单轮问答}
回归样本:{有没有能稳定复现的任务集,没有就写无}
## 输出
1)回传链路核对表:把「上一轮产生思考内容」到「下一轮请求发出」之间的每一步列出来,逐项标注是保留、丢弃还是被改写,并指出哪一步最可能被框架默默丢掉。
2)对照实验:给一个 30 分钟内能跑完的验证方法——同一批任务在「回传思考历史」与「不回传」两种设置下各跑一遍,写清看哪些指标(工具调用成功率、任务完成率、无效重试次数),以及差距多大才算真退化,避免把随机波动当结论。
3)日志与埋点:列出需要落盘的最小字段(每轮请求的 token 组成、思考段是否被截断、裁剪发生在哪一环),让下次退化能直接定位。
4)止损做法:如果确认框架会丢思考历史,给出两种可落地的处理(改框架 / 换模型),并说明各自代价。
5)结论:直接说明这批任务在当前链路下能不能上生产,还差哪一步。
怎么用
- 把上面的提示词全文复制到对话窗口或工作流里。
- 把花括号占位符(如 {任务描述})替换成你自己的内容。
- 条目越具体,产出越稳定;不需要的条目可以直接删掉。
输出示例
输入一个旅行规划 Agent 的接入信息后,输出会把链路拆成「模型返回思考段 → 框架写入会话 → 裁剪历史 → 拼装下一次请求 → 服务端解析」五步,指出「裁剪历史」最容易整段丢掉思考内容;给出对照实验:同一批 30 个多步任务各跑两遍,工具调用成功率相差 12 个百分点以上才判定为退化,并列出需要落盘的字段(每轮思考段 token 数、是否被截断、裁剪策略命中记录)。
基本信息
- 分类:Agent
- 标签:思考回传 · 上下文管理 · 回归测试 · 退化排查 · Agent
- 收录日期:2026-09-19
同类提示词
- AI Agent 任务分解器
- AI Agent 需求评审清单
- 多 Agent 协作任务编排
- 把重复劳动固化成 Agent 技能:记录、参数化、验收、沉淀四步
- 给 Agent 开权限前做最小化评审:列动作、分风险、定审批与审计
- Agent 失败复盘五问:判断问题出在模型、工具还是流程
- Agent 交接摘要:把会话之外的状态写成可接手的交接单
- 权限三档:把一次任务拆成「可自主 / 需确认 / 禁止」
- 智能体出网与凭据边界自查:把训练/评测沙箱当成生产攻击面
- 智能体上线前的授权边界清单:它能读什么、能改什么、出事怎么查
- 让 AI 先替你列「这套 Agent 上线后会怎么坏」,再决定要不要上线
- 给要跑长链路的智能体列一份「必须停下来问人」的清单