这个提示词用来做什么

接入 Qwen3.8-Omni-Flash、Kimi K3 这类官方说明「在保留思考历史模式下训练」的模型后,框架如果不回传历史思考内容,输出质量会静默退化,而日志里什么都看不到

提示词全文

我在把一个「在保留思考历史模式下训练」的模型接进 Agent 框架,需要先确认历史思考内容有没有被正确回传,避免出现看不到报错的静默退化。请基于我给的链路信息产出一份可执行的自检方案,不要泛泛讲原理。

## 输入
模型与接入方式:{模型名,以及官方文档里关于思考历史回传的说明原文}
框架与调用链:{Agent 框架名称、消息如何拼装、历史轮次如何裁剪、中间层有没有改写消息}
任务类型:{多轮工具调用 / 长链路规划 / 单轮问答}
回归样本:{有没有能稳定复现的任务集,没有就写无}

## 输出
1)回传链路核对表:把「上一轮产生思考内容」到「下一轮请求发出」之间的每一步列出来,逐项标注是保留、丢弃还是被改写,并指出哪一步最可能被框架默默丢掉。
2)对照实验:给一个 30 分钟内能跑完的验证方法——同一批任务在「回传思考历史」与「不回传」两种设置下各跑一遍,写清看哪些指标(工具调用成功率、任务完成率、无效重试次数),以及差距多大才算真退化,避免把随机波动当结论。
3)日志与埋点:列出需要落盘的最小字段(每轮请求的 token 组成、思考段是否被截断、裁剪发生在哪一环),让下次退化能直接定位。
4)止损做法:如果确认框架会丢思考历史,给出两种可落地的处理(改框架 / 换模型),并说明各自代价。
5)结论:直接说明这批任务在当前链路下能不能上生产,还差哪一步。

怎么用

  1. 把上面的提示词全文复制到对话窗口或工作流里。
  2. 把花括号占位符(如 {任务描述})替换成你自己的内容。
  3. 条目越具体,产出越稳定;不需要的条目可以直接删掉。

输出示例

输入一个旅行规划 Agent 的接入信息后,输出会把链路拆成「模型返回思考段 → 框架写入会话 → 裁剪历史 → 拼装下一次请求 → 服务端解析」五步,指出「裁剪历史」最容易整段丢掉思考内容;给出对照实验:同一批 30 个多步任务各跑两遍,工具调用成功率相差 12 个百分点以上才判定为退化,并列出需要落盘的字段(每轮思考段 token 数、是否被截断、裁剪策略命中记录)。

基本信息

  • 分类:Agent
  • 标签:思考回传 · 上下文管理 · 回归测试 · 退化排查 · Agent
  • 收录日期:2026-09-19

同类提示词