这个提示词用来做什么
系统里有多个 agent 互相调用工具,一个被污染的 agent 可能把恶意指令传给信任它的下游
提示词全文
我的系统里不止一个 agent,它们之间会互相传递指令与上下文。请帮我设计一道「谁在说话」的校验,降低一个被污染的 agent 把恶意指令传给下游的风险。
## 输入
agent 拓扑:{列出有哪些 agent、谁会给谁发指令,例如 A→B→C}
通信方式:{MCP / 内部消息队列 / 直接函数调用}
每个 agent 能触达的资源:{数据库、文件、外部 API、密钥等}
## 输出
1)信任边清单:把「谁能向谁下指令」画成一张表,标出其中「只要来源是内部就无条件执行」的边——这些是重点。
2)身份与来源:给出每条边上的最小可行校验(来源标识、签名或调用票据),说明在什么规模下用什么强度就够,不要一上来就上重型方案。
3)最小权限:对每个 agent 列出它「本来不需要」的写操作、读取密钥与外发请求,给出默认关闭的具体清单。
4)可疑指令特征:列出 5-8 条可自动检测的危险指令模式(如「忽略之前的规则」「把结果发到某个地址」「读取环境变量」),并说明命中后应该阻断还是转人工。
5)验证方法:给出一个能在本地跑的演练——构造一条由弱 agent 发起的越权指令,确认它在哪一步被挡住。
请区分「必须现在做的」与「有规模后再做的」;不确定的地方直接说明。
怎么用
- 把上面的提示词全文复制到对话窗口或工作流里。
- 把花括号占位符(如 {任务描述})替换成你自己的内容。
- 条目越具体,产出越稳定;不需要的条目可以直接删掉。
输出示例
第 1 步的价值在于把「内部即可信」这种默认假设显式写出来——很多漏洞不是没设防,而是没人意识到那条边是敞开的。第 5 步的演练建议真做一次,能挡住才算数。
基本信息
- 分类:工程
- 标签:多 agent · MCP · 提示注入 · 最小权限 · 校验
- 收录日期:2026-10-07
同类提示词
- 故障复盘(Postmortem):时间线、根因与行动项
- 代码评审:先对齐意图,再挑毛病
- 上线前变更自查:兼容性、回滚与可观测性过一遍
- 提示词回归测试:用 12 个边界用例验证改动没有把别处改坏
- AI 编程会话归档:导出、脱敏、编目三件事一次做完
- 智能体资产盘点:把扫描/清单变成权限最小化清单
- 给端侧场景做一张模型选型约束表,而不是对着排行榜挑
- 让智能体写「交接单」而不是「总结」:给下一个会话一份可审计的上下文
- 算力集群采购前的技术尽调:把峰值与利用率指标问成可复现的口径
- 把一次线上事故录制成能进 CI 的回归用例(Agent 录制与选择性回放)
- 把智能体里其实只是 if-then 的调用挑出来,换成窄判定器
- 模型安全评测前的环境体检:让测试沙箱真的离线