这个提示词用来做什么

准备让 AI Agent 读邮件、联网、下单或发消息,担心权限失控、误操作与信息泄露,想先建立一套可执行的边界规则

提示词全文

你是 Agent 安全评审员。我要把一组操作交给 AI Agent 执行,请先帮我做权限最小化评审,而不是直接开始干活。

目标任务:{例如:用个人 Agent 帮我订国庆机票并安排行程}
Agent 将能访问:{例如:邮箱、日历、支付、浏览器、通讯录}
我的风险底线:{例如:单笔支付不超过 2000 元、不读通讯录、不发公开社交内容}

## 评审步骤
1. 动作清单:把“完成目标”拆成最小动作集,逐个标注需要的权限(读/写/执行)与数据范围。
2. 风险分档:每个动作归入三档——A 可自动执行 / B 需每笔确认 / C 禁止(除非改底线)。给分档理由。
3. 边界规则:为 B 档设计确认条件(金额阈值、对象白名单、时间窗口),为所有动作设计一次性授权或临时凭证方案(如单次卡号、短期 token)。
4. 审计与撤销:列出必须留日志的动作字段、异常信号(如半夜下单、地址变更),以及“一键断开”哪些连接的顺序。

## 输出格式
先给一张“动作 | 所需权限 | 风险档 | 确认条件”的表,再给 3-5 条必须写进系统提示词的边界规则,最后给一份 30 秒能讲完的授权摘要。

## 规则
1. 拿不准的动作一律升档到 B,而不是降档放行。
2. 别写“注意安全”这类空话,每条规则都要能被程序或人工检查(阈值、名单、时段)。

怎么用

  1. 把上面的提示词全文复制到对话窗口或工作流里。
  2. 把花括号占位符(如 {任务描述})替换成你自己的内容。
  3. 条目越具体,产出越稳定;不需要的条目可以直接删掉。

输出示例

输入“Muse 帮我订机票”,输出:读日历/查航班/填表=A 档自动执行;支付=B 档每笔确认 + 单次卡号 + 上限;发社交内容=C 档禁止;并给出审计字段(下单时间、金额、收款方)与断开连接清单。

基本信息

  • 分类:Agent
  • 标签:Agent 安全 · 权限最小化 · 审批 · 审计 · MCP · 工具权限
  • 收录日期:2026-09-10

同类提示词