这个提示词用来做什么
准备让 AI Agent 读邮件、联网、下单或发消息,担心权限失控、误操作与信息泄露,想先建立一套可执行的边界规则
提示词全文
你是 Agent 安全评审员。我要把一组操作交给 AI Agent 执行,请先帮我做权限最小化评审,而不是直接开始干活。
目标任务:{例如:用个人 Agent 帮我订国庆机票并安排行程}
Agent 将能访问:{例如:邮箱、日历、支付、浏览器、通讯录}
我的风险底线:{例如:单笔支付不超过 2000 元、不读通讯录、不发公开社交内容}
## 评审步骤
1. 动作清单:把“完成目标”拆成最小动作集,逐个标注需要的权限(读/写/执行)与数据范围。
2. 风险分档:每个动作归入三档——A 可自动执行 / B 需每笔确认 / C 禁止(除非改底线)。给分档理由。
3. 边界规则:为 B 档设计确认条件(金额阈值、对象白名单、时间窗口),为所有动作设计一次性授权或临时凭证方案(如单次卡号、短期 token)。
4. 审计与撤销:列出必须留日志的动作字段、异常信号(如半夜下单、地址变更),以及“一键断开”哪些连接的顺序。
## 输出格式
先给一张“动作 | 所需权限 | 风险档 | 确认条件”的表,再给 3-5 条必须写进系统提示词的边界规则,最后给一份 30 秒能讲完的授权摘要。
## 规则
1. 拿不准的动作一律升档到 B,而不是降档放行。
2. 别写“注意安全”这类空话,每条规则都要能被程序或人工检查(阈值、名单、时段)。
怎么用
- 把上面的提示词全文复制到对话窗口或工作流里。
- 把花括号占位符(如 {任务描述})替换成你自己的内容。
- 条目越具体,产出越稳定;不需要的条目可以直接删掉。
输出示例
输入“Muse 帮我订机票”,输出:读日历/查航班/填表=A 档自动执行;支付=B 档每笔确认 + 单次卡号 + 上限;发社交内容=C 档禁止;并给出审计字段(下单时间、金额、收款方)与断开连接清单。
基本信息
- 分类:Agent
- 标签:Agent 安全 · 权限最小化 · 审批 · 审计 · MCP · 工具权限
- 收录日期:2026-09-10
同类提示词
- AI Agent 任务分解器
- AI Agent 需求评审清单
- 多 Agent 协作任务编排
- 把重复劳动固化成 Agent 技能:记录、参数化、验收、沉淀四步
- Agent 失败复盘五问:判断问题出在模型、工具还是流程
- Agent 交接摘要:把会话之外的状态写成可接手的交接单
- 权限三档:把一次任务拆成「可自主 / 需确认 / 禁止」
- 智能体出网与凭据边界自查:把训练/评测沙箱当成生产攻击面
- 智能体上线前的授权边界清单:它能读什么、能改什么、出事怎么查
- 让 AI 先替你列「这套 Agent 上线后会怎么坏」,再决定要不要上线
- 给要跑长链路的智能体列一份「必须停下来问人」的清单
- 给保留思考历史的智能体做一次「思考回传」链路自检