这个工具是做什么的
把「这个 Agent 到底有没有在做它该做的事」做成一次可复现的检查:官方一共 60 项检查,其中 32 项构成计入等级的五个维度——编造、被操纵、欺骗、行为不可预期、过程不透明,跑完给一张 A–F 评分卡,同时输出 JSON 与 Markdown 报告。既可以直接对着已部署 Agent 的 HTTP 接口测,也可以测裸模型 API;想让成绩能对外引用,就再用另一家厂商的模型当裁判,不允许自己给自己打分。装好后先用内置样例跑一次自检(不联网、约一秒,会故意给一份不及格的评分卡让你看懂报告),再换成自己的 Agent 跑真正的检查。命令行、Claude Code / Codex 插件、以及给任意编码 Agent 生成的 skill,三种用法跑的是同一个引擎;代码在 github.com/ifixai-ai/iFixAi,Apache-2.0 开源。
基本信息
- 分类:AI Agent
- 厂商 / 团队:iFixAi
- 价格:开源免费(Apache-2.0;被测模型与裁判模型的调用按各自厂商计费)
- 收录日期:2026-10-07
- 官网:ifixai.ai
适用场景
Agent 审计 · 评测 · 安全合规 · 开源 · 命令行