这个工具是做什么的

把「这个 Agent 到底有没有在做它该做的事」做成一次可复现的检查:官方一共 60 项检查,其中 32 项构成计入等级的五个维度——编造、被操纵、欺骗、行为不可预期、过程不透明,跑完给一张 A–F 评分卡,同时输出 JSON 与 Markdown 报告。既可以直接对着已部署 Agent 的 HTTP 接口测,也可以测裸模型 API;想让成绩能对外引用,就再用另一家厂商的模型当裁判,不允许自己给自己打分。装好后先用内置样例跑一次自检(不联网、约一秒,会故意给一份不及格的评分卡让你看懂报告),再换成自己的 Agent 跑真正的检查。命令行、Claude Code / Codex 插件、以及给任意编码 Agent 生成的 skill,三种用法跑的是同一个引擎;代码在 github.com/ifixai-ai/iFixAi,Apache-2.0 开源。

基本信息

  • 分类:AI Agent
  • 厂商 / 团队:iFixAi
  • 价格:开源免费(Apache-2.0;被测模型与裁判模型的调用按各自厂商计费)
  • 收录日期:2026-10-07
  • 官网:ifixai.ai

适用场景

Agent 审计 · 评测 · 安全合规 · 开源 · 命令行

官方入口

ifixai.ai ↗

同类工具