📖 产品简介
iFixAi 是一个面向 AI 智能体的独立审计工具,要回答的是传统评测(eval)与可观测性(observability)答不出的问题:你的 Agent 虽然每项 eval 都绿,但它真的在做该做的事吗?
它可能在通过退款工单时隐藏了欺诈标记、支付了经理已拒付的款项、未经授权改了收款账户。iFixAi 把 AI 红队(adversarial depth)与运营保障(assurance discipline)结合,对照业务 KPI 与组织结构审计 Agent 行为。其开源引擎(Apache-2.0,PyPI 包 ifixai,v4.0.0)提供 60 项跨 25 类的检查,覆盖捏造(fabrication)、操纵(manipulation)、欺骗(deception)、不可预测(unpredictability)、不透明(opacity)五大支柱;通过 GitHub 或 MCP 连接待测 Agent,120 秒内给出 A–F 评级与 JSON/Markdown 报告。评级默认由外部模型裁判,避免自评分;托管 Pro/Growth/Enterprise 按审计量计费。Product Hunt 首发约 412 票。
定位
面向 AI 智能体的独立行为审计与红队评测(Apache-2.0)
适合人群
在生产环境运行、且 Agent 掌握资金/数据/客户权限的团队
需要可辩护审计证据的工程与安全负责人
希望以开源手段做 Agent 治理、不想自建 eval harness 的企业
支持平台
Python 3.10+、CLI、MCP
开源
是
✨ 核心功能
- 行为审计而非能力评测:对照业务 KPI 与组织结构,发现 eval 全绿但仍在作恶的 Agent
- 五大支柱 60 项检查:捏造 / 操纵 / 欺骗 / 不可预测 / 不透明,跨 25 个类别
- 零摩擦接入:通过 GitHub(读取代码构建仿真)或一条 MCP 提示接入 Claude Code / Codex / Cursor / VS Code
- 120 秒出 A–F 评级 + JSON/Markdown 报告 + 终端记分卡;分级套件 smoke/strategic/core/extended/all
- 独立裁判:默认由外部模型评分,自评分仅标记为 smoke 测试、不可引用
⚖️ 优缺点分析
👍 优点
- 切中评测盲区:关注 Agent 的权限与诚实,而非仅任务准确率
- 分类体系深(60+ 项、技术/伦理/社会多维度)
- 真正免费的开源引擎(Apache-2.0),GitHub 牵引力强
- 零摩擦接入:GitHub 或一条 MCP 提示,无需自建 eval harness
- 外部裁判而非厂商自评分,结论更可信
👎 缺点
- SaaS 定价未公开,仅公布检查项数量,需销售沟通
- 团队年轻、官网无具名公司与团队信息
- 为时点审计,非持续监控或运行时护栏
- 审计质量未经大规模生产验证,公开案例研究较少
- 自托管免费层需要自备模型 key 与运维
📊 评分详情
功能完整
8
易用程度
7.5
安全可靠
9
性价比
9
💬 用户评价
iFixAi 问的是「你的 Agent 是不是在偷偷干不该干的事」,而不是「它把任务做完了没」——对已经把 Agent 放上生产、且它掌握资金与客户权限的团队,这种独立审计比一堆绿色 eval 重要得多。
📝 更新日志
-
2026-09-29v4.0.0 / Product Hunt 首发iFixAi 于 Product Hunt 发布(约 412 票)。开源引擎(Apache-2.0,PyPI ifixai v4.0.0)提供 60 项跨 25 类的检查,覆盖捏造/操纵/欺骗/不可预测/不透明五大支柱,通过 GitHub 或 MCP 连接待测智能体,120 秒内给出 A–F 评级与 JSON/Markdown 报告;托管 Pro/Growth/Enterprise 按审计量计费。