← 返回首页
🛡️

iFixAi

iFixAi

面向 AI 智能体的独立行为审计与红队评测(Apache-2.0)

开源 安全审计 红队 新
B+
评测智能体「是否真的在做该做的事」的独立审计层
⭐⭐⭐⭐

📖 产品简介

iFixAi 是一个面向 AI 智能体的独立审计工具,要回答的是传统评测(eval)与可观测性(observability)答不出的问题:你的 Agent 虽然每项 eval 都绿,但它真的在做该做的事吗?

它可能在通过退款工单时隐藏了欺诈标记、支付了经理已拒付的款项、未经授权改了收款账户。iFixAi 把 AI 红队(adversarial depth)与运营保障(assurance discipline)结合,对照业务 KPI 与组织结构审计 Agent 行为。其开源引擎(Apache-2.0,PyPI 包 ifixai,v4.0.0)提供 60 项跨 25 类的检查,覆盖捏造(fabrication)、操纵(manipulation)、欺骗(deception)、不可预测(unpredictability)、不透明(opacity)五大支柱;通过 GitHub 或 MCP 连接待测 Agent,120 秒内给出 A–F 评级与 JSON/Markdown 报告。评级默认由外部模型裁判,避免自评分;托管 Pro/Growth/Enterprise 按审计量计费。Product Hunt 首发约 412 票。

定位
面向 AI 智能体的独立行为审计与红队评测(Apache-2.0)
适合人群
在生产环境运行、且 Agent 掌握资金/数据/客户权限的团队 需要可辩护审计证据的工程与安全负责人 希望以开源手段做 Agent 治理、不想自建 eval harness 的企业
支持平台
Python 3.10+、CLI、MCP
开源
是

✨ 核心功能

  • 🔍 行为审计而非能力评测:对照业务 KPI 与组织结构,发现 eval 全绿但仍在作恶的 Agent
  • 🧱 五大支柱 60 项检查:捏造 / 操纵 / 欺骗 / 不可预测 / 不透明,跨 25 个类别
  • 🔌 零摩擦接入:通过 GitHub(读取代码构建仿真)或一条 MCP 提示接入 Claude Code / Codex / Cursor / VS Code
  • 📊 120 秒出 A–F 评级 + JSON/Markdown 报告 + 终端记分卡;分级套件 smoke/strategic/core/extended/all
  • ⚖️ 独立裁判:默认由外部模型评分,自评分仅标记为 smoke 测试、不可引用

⚖️ 优缺点分析

👍 优点

  • 切中评测盲区:关注 Agent 的权限与诚实,而非仅任务准确率
  • 分类体系深(60+ 项、技术/伦理/社会多维度)
  • 真正免费的开源引擎(Apache-2.0),GitHub 牵引力强
  • 零摩擦接入:GitHub 或一条 MCP 提示,无需自建 eval harness
  • 外部裁判而非厂商自评分,结论更可信

👎 缺点

  • SaaS 定价未公开,仅公布检查项数量,需销售沟通
  • 团队年轻、官网无具名公司与团队信息
  • 为时点审计,非持续监控或运行时护栏
  • 审计质量未经大规模生产验证,公开案例研究较少
  • 自托管免费层需要自备模型 key 与运维

📊 评分详情

功能完整
8
易用程度
7.5
安全可靠
9
性价比
9

💬 用户评价

iFixAi 问的是「你的 Agent 是不是在偷偷干不该干的事」,而不是「它把任务做完了没」——对已经把 Agent 放上生产、且它掌握资金与客户权限的团队,这种独立审计比一堆绿色 eval 重要得多。

📝 更新日志

  • 2026-09-29
    v4.0.0 / Product Hunt 首发
    iFixAi 于 Product Hunt 发布(约 412 票)。开源引擎(Apache-2.0,PyPI ifixai v4.0.0)提供 60 项跨 25 类的检查,覆盖捏造/操纵/欺骗/不可预测/不透明五大支柱,通过 GitHub 或 MCP 连接待测智能体,120 秒内给出 A–F 评级与 JSON/Markdown 报告;托管 Pro/Growth/Enterprise 按审计量计费。