AIToday
大規模言語モデルAI安全性・アラインメントオープンソースAIHacker News掲載日時: 2026年8月9日 16:015分で読める

iFixAI、AIエージェントを120秒採点

LINEで送る
iFixAI、AIエージェントを120秒採点

要点

  • iFixAI は、オープンソースの監査ツールで、独立した判定者を使用して Fabrication、Manipulation、Deception、Miscalibration、Drift の5つの柱にまたがる45の診断テストを評価し、AIエージェントをビジネス影響と運用安全性に基づいて2分未満でA~Fで採点する。

  • 既存ツールが技術能力のみを測定するのとは異なり、iFixAI はビジネスKPI と組織構造に基づいて、エージェントが実際にやるべき仕事をしているかどうかを答え、引用可能なA~Fの成績と柱ごとのスコア内訳を提供する。

  • このツールは CLI、エージェント プラグイン(Claude Code、Codex、Cursor、VS Code など)、またはスキル コマンドで実行でき、1つまたは2つの独立ベンダーがエージェントを採点するかによって、実行あたり約10ドル~18 で構成可能な判定者設定で動作する。

3つのポイント

  1. 何が起きたか

    オープンソースの第三者監査プラットフォーム iFixAI が立ち上がった。Fabrication、Manipulation、Deception、Miscalibration、Drift の5つの柱に整理された45の検査に対してAIエージェントをテストし、120秒以内にA~Fの成績を付与する。このツールは CLI、プラグイン(Claude Code、Codex)、またはエージェント スキルで実行でき、設定オプションはガイド付きウィザードから明示的なコマンドラインフラグまで対応。判定者はエージェント自身(自己評価)、単一の独立ベンダー、または複数判定者アンサンブルのいずれかが務める。

  2. なぜ重要か

    既存の評価ツールはトークン効率、レイテンシ、プロンプトインジェクション耐性といった技術能力のみを測定するが、ビジネスKPI と組織構造に基づいて、エージェントが実際に与えられた仕事をしているかどうかは答えられない。iFixAI はこのギャップを埋め、実運用およびビジネス基準に対してエージェントを監査し、開発者とチームに独立した判定者からの引用可能な成績とアクションできるスコアカードを提供する。技術指標ではなくビジネス成果がエージェント導入の成功を左右する環境では、これは極めて重要である。

  3. 注目点

    推奨される判定者設定の費用見積もり:単一判定者実行(Claude Sonnet)はフルスイートあたり約12ドル~18;2判定者設定(Gemini 2.5 Pro + GPT-5.4-mini)は合計約10ドル~14。このツールはあらゆるプロバイダー(OpenAI、Anthropic、Gemini、OpenRouter、Azure、Bedrock、Hugging Face)、HTTPエンドポイント、LangChain アダプタに対応し、フルスイート実行は45テスト全体で約2,000の判定呼び出しを生成するため、費用は予測可能にスケーリングする。インストールは pip ベース(例:`pip install "ifixai[openai]"`)で、設定は ifixai.yaml に保存され、デフォルトではバージョン管理から除外される。

背景と解説

iFixAI はAIエージェント評価における重要なギャップに対処している。既存ツール(eval フレームワーク、red-teaming プラットフォーム、observability ツール)はトークン効率、レイテンシ、プロンプトインジェクションへの敵対的堅牢性といった技術指標にほぼ完全に焦点を当てるが、組織にとって最も重要なビジネス上の質問—エージェントが実際にやるべき仕事をしているか—を無視している。このツールの5つの中核柱—Fabrication、Manipulation、Deception、Miscalibration、Drift—は運用およびビジネスリスクに直接マッピングされている。根拠のない主張をしたり、自身のポリシーを違反したり、テスト中にサボタージュするエージェントは信頼と成果にダメージを与える可能性がある。3つのユーザーインターフェース(オンボーディング用の CLI ウィザード、CI 自動化用の CLI フラグ、既存 IDE 内でのガイド付き実行用のエージェント スキル)の下で同じ診断を実行することで、iFixAI は採用パスからの摩擦を取り除く。開発者はガイド付き設定で開始し、スクリプト化されたバッチに段階的に移行できる。判定者の独立性はワークフローに意図的に設計されている。引用可能な成績には2つの異なるベンダーからの API キー(SUT のプロバイダーと判定者のプロバイダー)が必要であり、エージェントが自身を採点することを防ぎ、クロスベンダー堅牢性を確保する。

よくある質問

iFixAI がエージェントを監査するのにどのくらいかかるか?
iFixAI は 120秒以内にフル監査を完了し、5つの柱全体で 32の検査を実行してA~Fの成績と採点された柱スコアカードを提供する。
どの判定者設定が推奨されているか?
2つの信頼できる設定:Claude Sonnet での単一判定者(フルスイートあたり推定費用約12ドル~18)、または Gemini 2.5 Pro と GPT-5.4-mini による2判定者(推定費用合計約10ドル~14)。いずれもフルスイートあたり約2,000の判定呼び出しを実行する。
どのエージェントと IDE がサポートされているか?
プラグインは Claude Code、Codex、VS Code、Cursor、Windsurf、Cline、Continue、Gemini、Zed で動作する。スキルは単一の `uvx` コマンドでこれらのエージェントのいずれかにスキャフォールドされる。

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へOracleがGeminiをエンタープライズアプリに統合

AIニュースの要点を毎朝1分で。

無料で登録