AIToday

Microsoft のAIセキュリティツール、ベンチマークで競合他社を12ポイント上回る

Ars Technica AI2時間前LINEで送る
Microsoft のAIセキュリティツール、ベンチマークで競合他社を12ポイント上回る

要点

Microsoftは月曜日、2つの新しいAI搭載セキュリティツールを発表した。MAI-Cyber-1-Flashを搭載したMDASHはCyberGYMベンチマークで96%を獲得し、Anthropic、Google、OpenAIの競合システムを12ポイント上回り、従来版の半分のコストで利用可能。また、セキュリティタスクの90%を競合他社より低コストで処理するよう設計された専門AI エージェントのプラットフォーム「Project Perception」も発表した。これらのツールは、AIが攻撃速度と規模の両方を加速させ、防御側が従来の手法で複雑化するネットワークを保護せざるを得なくなっている状況の根本的な変化に対応している。

こういう要約が、毎朝あなたのメールに届きます。

無料で登録 →

3つのポイント

  • 何が起きたか

    Microsoftは月曜日、2つのAIセキュリティツールを発表した。MAI-Cyber-1-Flashを搭載したMDASHはCyberGYMベンチマークで96%のスコアを獲得し、Anthropicの Mythos より12ポイント高く、Google GeminiおよびOpenAI GPTを上回った。また、赤チーム、青チーム、緑チームのセキュリティ機能を担当する専門AI エージェントのプラットフォーム「Project Perception」も発表。新しいMDASHの利用コストは従来のMDASH提供サービスの半分。

  • なぜ重要か

    Microsoftによると、Project Perception はセキュリティタスクの90%をライバル企業のプラットフォームより低コストで実行でき、組織は残り10%のタスクにのみ高額な代替案を使用すればよい。これらのツールは、AIがサイバー攻撃の速度と規模の両方を加速させ、セキュリティチームが時代遅れのアプローチで急速に複雑化する環境を管理せざるを得なくなっている状況の変化に対応している。

  • 注目点

    両ツールは現在プレビューモード中であり、本番環境で使用する前に慎重に検討する必要がある。ただし、こうしたツールの採用を避けるリスクも明らかに存在する。AIエージェント使用のリスクと採用回避のリスクとのバランスは未解決の状態が続いている。

詳細

Microsoftは、急速に加速する脅威から組織を防御するのに役立つ、2つの新しいAI搭載サイバーセキュリティツールを発表した。第1のツール「MAI-Cyber-1-Flashを搭載したMDASH」は、標準ベンチマークテストであるCyberGYMで強いパフォーマンスを発揮し、96%のスコアを獲得した。この結果は、同ツールをAnthropicの Mythos より12ポイント上回り、Google(Gemini)およびOpenAI(GPT)からのオファリングを上回るものとなった。パフォーマンス上の利点に加えて、新しいMDASHバージョンは従来のMDASH提供サービスの半分のコストで導入でき、コスト意識の高い組織にとってより経済的な選択肢となる。

第2のツール「Project Perception」は、異なるセキュリティ機能を処理する複数の専門AI エージェントを組み合わせることで、別のアプローチを採用している。これらのエージェントは、脆弱性を発見するための赤チーム作業(攻撃シミュレーション)、脆弱性を調査してリスクを評価するための青チーム作業(防御)、および改善措置を実装するための緑チーム作業(改善措置)を実行する。すべてのタスクに単一のモデルに依存するのではなく、Project Perception は手元の作業に基づいて最も適切なモデルを自動的に選択する。Microsoftは、この選択プロセスがモデルの有効性と顧客へのコストの両方を考慮し、「フロンティアおよび専門モデル全体における継続的な研究、ベンチマーク、および評価」によって決定されると述べている。

Microsoftはこれらのツールをセキュリティ環境の根本的な変化への対応として位置付けた。同社は、「AIがサイバー攻撃の速度と規模を加速させるにつれ、防御側は異なる時代のために構築されたアプローチで、ますます複雑になるデジタル環境を保護するよう求められている」と述べている。発表によると、セキュリティチームは膨大な量のデータ全体で信号、コンテキスト、リスク洞察をまとめるのに苦労することが多く、新たな脅威に追いつくことがより困難になっている。Project Perception は、セキュリティタスクの90%を競合プラットフォームより低コストで実行することでこの課題に対応することを目指しており、組織は残り10%のユースケースに対してのみ高額な代替案に頼る必要がある。

両ツールは現在プレビューモード中である。この記事は、本番環境での導入前に慎重に精査・評価する価値があり、セキュリティロールにおけるAI エージェント採用のリスクと、そのようなツール採用の回避という同等に重要なリスクの両方があることを指摘している。これらの競合するリスク間のバランスは未解決のままである。

背景と解説

Microsoftの発表は業界全体に広がる緊張関係を反映している。人工知能がサイバー攻撃の高度さと速度の両方を加速させるにつれ、従来のセキュリティアプローチは不十分になっている。同社は問題を規模と複雑性の問題として位置付けており、セキュリティチームは膨大な量のデータを処理し、急速に複雑化するデジタル環境全体にわたって信号を相関させる必要があるが、AI駆動の脅威環境のために設計されたツールに欠けていると述べている。MDASHとProject Perception を既存プラットフォームに対するコスト効率の高い代替案として位置付けることで、Microsoftは価格とパフォーマンスがセキュリティAI市場の差別化要因になったと示唆している。

ベンチマーク比較(Anthropicの Mythos より12ポイント上回り、GoogleおよびOpenAIのフラッグシップモデルをリード)は主要な競争上の主張として機能しているが、これらのツールは本番環境に展開する前に慎重に評価する必要があることが記事で指摘されている。Project Perception のコスト効率(タスクの90%をより低い費用で実行)の強調は、より広い市場シフトも示唆している。購入者は一枚岩のセキュリティソリューションを購入しなくなり、代わりに最も必要な場所でのみ高額で専門的なモデルをインテリジェントに配分するプラットフォームを求めている。両ツールはプレビュー段階であり、実世界での検証がまだ進行中であることを示唆している。

よくある質問

新しいMDASHはCyberGYMベンチマークで競合他社とどう比較されるか?
MAI-Cyber-1-FlashのMDASHはCyberGYMで96%を獲得し、Anthropicの Mythos より12ポイント高く、同じテストでGoogle GeminiおよびOpenAI GPTも上回った。
Project Perception は何をするのか?
Project Perception は、脆弱性の発見を行う赤チーム(攻撃シミュレーション)、リスク調査を行う青チーム(防御)、および是正措置を行う緑チーム(改善措置)の機能を実行する専門AI エージェントの集合体である。プラットフォームは、割り当てられたタスクに基づいて、モデルの有効性と顧客コストの両方を考慮しながら、使用するモデルを自動的に選択する。
Project Perception のコスト上の利点は何か?
Microsoftは、Project Perception が競合他社の同様プラットフォームより低コストでセキュリティタスクの90%を実行でき、顧客は残り10%のタスクにのみ高額な代替案を使用すればよいと述べた。

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

ディスカッション

まだコメントがありません。最初のコメントを投稿しましょう!

ログインして議論に参加

関連記事

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

無料で始める

登録無料・30秒で完了・いつでも解除できます