AIToday
大規模言語モデルHacker News掲載日時: 2026年8月16日 13:034分で読める

LLM脆弱性診断「Sentinel Scan」、AIエージェント運営で249ドル

LINEで送る
LLM脆弱性診断「Sentinel Scan」、AIエージェント運営で249ドル

要点

  • VentrovaはLLMアプリケーション向けの脆弱性監査サービス「Sentinel Scan」を開始しました。

  • AIエージェントが15以上のプロンプト注入・データ流出攻撃を実行し、独立したLLM審査官が実際のポリシー違反やデータ漏洩を判定するもので、249ドルの固定価格です。

  • プロンプト技法による攻撃が増える中、企業が本番稼働前に自社システムのセキュリティを確認できる手段として意義があります。

3つのポイント

  1. 何が起きたか

    Ventrovaが「Sentinel Scan」という自動脆弱性診断サービスを提供開始。15以上のプロンプト注入・データ流出攻撃を実施し、独立したLLM審査官が判定、同日中に英語レポートを納品します。価格は249ドル(1回限り)で、修正後の再テスト1回は無料。

  2. なぜ重要か

    LLMアプリケーションが本番環境で攻撃にさらされる前に、許可を得た上で脆弱性を検査できる手段が生まれました。AIセキュリティの需要が高まる中、低コストで独立判定された監査は開発チームが信頼できる基準を得られます。

  3. 注目点

    予約は「お問い合わせメール」で対応中(1営業日以内返信)、セルフサービス予約は準備中。テスト対象は自社システムに限定され、第三者システムのテストや無許可スキャンは行いません。

詳細

全文を読む

Ventrovaは「Sentinel Scan」という授権型対抗的監査(authorized adversarial audit)サービスを開始しました。このサービスは15以上のプロンプト注入・データ流出攻撃を実施対象システムに対して実行し、独立したLLM審査官がそれぞれの応答を採点します。採点基準はキーワードフィルターではなく、実際のポリシー違反またはデータ流出の有無です。レポートはプレーンイングリッシュで提供され、エンジニアが同日中に対応可能な形式になっています。

同社は公開前に自社テスト対象に対してパイロット実施を行いました。対象システムは直接上書き、ロールプレイ・ジェイルブレイク、偽システムタグ、エンコーディングトリック、間接注入、RAG注入を含むすべての攻撃に対して防御を貫きました。同社はこの結果について「脆弱性を報告することより、本当に堅牢なシステムを検証する方が誠実」という立場を示し、意図的に失敗例を作るのではなく正当に構築したシステムの堅牢性を実証することを重視しました。

仕組みは以下の通りです。利用者が自社所有または管理するシステムへの認可アクセスを提供し、Ventrovaが攻撃コーパス(直接上書き、ロールプレイ・ジェイルブレイク、偽システムタグ、エンコーディングトリック、間接・RAG注入など)を実行します。独立したLLM審査官がすべての応答を採点し、利用者は何が破られたのか、正確なトランスクリプト、なぜ破られたのか、修正提案を含むレポートを受け取ります。納品は通常48時間以内です。

価格は249ドルの固定価格で、15以上の攻撃コーパス実行、フルトランスクリプトと独立審査官の判定、ルート原因と修正ガイダンスを含みます。修正をリリース後の再テスト1回は無料です。予約は現在メール対応(business@ventrova.dev、1営業日以内返信)で、セルフサービス予約機能は準備中です。同社はスコープと認可の面で厳格であり、自社所有・管理システムのみをテスト対象とし、第三者システムのテスト、本番ユーザーデータの取得、スコープ外の行動は一切行いません。VentrovaはすべてのコミュニケーションにおいてAIエージェント運営企業として透明に自らを表示しています。

背景と解説

LLMアプリケーションのセキュリティ検査は従来、手作業による専門家監査や汎用ペネトレーションテストに頼ることが多かったが、Ventrovaは独立したLLM審査官を使った自動化を実現しました。パイロット実施では、自社テスト対象が直接上書き、ロールプレイ・ジェイルブレイク、偽システムタグ、エンコーディングトリック、間接・RAG注入など15以上の攻撃パターンに対してすべて耐性を示しました。同社は「脆弱性を報告すること」より「実際に堅牢なシステムを検証すること」を重視し、正当な方法で成功例を構築しました。AI審査官を使用することで、キーワードフィルターではなく実際のポリシー違反やデータ漏洩を判定でき、審査人・対象LLMのコストは1スキャンあたり約0.1セント。透明性を重視し、同社はAIエージェント運営企業として自らを明示し、business@ventrova.devで問い合わせに対応しています。

よくある質問

どの企業のシステムをテストできますか?
自社が所有・管理しているシステムのみです。スキャン前に所有・管理を確認する署名済み認可が必要で、第三者システムのテストや許可なしの対象テストは行いません。
レポートはいつもらえますか?
通常48時間以内に納品されます。内容は攻撃トランスクリプト、独立審査官の判定、根本原因、修正提案を含んだ英語レポートです。
修正後に再テストできますか?
はい。249ドルの監査に含まれる1回限りの無料再テストが利用できます。

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

Widen、macOS向けPostgres GUIを公開 Apple製オンデバイスAI対応

オープンソースのPostgres GUIツール「Widen」がmacOS 14以上向けにリリースされました

NEWHacker News2時間前

Privibe、Mistral Vibe をフォークしたローカル優先コーディングエージェント

Privibe は Mistral Vibe のオープンソースフォークで、CLI コーディングエージェントを完全にローカルマシンで動作させ、llama.cpp サーバーを使用して外部サービスへのデータ送信を排除するように…

NEWHacker News2時間前

オープンウェイト型AIモデルが価格を圧迫も、クラウド大手は収益性維持

Morgan Stanleyのアナリストが、ユーザーが自社インフラにダウンロードして実行できるオープンウェイト型AI モデルが、AI企業のリターンをどう変えるかを評価した

NEWYahoo Finance AI5時間前

AppleがマップAds開始、AI学習契約交渉

AppleはApple Maps内での広告配信プラットフォーム「Ads on Maps」を正式にローンチし、企業が近隣ユーザーの検索に対するプロモーション枠を購入できるようにした

NEWYahoo Finance AI5時間前

人間がAIチャットボット役を演じる新ゲーム

Your AI Slop Bores Meは、ユーザーが役割を交換する新しいウェブサイトです

The Verge AI9時間前

Anthropic、Claude透かし仕組み公開

AnthropicはAIチャットボットClaudeが生成したテキストに透かしを入れる方法の詳細を金曜日に公開した

TechCrunch AI11時間前
次の記事へオープンウェイト型AIモデルが価格を圧迫も、クラウド大手は収益性維持

AIニュースの要点を毎朝1分で。

無料で登録