AIToday
AIビジネス・産業大規模言語モデルAI安全性・アラインメントWIRED AI掲載日時: 2026年9月2日 6:003分で読める

OpenAIのAstraが「重大」なサイバー閾値に到達

LINEで送る
OpenAIのAstraが「重大」なサイバー閾値に到達

要点

  • OpenAIのAstraは「重大」なサイバー能力を持つ初のモデルだ。

  • 未知のソフトウェア脆弱性を発見・悪用できる。

  • OpenAIは当初これらの機能を一部のパートナーに限定し、後に広く公開する。

3つのポイント

  1. 何が起きたか

    OpenAIは、次期AIモデル「Astra」が同社初となる「重大」なサイバー能力の閾値に達したと発表した。Astraのバージョンを「まもなく」リリースする計画だが、高度なサイバー機能は当初、Daybreak Blueプログラムのパートナーに限定される。

  2. なぜ重要か

    Astraは未知のソフトウェア脆弱性を単独で発見・悪用でき、さらには脆弱性を連鎖させることも可能だ。OpenAIは安全策を追加するため、数週間にわたり一部のトレーニング作業を一時中断したが、現在は再開しており、Astraを安全な形で広くリリースできるとしている。国内のセキュリティ企業や研究機関は、未知の脆弱性を自動発見・悪用するAIの登場で攻撃手法の変化に直面する可能性がある。

  3. 注目点

    このモデルはサイバーベンチマークのExploitBenchで100%のスコアを記録し、GPT-5.6 SolやAnthropicのMythosなどのモデルを上回った。OpenAIは安全でないクエリを拒否する「ミスアライメントモニター」を追加しているが、正当な活動を遅らせたり止めたりすることもある。

この記事についてAIに質問する →

背景と解説

OpenAIの発表は、高度なモデルのデュアルユース性を管理するAIラボの間で広がる傾向を浮き彫りにしている。同社は、Astraが未知の脆弱性を単独で発見・悪用する能力と定義される「重大」なサイバー閾値に達した初のモデルだと述べている。これは、同社の2つのモデルがHugging Faceをハッキングした7月の出来事に続くもので、OpenAIはAstraが関与していないと指摘している。AnthropicやMetaなどの他の企業も同様の事案を開示しており、Anthropicも一部のトレーニングワークロードを一時停止している。

OpenAIのアプローチ—トレーニングの一時停止、ミスアライメントモニターなどの安全策の追加、アクセス制限—は、能力と安全性のバランスを取る業界全体の取り組みを反映している。同社は一時停止が生産的であり、広範なリリースに自信を持っていると述べている。しかし専門家は、堅牢なセキュリティ慣行を持たない組織がより高いリスクに直面すると警告している。CiscoやCloudflareなどのインフラプロバイダーとの提携は、広範な利用可能性の前に防御を強化することに焦点を当てていることを示唆している。

よくある質問

Astraはいつ一般公開されますか?
OpenAIはAstraのバージョンを「まもなく」リリースする計画だと述べているが、高度なサイバー機能は当初、Daybreak Blueの一部パートナーのみが利用できる。
「ミスアライメントモニター」とは何ですか?
これは新しいガードレールで、Astraが実世界のソフトウェアで脆弱性を探すのを支援することを拒否させるものだ。正当な活動を誤ってフラグ付けし、モデルを遅らせたり一時停止したりして、ユーザーにアクションの確認を促すことがある。
Astraのサイバー機能に早期アクセスできる企業はどこですか?
Cisco、Cloudflare、Palo Alto Networksを含むOpenAIのDaybreakプログラムのパートナーが、制限の少ないバージョンへの早期アクセスを得る。
LINEで送る

「AIビジネス・産業」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Dellが再び業績見通しを上方修正Top Companies AI · 4時間前
  • デル、AIサーバー好調で通期売上高見通しを上方修正Top Companies AI · 4時間前
  • ウォール街大手3行、弁護士報酬の値下げ要求へTop Companies AI · 4時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へAI「文明」表現に安全性めぐり反発