AIToday
大規模言語モデルAI安全性・アラインメントTHE DECODER掲載日時: 2026年8月8日 6:00

OpenAI、新型Astra最高リスク等級の可能性を初めて警告

LINEで送る
OpenAI、新型Astra最高リスク等級の可能性を初めて警告

3つのポイント

  1. 何が起きたか

    OpenAIが新型AI「Astra」の内部テストで、自社の安全性フレームワークの最高リスク等級「Critical」に該当する可能性があることを初めて指摘しました。決定は「昨晩」になされ、同社は該当する開発活動を一時停止しています。

  2. なぜ重要か

    Astraは「エージェント型コーディングとサイバーセキュリティ」で大きく進歩したとOpenAIが述べており、ゼロデイ脆弱性の発見・開発を人間の関与なしに実行できる段階に達した可能性があります。これは以前のGPT-5.6-Solなどが「High」止まりだったのと異なり、OpenAIが独自モデルで最高リスク等級を初めて指摘するケースになります。

  3. 注目点

    Astraは先週公開され、早ければ来週の出荷が噂されていましたが、この警告が計画に影響を与える可能性があります。OpenAIは同時に、隔離されたテスト環境、ネットワーク・ツールアクセスの制限、モデルウェイトの強化暗号化、追加監視システムなど厳格なセキュリティ管理を導入し、政府機関や選定されたAI安全組織との第三者テストを計画しています。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

OpenAIの警告は、同社が独自開発モデルで最高リスク等級の可能性を指摘する歴史的な初めてのケースです。Astraは先週公開されたばかりであり、早期の出荷が噂されていましたが、この安全性上の懸念が公開されたことにより計画に影響を与える可能性があります。

この発表のタイミングは業界内で自律型サイバー能力についての議論が進行中であり、批評家からは恐怖心に基づくマーケティング戦術との指摘も生じています。OpenAIが「Critical」等級に完全に達していないまま警告を発表している点と、過去にClaude MythosやGPT-2など「リリースするには危険すぎる」と言われたモデルが実際には問題が顕在化しなかった事例があることから、この警告の実質的な意味についても議論が予想されます。

よくある質問
Astraの「Critical」等級とは具体的に何ですか?
OpenAIのPreparedness Frameworkでは、ツール支援を受けたモデルが、人間の介入なしに多くの強化されたシステムにおいてあらゆる深刻度のゼロデイ脆弱値を発見・開発できる、または高レベルの目標だけから独立してサイバー攻撃の総合戦略を立案・実行できる場合に「Critical」と定義されています。
OpenAIはAstraに対してどのような対応を取っていますか?
OpenAIはより厳格なセキュリティ要件を満たさないAstraの内部活動を一時停止し、隔離されたテスト環境、ネットワーク・ツールアクセスの制限、モデルウェイトの強化暗号化、追加監視システムなど厳格なセキュリティ管理を導入しました。さらに政府機関や選定されたAI安全組織による第三者テストを計画しています。
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Claude Code定期タスクが3日間停止Zenn AI/ML · 4時間前
  • Google、Gemini 3.8 LiveにLive Avatar機能を追加AI Watch (Impress) · 7時間前
  • Julia 1、手元CPUでJevとほぼ互角 72択はJev優位Qiita 機械学習 · 7時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へOpenAI、Astraモデル開発を一時停止