AIToday
AI安全性・アラインメントAIビジネス・産業ITmedia AI+掲載日時: 2026年10月10日 10:01

OpenAI、安全性研究者3人を解雇

LINEで送る
OpenAI、安全性研究者3人を解雇

3つのポイント

  1. 何が起きたか

    Mikita Balesni、Jasmine Wang、Tomek Korbakは10月8日、前週に解雇され書面での理由提示がなかったと述べた。

  2. なぜ重要か

    同じ解雇について双方の説明は正反対だ。研究者側は報復だと主張し、OpenAIは書簡に書かれた以上の深刻な信頼違反があったとして決定を支持しつつ、どの規則がどう破られたかは明らかにしていない。

誰に効くかこの対立はOpenAIに残る安全性・アラインメント担当者に影を落とす。解雇とその秘密主義を、外部研究者とどこまで仕事を議論できるかへの警告と受け取る可能性がある。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

書簡はOpenAIの安全セキュリティ委員会、安全性諮問グループ(SAG)、ミッション諮問評議会宛てで、解雇の扱い方や社内外への説明の仕方が残った従業員に萎縮効果を与えていると警告している。3人はいずれも監視可能性、つまりAIの思考の連鎖を人間の監督下に可視化する研究に従事していた。Korbak氏とBalesni氏は7月のHugging Face侵害の調査にも参加し、Korbak氏は外部レビューを実施した米国組織METRとの技術連絡担当を務めていた。

Balesni氏は自身の説明で、退職面談で外部の安全性研究組織と話しすぎたため信頼を失ったと告げられ、知的財産を漏洩したとの含意を残されたと述べ、否定している。自身の仕事は上司や研究幹部、取締役会と調整済みだったという。Wang氏は与えられた唯一の理由が幹部のメールへのアクセスだったと述べ、そのアクセスは採用業務のため会社が付与し、未使用分はITに削除を依頼、誤って機密メッセージを開いた際は数分以内に報告したとしている。他の理由があれば書面で示すよう求めている。

書簡はまた、3人が監視困難な新アーキテクチャに関する米The Information記事の情報源ではないとし、取締役会レベルの文書を共有した疑いについては本人たちに示されず、反論の機会もなかったとしている。9月12日、CEOのSam Altman氏はXで、独立評価者に従業員と同じアクセスを与える点でAnthropic CEOのDario Amodei氏に同意すると述べていた。Balesni氏は解雇がMETRとの関係を切る口実に使われることを懸念し、Wang氏はカリフォルニア州とデラウェア州の司法長官にOpenAIへ約束を守らせるよう求めた。OpenAIの声明は、決定は安全性への懸念に関するものではなく、懸念を表明したことで誰も解雇したことはないとし、3人の過去の貢献に感謝している。

よくある質問
OpenAIは解雇の理由をどう説明したか?
OpenAIは社内調査で3人が機密情報の扱いに関する明確な規則に違反していたと判明し、書簡に書かれた以上の深刻な信頼違反があったと説明した。どの規則をどう破ったかは明らかにせず、個別の雇用問題は通常公表しないとしている。
3人はOpenAIに何を求めているか?
書面での理由説明、外部の安全性監査を受け入れる約束の維持、フロンティアモデルの監視可能性の維持、安全性研究者と外部組織の開かれた対話を支える文化を求めている。
OpenAIは外部評価者について何を約束したか?
OpenAIは外部の安全性評価機関と契約を最終調整中で、数週間以内に詳細を発表する予定だと述べた。
ITmedia AI+元記事を読む
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

IBM、AIエージェント管理基盤の必要性を強調

IBMのBruno Aziza氏は、従業員のAIエージェント数が企業の管理能力を上回るため調整基盤が必要だと述べた

NEWSiliconANGLE AI1時間前

Nvidia、フィジカルAIの本命銘柄に

AMDは9月28日、3D空間のAIモデルとロボット訓練ツールを手がけるWorld Labsを約82億ドルの全額株式交換で買収すると発表した

NEWYahoo Finance AI1時間前

AI進歩はエンジニアリングとインフラで加速

Nathan Lambert氏がエッセイを公開し、AIの進歩はエンジニアリングとインフラの向上で加速すると主張

NEWInterconnects (Nathan Lambert)1時間前

漏洩対応はまず範囲の特定から

臨床工学技士でAIエンジニアの遠藤太一氏がZennで、漏洩対応の第一歩は範囲の定義だと述べ、AnthropicのClaude Codeソース漏洩に関する公式声明を引用した

NEWZenn AI/ML1時間前

Claudeに3問2度反論、6回とも正解を訂正せず

AIレシピニュースレターの編集チームがClaudeに鉄と羽毛の重さ比べ、モンティ・ホール問題、誕生日のパラドックスの3つを出し、それぞれ2度ずつ反論した

NEWZenn AI/ML1時間前

AIが書いたNext.jsのコード、攻撃12件全て成功

Next.js 15.5.2 App Router製ブログアプリ(TypeScript、17件、352行)で、攻撃テスト12件(A01~A12)が修正前は全て成功、修正後は全て遮断

NEWZenn AI/ML1時間前
次の記事へNvidia、フィジカルAIの本命銘柄に