
Anthropicが安全性強化後にFable 5の全世界配信を再開しました。
Amazon研究者が発見した安全機構の回避手法に対抗するため、99%以上の精度でその技術をブロックする新しい安全分類器を導入しています。
同社は政府と協働しながら業界全体でジェイルブレーク対策の標準化を進める必要があると主張しており、米政府との協力体制をさらに強化していく方針です。
何が起きたか
米政府による2週間の使用禁止を経て、Anthropicは最新AIモデル「Fable 5」の全世界配信を再開しました。Claude Platform、Claude.ai、Claude Code、Claude Coworkで提供開始され、Pro・Max・Team・一部Enterprise プランは7月7日まで利用枠の50%まで無制限アクセスが可能です。
なぜ重要か
Amazon研究者が見つけた安全機構の回避方法により政府が配信を一時停止していました。Anthropicは新しい安全分類器を導入し、当該技術をブロックする精度を99%以上に高めました。同社は「AIモデルを完全にジェイルブレーク耐性にするのはおそらく不可能」と認めつつ、業界全体で共有できるジェイルブレーク評価基準の構築を求めています。
注目点
改善された安全分類器は有害でないコード作業でも誤ってリクエストをブロックする可能性があり、前回の配信でユーザーから制限が厳しすぎるという指摘を受けていました。Anthropicはセキュリティ研究者向けの新HackerOneプログラムを立ち上げ、Fable 5向けのサイバージェイルブレーク報告を募集しています。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
レディット株は年初来36.7%下落

エヌビディアのジェンスン・フアンCEOはCNBCの「マッド・マネー」で、オープンAIがブロードコムと開発した独自AIチップ「ハラペーニョ」に腹を立てていないと語った

OpenAIは、CursorのSpaceXによる買収を受け、Cursorとの提携終了を発表した

マイクロソフトの2026年度10-Kで、オープンAIとの商用契約による収益241億ドル(収益分配金含む)が開示された

AIが現在、いわゆるヤコビアン予想を含む長年の数学問題の解決を支援しており、トップ数学者たちはこれが最終的に良いことなのか悪いことなのか深く迷っている

15の言語モデルを対象に、出典付きの2件の依頼でベンチマークを実施
