
Anthropic は Amazon のセキュリティチームからの要請に応じ、悪意のある使用を阻止する仕組みを強化した新版 Claude「Fable 5」を展開しました。
政府や大規模事業者からセキュリティ要件が提示される流れが実際に機能しており、99% 以上の精度で有害な指示を遮断できる一方で、正当な用途は妨げない設計になっています。
何が起きたか
Anthropic が AI モデル Claude に新版「Fable 5」を展開しました。Amazon のセキュリティチームからの要請を受け、悪意のある使用を防ぐ仕組みを強化したもので、Pro、Max、Team、一部の Enterprise で現在利用できます。サブスク利用者には 7 月 7 日までの期間限定で提供予定です。
なぜ重要か
政府や大規模クラウド事業者が AI のセキュリティリスクに関わる具体的な要件を企業に突き付け始めたということを示しています。Anthropic は要望を受けた対策を実装することで、官民協力の枠組みが機能することを示した形となり、同様の対策がほかの AI 企業にも求められる可能性があります。
注目点
Fable 5 は悪意のある要求を含む高度な指示でも 99% 以上の精度で阻止できるとの評価を受ける一方、通常のプログラミング相談といった正当な用途の阻止率は低く抑えられています。HackerOne というバグ報奨金プログラムでも脆弱性を募集中で、セキュリティ上の課題が継続的に検証されます。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
ViskoはLlama Venturesからプレシードで1000万ドルを調達し、長編動画を生成するライブモデル「Orbis」を一般公開した
8月の米国市場は上昇で終え、S&P 500は2.6%高、ナスダックは3.9%高となった

アブダビ拠点のNeurovia AIが、サウジアラビアの治安機関向けに映像ファイルを最大95%圧縮できるソフトウェアを提案している

AI企業のRunwayが、新カテゴリー「インターフェース・ワールドモデル」の第一弾となるSolarisを発表した

GoogleのAI検索が、アフリカ系、インド系、パキスタン系の人と二人きりのユーザーに緊急通報を勧め、イギリス人には紅茶を提案した

ジョンディアは、農家が過去の農場データについて自由な質問ができる対話型AIツール「JD」を発表した
