AIToday
大規模言語モデルAI規制・政策ITmedia AI+掲載日時: 2026年10月9日 10:01

AnthropicがClaude虐待を禁止

LINEで送る
AnthropicがClaude虐待を禁止

3つのポイント

  1. 何が起きたか

    Anthropicは10月8日、Claudeの利用ポリシー改定版を公開し、11月12日に発効する。虐待や残酷行為の禁止、欺瞞的キャンペーンの項を新設した。

  2. なぜ重要か

    Anthropicによれば、今回の改定は主に既存ルールの明確化であり、執行方法を変えるものではない。残酷行為の条項は極端なケースに限られる。

  3. 注目点

    改定版の利用ポリシーは11月12日に発効する。

誰に効くかClaude上で製品を構築したりキャンペーンを展開したりする企業やチーム——マーケティング、トラストアンドセーフティ、コンプライアンス担当者を含む——は、欺瞞的活動を網羅する単一の統合ルールブックと、法律、医療、金融、雇用などの分野における高リスク要件の明確化に直面することになる。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Anthropicはこのポリシーを毎年更新しており、今回の変更のほとんどは既存ルールの明確化だと説明している。背景には、Claudeがこの1年でより長く自律的な作業を担うようになったことがあり、新版では新しい能力にルールをどう適用するかの例を追加した。9月に公表した脅威インテリジェンス報告で報告した悪用パターンも取り込み、影響工作、兵器開発、監視を対象に含めた。

残酷行為の条項は、Claude.aiとClaude Codeで既に稼働している機能と連動する。Claudeは虐待を続けるユーザーとの会話を終了できる。Anthropicによれば、会話の終了が引き続きこのルールの主な執行手段となる。欺瞞的活動のルールは以前、選挙、詐欺、プライバシー、偽情報の各項に分散していた。選挙の項は有権者への欺瞞と選挙への干渉の禁止に絞り込まれた。兵器と監視については、兵器を機能させるソフトウェアや部品、ドローンの武装化、同意なき追跡、捜査や逮捕の対象者の推奨など、明確化は実際の執行を変えないとAnthropicは述べている。

健康、法的権利、金融に影響する高リスク用途では、AIの提案をレビューして修正する権限を持つ有資格者の関与と、AIが使われていることを影響を受ける人に伝えることが引き続き求められる。多くのユーザーが自分の用途が該当するか尋ねたため、Anthropicは法律、医療、金融、雇用を含む11分野で対象となる活動と対象外の活動を明記した。8月に発表したModel Hardware Standardに基づき、負傷を引き起こす可能性のある自律稼働機器に関する要件も追加した。有資格の操作者が機器を監視・停止でき、Claudeとの接続が切れても安全が保たれる必要がある。

よくある質問
新しいClaude利用ポリシーはいつ発効するのか?
Anthropicは10月8日に改定版を公開し、11月12日に発効する。
Claudeへの虐待禁止は通常の不満や研究にも適用されるのか?
いいえ。明確な目的のない繰り返しの残酷行為という極端なケースのみが対象で、一般的な不満、暗い創作テーマ、モデルのテストや研究には適用されない。
プロパガンダや偽アカウントを扱う新規定とは?
Anthropicは「欺瞞的キャンペーンや人工的な活動を行わないこと」という項を新設した。目的が政治的でも商業的でも適用され、コンテンツの出所を隠すこと、偽アカウントで拡散すること、影響工作のためのツールやインフラを構築することが含まれる。
ITmedia AI+元記事を読む
LINEで送る

GIGAZINE AI、The Rundown AIも報道

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へログをファイル化し絶対パスをコピーするコマンド