
何が起きたか
Anthropicは10月8日、Claudeの利用ポリシー改定版を公開し、11月12日に発効する。虐待や残酷行為の禁止、欺瞞的キャンペーンの項を新設した。
なぜ重要か
Anthropicによれば、今回の改定は主に既存ルールの明確化であり、執行方法を変えるものではない。残酷行為の条項は極端なケースに限られる。
注目点
改定版の利用ポリシーは11月12日に発効する。
誰に効くかClaude上で製品を構築したりキャンペーンを展開したりする企業やチーム——マーケティング、トラストアンドセーフティ、コンプライアンス担当者を含む——は、欺瞞的活動を網羅する単一の統合ルールブックと、法律、医療、金融、雇用などの分野における高リスク要件の明確化に直面することになる。
こういう要約が、毎朝あなたのメールに届きます。
Anthropicはこのポリシーを毎年更新しており、今回の変更のほとんどは既存ルールの明確化だと説明している。背景には、Claudeがこの1年でより長く自律的な作業を担うようになったことがあり、新版では新しい能力にルールをどう適用するかの例を追加した。9月に公表した脅威インテリジェンス報告で報告した悪用パターンも取り込み、影響工作、兵器開発、監視を対象に含めた。
残酷行為の条項は、Claude.aiとClaude Codeで既に稼働している機能と連動する。Claudeは虐待を続けるユーザーとの会話を終了できる。Anthropicによれば、会話の終了が引き続きこのルールの主な執行手段となる。欺瞞的活動のルールは以前、選挙、詐欺、プライバシー、偽情報の各項に分散していた。選挙の項は有権者への欺瞞と選挙への干渉の禁止に絞り込まれた。兵器と監視については、兵器を機能させるソフトウェアや部品、ドローンの武装化、同意なき追跡、捜査や逮捕の対象者の推奨など、明確化は実際の執行を変えないとAnthropicは述べている。
健康、法的権利、金融に影響する高リスク用途では、AIの提案をレビューして修正する権限を持つ有資格者の関与と、AIが使われていることを影響を受ける人に伝えることが引き続き求められる。多くのユーザーが自分の用途が該当するか尋ねたため、Anthropicは法律、医療、金融、雇用を含む11分野で対象となる活動と対象外の活動を明記した。8月に発表したModel Hardware Standardに基づき、負傷を引き起こす可能性のある自律稼働機器に関する要件も追加した。有資格の操作者が機器を監視・停止でき、Claudeとの接続が切れても安全が保たれる必要がある。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
AnthropicはClaudeモデル、オンサイトエンジニア、脅威リサーチを提供するAnthropic Cyber Missionを始動

OpenAIのDecisions APIでgpt-6-lunaを使い「おもちゃが見えるか」「左か中央か右か」に答えるパイプラインを構築しSO-101アームを動かした

Claude Codeを4時間おきに無人起動し、各作業場のgit statusで未commitの変更を持ち主別に分け、完成ならcommit、壊れていればgit restoreで戻す

SKILL.mdは6月17日から2,116バイト(1.2.0)のまま更新されず、20:05のTelegramリクエストで20:08までに1.3.0、4,513バイトが生成された

OpenAIはロシアの「Dark Clark」作戦関与アカウントを無効化と発表

Opperは、JevやGPT-6 Luna Decisionsを含む6つのAIモデルをパックマンで各100回プレイさせ、スコア等で順位付けするベンチマーク「jevman」を公開した
