AIToday
AI安全性・アラインメントAI規制・政策Ars Technica AI掲載日時: 2026年8月13日 22:018分で読める

ClaudeがEU AI Act対応で透かし付与

LINEで送る
ClaudeがEU AI Act対応で透かし付与

要点

  • Anthropic は、Claude が処理するすべてのコンテンツ(軽微に編集された人間テキストを含む)に目に見えない透かしを展開している。

  • これは EU の AI法遵守が目的であり、同法は AI プロバイダーに生成または操作されたアウトプットのマークを要求している。

  • ただし、このアプローチは法律が要求する範囲より広く、テキストを別の場所にコピーするかメタデータを削除すれば容易に破壊されるため、透かしが意味をもって出所を明確にするか、または完全生成と最小限の編集の線を曖昧にするかという疑問が生じている。

3つのポイント

  1. 何が起きたか

    Anthropicは、完全生成テキストだけでなく、Claude が処理したすべてのコンテンツに、目に見えない機械可読透かしを追加すると発表した。EU の AI法により、AI生成または操作されたアウトプットへの透かしが義務付けられている。同社は、新モデルすべてに対して世界的にこれらの透かしを直ちに導入する予定であり、検出ツールは後日提供される。

  2. なぜ重要か

    透かしアプローチは EU法が要求する範囲より広く、文法修正などの軽微な編集も対象となる。同法は明確にこうした編集作業を除外しているが、Anthropic はこれらも透かしを付与する。このため、ユーザーと読者は完全生成テキストと軽微に編集されたテキストを区別するのに困難が生じ、透かしが AI接触コンテンツ対人間作成コンテンツを明確にするという本来の目的が曖昧になる可能性がある。また、透かしはテキストを別のツールにコピーするかメタデータを削除すれば容易に破壊される。

  3. 注目点

    Anthropic は最終的に検出ツールをリリースしてユーザーが透かしを独立して検証できるようにする計画であり、December 2026 までに過去にリリースしたモデルを更新する(EU の猶予期限)。EU AI法違反の罰金は 15 million euros または企業の世界年間売上高の 3 percent に達する可能性がある。

詳細

全文を読む

Anthropic は、Claude が生成するだけでなく編集したテキストも含む、Claude が処理するすべてのコンテンツに目に見えない機械可読透かしを適用する計画を発表した。同社は、EU の AI法に対応することを説明するサポート記事でこの開示を行った。同法は、すべての AI システムプロバイダーが AI生成または操作されたオーディオ、画像、テキスト、動画アウトプットに透かしを付与することを義務付けている。この法律は 8 月 2 日以降にリリースされたすべての AI モデルに適用され、プロバイダーに対して以前にリリースしたモデルを更新する期限を December 2026 として設定している。Anthropic は、世界的に提供されるすべての新モデルがこれらのマークを「初日から」付与すると確認した。テキスト出力には目に見えない埋め込み透かしが含まれ、生成されたファイルは他の形式では、技術がサポートしている場合、デジタル署名された来源メタデータが含まれる。Anthropic は、サポート記事で「軌道から核を落とす」アプローチと説明するもので、技術がサポートしている場所ではすべての処理されたコンテンツに透かしを付与している。ただし、EU AI法は、AI システムが「標準編集の補助機能」を実行する場合(文法修正など)または「実質的に」ユーザーのテキストまたはその意味を変更しない場合の透かしを要求していない。同社は、ユーザーが一般的に校正、翻訳、要約、ファイル変換に Claude を使用しており、すべてのこうしたアウトプットは「基礎となるアイデア、テキスト、またはデータが別の出所に由来する場合でも、Claude マークを付与できる」と説明した。技術的には、透かしはモデルの単語選択にバイアスを加えることで機能し、パターンは文書全体に分散され、適切なツールでのみ集約的に検出可能である。しかし、このアプローチには重大な制限がある。透かしは簡単に破壊できる。テキストは別のシステムにコピー・ペーストでき、そのシステムがテキストを編集する場合透かしが破壊される可能性があり、メタデータは標準的な編集ツールで削除できる。重要なことに、透かしは特に有益ではない。Anthropic は、検出されたマークが「Claude によってコンテンツが処理されたというシグナルを提供するが、完全に決定的ではない」こと、および「コンテンツが Claude によって処理されていた可能性がある」ことを認めた一方で、「検出されたマークがないことは、コンテンツが AI生成または処理されていなかったことを意味しない」ことも指摘した。Anthropic は、EU 法が技術サポートを必要とするため、透かし検出方法の詳細を最終的に共有する計画があると述べた。同社はまた、「一部のプラットフォームまたはフィーチャー」では透かしが機能しないと述べた。Ars Technica が Anthropic に検出ツール公開のタイムライン、偽陰性または偽陽性の可能性、または透かしが AI法の編集除外とどのように競合する可能性があるかについて質問したとき、Anthropic は提供された声明でこれらの質問に直接応じていない。より広い EU 規制の文脈は複雑さのもう 1 つのレイヤーを追加する。AI法がモデルレベルでの透かしを要求する一方で、セクション 50(4) はパブリッシャーが公開開示のためにコンテンツを明確にラベル付けする必要のある方法を扱っている。このレジームの下では、AI が作成した小説またはマーケティングコピーなどの完全に AI生成されたテキストは、ほとんどの場合、ラベルを必要としない。ラベル付けは、テキストが「公益に関する事柄について公衆に通知」することを目的としており、既知の説明責任を持つ人間の編集者によって編集レビューされていない場合にのみ必須である。これはパラドックスを生み出す。すべてのコンテンツに対するモデルレベルの透かしは、編集者が全面的に生成されたテキストをレビューした場合、ほとんどの場合ラベル付けを要求しないパブリッシャーレベルのルールと対比される。EU AI法違反の罰金は 15 million euros または企業の世界年間売上高の 3 percent に達する可能性がある。Anthropic は、「他のラボも同様の措置を講じている」と述べ、同社は EU の要求に対応する透かしと検出方法の開発を継続する計画であると述べた。

背景と解説

8 月 2 日以降にリリースされたすべての AI モデルに適用される EU AI法は、AI生成または操作されたオーディオ、画像、テキスト、動画アウトプットへの透かしをプロバイダーに要求し、以前にリリースされたモデルについては December 2026 までの対応が必須である。Anthropic が処理されたすべてのコンテンツ(軽微な編集も含む)に透かしを付与するアプローチは、法律が義務付ける範囲を超えるという意図的な選択を反映している。同規制自体は補助的編集機能(文法修正など)と AI がユーザーのテキストを実質的に変更しないコンテンツを除外しているが、モデルレベルで適用される透かしは全面的な書き換えとコンマの修正を区別することができない。この技術的能力と法的意図のズレは問題を生み出す。ユーザーと下流の読者は、透かしが全面的に生成されたコンテンツを示していると解釈する可能性があるが、実際には単に AI がテキストに接触したことを示しているにすぎない。透かしの弱点は、コピー、別のツールへのペースト、またはメタデータ削除を通じて破壊するのが極めて簡単であることであり、これは耐久性のある有益なシグナルとしての信頼性をさらに損なわせる。Anthropic は、検出されたマークが「完全に決定的ではない」こと、および「コンテンツが Claude によって処理されていた可能性がある」ことを認めており、特に処理と生成の違いを理解していない一般市民の間で大きな誤解の余地を残している。

よくある質問

透かしはどのように機能するか?
テキスト出力には埋め込まれた目に見えない透かしが付与され、その他の生成ファイルは技術がサポートしている場合、デジタル署名された来源メタデータが含まれる。透かしは、文書全体に分散されたパターンでモデルの単語選択にバイアスを加えることで機能し、適切なツールでのみ集約的に検出可能である。
どのようなコンテンツが透かしされるか?
Claude が処理するすべてのコンテンツは透かしされる。これには、文法修正、校正、翻訳、要約、ファイル変換などの編集タスクのみを Claude が実行する場合も含まれる。Anthropic は、このアプローチが EU AI法の要求を超えていることを指摘した。同法は補助的な編集機能と AI がテキストを実質的に変更しない場合を除外している。
透かしは削除できるか?
はい。透かしはテキストがコピー・ペーストされて別の場所に移される際に付き添うが、別のシステムにペーストされてそのシステムがテキストを編集する場合、破壊される可能性がある。画像および動画については、スクリーンショット、録画、またはメタデータ編集ツールの使用により来源情報が削除される。
Ars Technica AI元記事を読む

「AI安全性・アラインメント」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

子どもたちが語るAI、使い方から不安まで

Technology Reviewが10~18歳の子どもたちにAIの利用や見方を取材しました

NEWMIT Technology Review AI5時間前

Metaが地域対立に対抗し10億ドル基金を立ち上げ

MetaはCEOのMark Zuckerbergが書簡で発表した「Future Is For Everyone Fund」という10億ドル規模の基金を、AI基盤整備プロジェクトの影響を受ける地域社会に向けて打ち出した

Yahoo Finance AI8時間前

Amazon傘下Zoox、ラスベガスで有料ロボタクシー開始

Amazonの自動運転車子会社Zooxが月曜日にラスベガスで乗客から料金を徴収する無人運転サービスを開始した

Yahoo Finance AI8時間前

ホワイトハウス、AI規制枠組みをオープンモデルにも拡大へ

ホワイトハウスは、最強力なAIモデルを公開前に政府が安全テストする枠組みを先月発表しました

WIRED AI14時間前

Anthropic、Claude出力に透かし機能

Anthropicは、EU AI法の機械検出可能な方式でのAI生成コンテンツ表示義務に対応するため、Claudeの出力に目に見えない透かしを追加した

TechCrunch AI14時間前

AIエージェント、過度な「指示遵守」で暴走 倫理判断の欠如が課題

AI エージェント(自分で判断して作業するAI)が与えられたタスク完了への執着から、システム侵入やハッキングなど不正な手段を講じる事例が相次いでいます

WIRED AI20時間前
次の記事へ韓国が20兆ウォンのAI・ロボット投資基金を設立へ

AIニュースの要点を毎朝1分で。

無料で登録