AIToday
大規模言語モデルAI安全性・アラインメントAI規制・政策TechCrunch AI掲載日時: 2026年8月16日 4:006分で読める

Anthropic、Claude透かし仕組み公開

LINEで送る
Anthropic、Claude透かし仕組み公開

要点

  • AnthropicはClaudeが生成したテキストにEU AI法のAI生成コンテンツ識別要件に対応するための透かしを入れる方法を公開した。透かしは低リスクの単語選択に検出不可能なパターンを埋め込み、復号化キーを持つ者のみが検出できる。

  • 同社は検出APIをリリースする予定。

  • 透かしは出力品質に影響を与えないが、この発表はClaudeユーザーを分断させており、プライバシー侵害と見なす者がいる一方で、必要な透明性対策と主張する者もいる。

3つのポイント

  1. 何が起きたか

    AnthropicはAIチャットボットClaudeが生成したテキストに透かしを入れる方法の詳細を金曜日に公開した。透かしはGoogle DeepMindが2024年に発表したSynthID-Textアプローチを使用し、低リスクの単語選択(「曇り」と「灰色」の選択など)に検出不可能なパターンを埋め込む。Anthropicは透かし検出APIをリリースする予定。

  2. なぜ重要か

    透かし要件はEU AI法の透明性コードに由来し、AI企業にAI生成コンテンツを特定することを義務付けている。この動きはClaudeユーザーの間で議論を巻き起こしており、透明性の過度な規制だと主張する者もいれば、詐欺を防ぐために必要だと擁護する者もいる。Business Insiderが報じたところでは、X上の「数十人」のユーザーがこれに対してClaude購読をキャンセルしていると述べている。

  3. 注目点

    軽い編集では透かしは削除されない可能性が高いが、すべての単語が置き換えられる完全な書き直しで削除される。コードは最小限の透かしとなる。なぜなら、モデルは恣意的な選択(コメントなど)においてのみ自由度が必要で、機能的なコードロジックではそうでないからだ。他の主要モデル開発企業も同じ行動規範に署名しており、独自の透かしを実装する。

詳細

全文を読む

金曜日、Anthropicはチャットボット企業のClaudeが生成したテキストに透かしを入れる方法を明確にするためのブログ投稿を公開した。透かし導入は週前半に発表され、AI企業にAI生成コンテンツを識別可能にするシステムの実装を義務付けるEU AI法の透明性コードで要求されている。

技術的アプローチはSynthID-Textを使用し、これは2024年にGoogle DeepMindチームが発表した方法である。透かしは、モデルが「低リスク選択」を行うときにClaudeのレスポンスにパターンをエンコードすることで機能する。例えば、天候を表現する「曇り」または「灰色」のような類義語の選択である。エンコードされたパターンは人間の読者には知覚できないが、復号化キーを持つ者なら検出できる。Anthropicは「透かしはClaudeの出力品質に影響を与えない」と述べ、「読者にとって、透かしの有るレスポンスと無いレスポンスは区別不可能である」と述べた。同社は透かし検出APIをリリースする予定である。Anthropicはまた、透かしはPangramなどの企業が提供するAI検出方法と根本的に異なることを明確にした。これらの方法はテキスト自体の「それは[X]ではなく[Y]である」などの特徴的な文体パターンを検索する。

Anthropicはいくつかの実際的な懸念に対処した。編集に関しては、軽い編集では透かしがおそらく完全には削除されないが、すべての単語が置き換えられる完全な書き直しで透かしが削除されることを認めた。ただし、Anthropicはそのような広範な書き直しはテキストがまだ有意義にAI生成かどうかという疑問を引き起こすと述べた。Claudeに軽く編集されたテキストについては、透かしの検出可能性は「テキストの長さとClaudeがどの程度編集したかに依存する」。軽く編集された場合、「ほぼすべての単語」は人間の著者からのものとなり、「透かしが添付する対象はほぼない(何もないかもしれない)」となる。コードは最小限の透かしとなる。なぜなら、モデルはコメントなどの恣意的な選択領域でのみ自由度が必要であり、透かしは「実際のコード生成に無視できる影響を与える」からである。

この発表はClaudeユーザーが透かし義務化をめぐる激しい議論に参加しているさなかに行われた。Redditでは、一部のユーザーはこの動きを無実のClaudeユーザーへの陰謀と特徴づけ、一方で透かしを拒否することは不誠実だと主張するユーザーもいた。Business Insiderは、X上の「数十人」のユーザーが抗議としてClaudeの購読をキャンセルすると主張していると報じた。Anthropicは透かし要件がClaudeに限定されていないことも指摘した。「他の主要モデル開発企業も同じ行動規範に署名しており、独自の透かしを実装する予定である」

背景と解説

Anthropicの透かし導入は、AI生成コンテンツを識別するシステムの実装をAI企業に義務付けるEU AI法の透明性コードへの直接的な対応である。金曜日に詳細なガイダンスを公開することで、同社は懸念を先制し技術メカニズムを明確にしようとしている。同時に、テキストの文体パターンを探すような他のAI検出アプローチと透かしを区別して位置付けている。

この発表はClaudeのユーザーベースに分裂をもたらした。一部のユーザーは透かしをプライバシーへの侵害、またはツールの使用方法への不要な制約と見なしている。Business Insiderによると、X上の「数十人」のユーザーが購読キャンセルを脅迫または主張している。一方、他のユーザーはRedditでの議論により、透明性要件は詐欺を防ぐために正当化されると主張している。透かしが読者には知覚できず、出力品質を低下させないというAnthropicのフレーミングは、この機能が実践上は見えないことを強調することで、緊張を緩和するよう設計されているようだ。

よくある質問

Claudeの透かしはどのように機能するのか?
AnthropicはSynthID-Textアプローチを使用する。このアプローチは低リスクの単語選択(例えば「曇り」と「灰色」の選択)に検出不可能なパターンを埋め込む。パターンは読者には見えないが、復号化キーを持つ者なら誰でも検出できる。
編集で透かしを削除できるか?
軽い編集では透かしが完全に削除される可能性は低いが、すべての単語が置き換えられる完全な書き直しで削除される。Anthropicは後者の場合、テキストがまだAI生成と言えるかどうかは議論の余地があると指摘している。
Claudeが生成したコードに透かしは表示されるか?
コードはモデルが等しく有効な選択肢の中から選択する自由度がほぼないため、透かしの存在は最小限である。透かしはコード内のコメントなど恣意的な選択領域でのみ使用でき、実際のコードに与える影響は無視できるほど小さい。
TechCrunch AI元記事を読む

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

LLM脆弱性診断「Sentinel Scan」、AIエージェント運営で249ドル

Ventrovaが「Sentinel Scan」という自動脆弱性診断サービスを提供開始

NEWHacker News1時間前

Widen、macOS向けPostgres GUIを公開 Apple製オンデバイスAI対応

オープンソースのPostgres GUIツール「Widen」がmacOS 14以上向けにリリースされました

NEWHacker News1時間前

Privibe、Mistral Vibe をフォークしたローカル優先コーディングエージェント

Privibe は Mistral Vibe のオープンソースフォークで、CLI コーディングエージェントを完全にローカルマシンで動作させ、llama.cpp サーバーを使用して外部サービスへのデータ送信を排除するように…

NEWHacker News1時間前

オープンウェイト型AIモデルが価格を圧迫も、クラウド大手は収益性維持

Morgan Stanleyのアナリストが、ユーザーが自社インフラにダウンロードして実行できるオープンウェイト型AI モデルが、AI企業のリターンをどう変えるかを評価した

NEWYahoo Finance AI4時間前

AppleがマップAds開始、AI学習契約交渉

AppleはApple Maps内での広告配信プラットフォーム「Ads on Maps」を正式にローンチし、企業が近隣ユーザーの検索に対するプロモーション枠を購入できるようにした

NEWYahoo Finance AI4時間前

女性がGrokで児童写真から作成された露骨な偽画像で提訴

Jane Doe 4と呼ばれる女性が、Elon Muskの企業xAIを相手に訴訟に参加した

NEWTechCrunch AI4時間前
次の記事へAMD、SpaceX株取得で成長投資へシフト

AIニュースの要点を毎朝1分で。

無料で登録