AIToday
大規模言語モデルAI安全性・アラインメントAI規制・政策THE DECODER掲載日時: 2026年8月15日 10:006分で読める

Anthropic、Claude検出APIを公開

LINEで送る
Anthropic、Claude検出APIを公開

要点

  • Anthropicは、Google DeepMindのSynthID Textの変種を使用してClaude生成テキストを識別する透かし検出APIを展開している。この透かしは単語選択時のランダム性を変更してコンテンツの品質と可読性を保ちながら追跡可能なパターンを作成する。

  • AnthropicはEU AI法への準拠のためこの機能を実装しており、地域による制限の技術的手段がないため、透かしは世界中で提供される。

  • 2025年8月2日以降にリリースされたすべてのClaudeモデルはデフォルトで対応し、既存モデルは今後数ヶ月で対応予定である。

3つのポイント

  1. 何が起きたか

    Anthropicが、Claude生成テキストを識別するための透かし検出APIを第三者開発者に提供する。この透かしは2024年にNatureに掲載されたGoogle DeepMindのSynthID Textの変種を使用し、単語選択時のランダム性を微調整して追跡可能なパターンを生成し、コンテンツの品質や可読性には影響を与えない。

  2. なぜ重要か

    AnthropicはEU AI法への準拠のため透かし化を実装している。同社は2026年7月にEUのAI生成コンテンツ透明性実践規範に署名した。PangramなどのAIパターン認識に依存する外部検出ツールと異なり、この透かし方式はAnthropicのみが保有する鍵に基づいており、実践上、より信頼性の高い検出を可能にする可能性がある。

  3. 注目点

    2025年8月2日以降にリリースされたすべてのClaudeモデルが透かしに対応し、既存モデルは今後数ヶ月で対応する予定。透かしは短いテキスト、事実が密集した箇所、コード、大幅に改稿されたテキストではあまり機能せず、Claudeがテキスト全体を執筆したのか、単に編集したのかを区別できない。

詳細

全文を読む

Anthropicは、第三者開発者が彼らのアプリケーションに直接AI テキスト検出機能を埋め込むことを可能にする透かし検出APIのリリースを準備している。このテクノロジーは、Google DeepMindが2024年にNatureで公開したSynthID Textの変種に依存している。透かし処理は、テキスト生成時に単語を選択する際にClaudeが使用するランダン性ソースを修正することで機能し、独特で追跡可能なパターンを生成する。Anthropicは、この修正がコンテンツ、創造性レベル、可読性を変更しないことを強調している。

透かしには注目すべき制限がある。短いテキストと、代替表現がほとんど存在する事実密集したテキストでは一貫性がない。コードも同様の劣化を示す。人間による純粋な修正を受けたテキスト(人間がすべての単語を選択した場合)は透かしを持たない。翻訳は例外であり、Claudeはそのプロセス中にすべての単語を選択するため。大幅な改稿は透かしを完全に除去できる。さらに、透かしはClaudeが可能性が高いテキスト作成に関与していたことのみを示すことができ、Claudeがテキスト全体を著作したのか、単に重い編集作業を提供したのか、またはテキストが人間またはあの異なるAIモデルから発信されたのかを指定することはできない。

ロールアウトは規制準拠により推進されている。約190の他の署名者とともにAnthropicは、2026年7月にEUのAI生成コンテンツ透明性実践規範に署名した。この約束を果たすため、同社は透かしを全世界で実装している。現在、機能を地域によって制限する技術インフラストラクチャが存在しないため、透かしは世界中で導入される。Anthropicは追加のオプションを検討しており、利用可能になった段階で更新を共有する予定である。

展開のタイムラインは段階的である。2025年8月2日以降にリリースされたすべてのClaudeモデルは、デフォルトで透かしサポートを含める。既存のClaudeモデルは今後数ヶ月でこの機能を受け取る。ドキュメントとファイルについて、Anthropicはオープンなc2PA標準を採用しており、基礎となるファイルを修正することなく識別メタデータを付加する。透かしアプローチは、Pangramなどの第三者検出サービスから根本的に異なっている。外部ツールはAnthropicの暗号化鍵へのアクセス権を持たず、代わりにAI生成テキストの典型的な統計パターン(再発するフレーズ、多用される単語、その他のスタイル的マーカー)をスキャンする。Anthropicの独自の鍵に依存する直接的な透かし検証は、実践上、より大きな信頼性を提供することが期待される。

背景と解説

Anthropicの透かし実装決定は、技術的な取り組みというより欧州連合からの規制圧力を反映している。2026年7月にAI生成コンテンツ透明性EUコード・オブ・プラクティスに約190の他の署名者とともに署名することで、同社はAI生成コンテンツを識別可能にすることを約束した。地域ごとに機能を制限する技術的メカニズムが存在しないため、Anthropicは透かしを全世界で展開している。このロールアウト制約は位置情報や規制管轄権にかかわらずすべてのユーザーに影響を与える。

透かし方式そのものは公開研究の上に構築されている。2024年にNatureに詳述されたGoogle DeepMindのSynthID Textアプローチは、単語選択時のランダム性ソースを調整することにより機能し、Anthropicの検証鍵へのアクセス権を持つ者が検出可能なパターンを作成する。これはPangramのような外部検出サービスからの実質的な乖離を表しており、そのようなサービスはAnthropicの内部メカニズムへのアクセスを持たず、代わりに典型的なAIテキスト機能のパターン認識に依存している。透かしが専有鍵に依存していることは潜在的に検出信頼性を強化するが、Anthropicのインフラストラクチャと情報共有の意思に対する依存関係を導入する。

この機能の制限事項は重大である。透かしは短いテキスト、言い換えが限定される事実密集箇所、コード、大幅に編集されたテキストで劣化する。これらはまさにAIによる人間の作業の補完が一般的なコンテキストである。Anthropicは、透かしがClaudeによる完全な著作権と重い編集上の介入を区別できず、競合モデルからの出力を特定できないことを認めている。これらの制約は、透かしが包括的なコンテンツ出所ソリューションというより準拠ツールであることを示唆している。

よくある質問

透かしはClaudeのテキスト品質に影響するか?
いいえ。Anthropicによると、透かしはClaudeのテキストのコンテンツ、創造性、可読性に何ら影響を与えない。
透かし機能はいつ利用可能になるか?
2025年8月2日以降にリリースされたすべてのClaudeモデルは、デフォルトで透かしに対応する。既存のClaudeモデルは今後数ヶ月で機能を受け取る予定である。
透かしの制限事項は何か?
透かしは短いテキスト、事実が多い箇所、コードではあまり機能しない。Claudeがテキスト全体を執筆したのか、単に大幅に編集したのかを区別できず、別のAIモデルからのテキストか人間からのテキストかを判別できない。大幅な改稿により透かしが削除される可能性がある。

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

AIニュースの要点を毎朝1分で。

無料で登録