AIToday

中国のAI検閲は蒸留で除去可能、研究が判明

Semafor Tech3時間前LINEで送る
中国のAI検閲は蒸留で除去可能、研究が判明

要点

研究者らは、DeepSeekのような中国のオープンソースAIモデルに組み込まれた検閲は、蒸留と呼ばれるテクニックを通じて、より小さなカスタマイズ版を学習させるためにモデルが使用される場合に除去できることを発見した。この発見は、中国のAIモデルが必然的に北京の政治的見方をアメリカのユーザーに広めるという米国政府の懸念に異議を唱えており、アメリカ企業がゼロから構築する代わりに、これらのより安価なモデルを採用する強力な根拠となる可能性がある。

こういう要約が、毎朝あなたのメールに届きます。

無料で登録 →

3つのポイント

  • 何が起きたか

    サンフランシスコのAIラボCTGTの研究者らが、中国のオープンソースモデルDeepSeek V4 Flashの出力を学習データとして使用し、蒸留と呼ばれるプロセスを通じてより小さなAIモデルを構築した。ウイグル人収容所など機密性の高いトピックについて質問されると、元のDeepSeekモデルは回答を拒否するか中国に有利な回答をしたが、蒸留されたモデルは証拠に基づいた回答を提供した。

  • なぜ重要か

    この知見は、中国のオープンソースAIモデルが中国の政治検閲をアメリカのユーザーに到達させる経路であるという米国政府の最大の懸念を弱めるものである。この研究は、中国のソースから構築されたモデルに検閲が自動的に転送されるわけではないことを示唆しており、米国企業がゼロから構築する代わりに、より安価で高速な中国のオープンソースモデルを使用するか、それらからカスタマイズ版を作成する正当性を強める可能性がある。

  • 注目点

    トランプ政権は中国のオープンソースモデルをどう扱うかについて積極的に議論しており、米国政府当局者はCTGTの知見に関心を示している。一部の当局者は、中国のモデルの大規模使用がアメリカ社会を北京の世界観へ向けて形成することを懸念しているが、中国のモデルに隠れたセキュリティバックドアが存在することへの懸念は、確固たる証拠で確立されたことはない。

詳細

サンフランシスコに本拠を置くAIラボCTGTは、高リスク用途向けのAIモデルの内部動作の調査を専門としており、DeepSeekのオープンソースモデルの出力と、その出力から学習した小さいモデルを比較する研究を実施した。研究者が政治的に機密性の高い質問(中国のウイグル人収容所に関する質問など)を提示すると、DeepSeekのモデルは回答を拒否するか、中国政府を支持するために問題をかき消すような回答を提供した。対照的に、CTGTがDeepSeek V4 Flashの出力を学習データとして蒸留することで作成したモデルに同じ質問を提示した場合、中国の国家がウイグル人を「抑留施設」に収容しているという証拠を提供した。蒸留プロセスは、より大きな「教師」モデルを使用して、より小さな「生徒」モデルのための学習データを生成することを伴う。CTGTの理論は、蒸留されたモデルが潜在意識的に検閲を継承するというものであったが、研究はそうでないことを示した。他の機密性の高いトピックについても同様のパターンが見られた。CTGTの創業者兼CEOのCyril Gorlaは、多くの企業がこの領域を探索しているが、「人々が不吉だと考える特性が実際に転送されるかどうかについての大量の誤報と不確実性に直面している」と述べた。この知見は、トランプ政権が中国のオープンソースモデルがもたらすリスクをどのように管理するかについて積極的に議論している時期に到着している。当局者は複数の懸念を表明している。DeepSeekのようなモデルが天安門事件などの出来事に関する質問に答えることを拒否する可能性があり、より広くは米国での中国のモデルの広範な採用がアメリカ社会を徐々に北京の世界観へ向けて転換する可能性がある。China Media ProjectはDeepSeekを「我々が皆想像していたよりもはるかに洗練されたプロパガンダツール」と特徴付けた。一部の当局者は、無防備なユーザーから情報を抽出するために使用できる隠れたセキュリティバックドアについての懸念も提起しているが、そのようなバックドアについての確固たる証拠は確立されていない。Gorlaは、彼のチームが米国の当局者と接触しており、この知見に関心を示していると報告している。Gibson Dunnのパートナーであり、Appleの元最高プライバシー責任者であるJane Horvathは、問題を異なる方法で枠組みした:「中国のモデルを蒸留してアメリカのモデルに戻すことができるときに、中国のモデルを禁止することは絶対に意味がない。これらは原料である。ソフトウェアだ。」この研究は、中国のオープンソースモデルが中国の政治検閲の必然的なベクトルであるという懸念を弱め、米国企業がより安価で高速な中国のモデルを採用するか、それらからカスタマイズ版を作成するための経路を潜在的に開く。

背景と解説

この研究は、トランプ政権内での中国のオープンソースAIモデルをどのように規制するかについての活発な議論の中で浮上している。米国当局者は長い間、これらのモデルが政治検閲を組み込んでおり、プロパガンダツールとして機能する可能性があることを懸念してきた。China Media ProjectはDeepSeekを「我々が皆想像していたよりもはるかに洗練されたプロパガンダツール」と呼んだが、CTGTの知見はこの懸念が誇張されている可能性があることを示唆している。同研究所の研究は、より大きな中国のモデルが蒸留を通じてより小さなカスタムモデルを学習させるために使用される場合、検閲の特性が必ずしも転送されないことを示している。この区別が重要なのは、モデルが検閲を「含む」かどうかの問題と、その検閲が別の当事者によってモデルを転用される際に「存続」するかどうかの問題を区別するからである。この研究は、中国のモデルが隠れたセキュリティバックドアを含むという二次的な懸念にも対処しており、この記事ではこの懸念は確固たる証拠によって支持されたことはないと指摘している。米国企業にとって、その含意は実用的である。より安価な中国のモデルから蒸留することは、ゼロから構築するよりも高速でコスト効率的な道である可能性がある。

よくある質問

蒸留とは何か、またモデルの応答をどのように変えるのか
蒸留は、より大きなモデル(「教師」と呼ばれる)がより小さな「生徒」モデルの学習に使用されるデータを生成するプロセスである。CTGTの研究は、DeepSeek V4 Flashを蒸留する場合、結果として得られた小さいモデルが元のモデルの検閲をもはや継承しないことを示した。例えば、ウイグル人収容所について回答を拒否または話題をかき消す代わりに、証拠に基づいた回答を提供した。
中国のオープンソースAIモデルについての元の懸念は何か
米国政府当局者は、中国のオープンソースモデルが中国の政治的思想と検閲をアメリカのユーザーの見方に浸透させる経路であり、大規模採用がアメリカ社会を北京の世界観と一致させるように形成する可能性があると懸念していた。

「オープンソースAI」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

ディスカッション

まだコメントがありません。最初のコメントを投稿しましょう!

ログインして議論に参加

関連記事

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

無料で始める

登録無料・30秒で完了・いつでも解除できます