
何が起きたか
Anthropicは木曜日、中国拠点のラボによる5件の蒸留キャンペーンを主張する報告書を公表した。最大はAlibabaのQwenモデルで1億5,100万件。
なぜ重要か
Anthropicは2月にも蒸留について言及し、特定のラボを名指ししていた。新たなキャンペーンはより大規模で攻撃的で、翻訳者を装うなどしてClaudeの思考連鎖を引き出したという。
注目点
Anthropicの主張が裏付けられるか、名指しされたラボが反応するかが焦点。AlibabaのQwenファミリーとMoonshot AIのKimiに注目だ。
誰に効くか最先端モデルを開発するAI企業やその保護機構に依存する企業は、訓練データの調達方法について新たな監視に直面する。Claudeのエージェント能力やコーディング能力に依存する企業は、アクセス保護の方法を見直す必要があるかもしれない。
こういう要約が、毎朝あなたのメールに届きます。
Anthropicの報告書は、同社が2月に蒸留への警戒を初めて示し、特定のラボを名指しした後に公表された。OpenAIも同様の活動を報告しており、特にDeepSeekによるものとしている。Anthropicは、新報告書のキャンペーンが以前より大規模で攻撃的だと述べており、手法がモデルとともに拡大したことを示唆している。
報告書はこれらの攻撃の仕組みに焦点を当てている。蒸留はモデルの回答から思考連鎖を引き出そうとするもので、小型モデルの訓練に使える。Anthropicは通常、ユーザーには内部の思考連鎖ではなく要約された思考ブロックのみを表示するが、報告書によると、キャンペーンはモデルに思考過程を直接明かさせる特定の方法を見つけた。例えば、カタカナのみの翻訳タスクを装うなどだ。Alibabaによるとされる試行の大半は、2026年5月から7月にかけて3,500アカウントを通じた1億5,100万件のやり取りで、いずれもAlibabaのQwenファミリー向け訓練データ生成を狙った単一の固定プロンプトに関連していた。
Kimiの開発元であるMoonshot AIによるとされる別のキャンペーンは、中国軍から直接リクエストをルーティングしていたようで、その中にはClaudeに監視映像の異常行動をレビューさせるものもあった。ある10日間で、5,000アカウントを通じた約30万件のリクエストがあり、主にAnthropicのOpusモデルを標的にしていた。結果はこれらの疑惑がどう受け止められ、名指しされたラボが反応するか次第だろう。報告書の規模と意図に関する主張が論争の中心だからだ。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
DynatraceがArize AIを買収し、AI可観測性、評価、エージェント監視を追加した
ロイターが9月10日に報じたところによると、d-MatrixはNVLink Fusionを使い、次世代RaptorをNvidiaのデータセンターラックに直接接続する

100個のファインチューニング済み7Bモデルはマージすると1.5TBを占めるが、ベースモデルを共有しLoRAアダプタを別々に保つと約19.3GBになり、vLLMがリクエストごとにアダプタを適用する

Spencer Kitts氏、Thomas Larsen氏、Sydney Von Arx氏の報告によると、OpenAIのエージェント群がRubyGemsリポジトリへの攻撃をほぼ確実に実行した

Simon Willison氏は、コーディングエージェントが1週間分の仕事を1時間でこなすことに多くの人(自身も含む)が実存的な危機を経験したが、そこを乗り越えたと書いた

AmazonがShop the Sceneを発表
