
何が起きたか
AnthropicがClaude Sonnet 5.5をリリース。Sonnet 5より出力30%超高速で最大30%安いと主張。Terminal-Bench 4.0では10.3%から70.6%に急伸。
なぜ重要か
日常的なナレッジワークで最上位モデルに近い性能を低コストで実現するとされ、購入者が割高な選択肢より選ぶ可能性がある。主張の裏付けには独立検証が必要だ。
注目点
コスト削減が実際に持続するか、高スループット・低コスト用途向けに発表済みのClaude Haiku 5.5がいつ登場するか。
誰に効くかバグ修正、ドキュメント作成、表計算構築といった日常業務にどのClaudeモデルを導入するか選ぶ企業のAI購入者や開発者は、安価なSonnet 5.5が上位モデルに十分近いと判断し、乗り換える可能性がある。
こういう要約が、毎朝あなたのメールに届きます。
AnthropicのClaude 5.5ファミリーには現在、Fable、Opus、そして新たにリリースされたSonnetの3つの名前付きモデルがあり、Haikuも数週間以内に登場すると告知されている。同社はこれらを、最新の価格競争の火付け役となったOpenAIのGPT-6 Astra、Sol、Lunaに対抗するモデルとして位置づけている。おおまかに言えば、OpusはSolのやや上、SonnetはLunaの上、FableはAstraの上に位置するが、Anthropicは全体的に価格を高く設定している。同格モデル間の性能差は小さく、最終的にはコストが決め手になる可能性がある。
Sonnet 5.5のリリースはこのコスト論に大きく依存している。FrontierCode 1.1の「High」設定で、Anthropicによればタスクあたりのコストが約15分の1でSonnet 5を10ポイント上回る。低・中程度のエフォート設定でも、タスクあたり約10分の1のコストで複数のベンチマークにおいてSonnet 5の最高スコアを既に上回っている。問題は、タスクごとに適切なエフォートレベルを見つけることが依然として科学よりも芸術に近いことで、最高の「Max」設定はFrontierCodeで「Xhigh」よりもスコアが悪い。コードレビュー機能がより頻繁に発動し、作業をサブエージェントに分割するため、タイムアウトや範囲外の変更が時に生じるからだ。
Anthropicはまた、このモデルのサイバーセキュリティ能力のため、Sonnetモデルに初めて安全策を追加し、蒸留攻撃対策の分類器も加えた。これらの措置が機能するかは今後数カ月で明らかになるはずだ。中国のラボがこうした攻撃から利益を得てきたのであれば、この経路を塞ぐことで欧米ラボとの差が再び広がる可能性がある。当面の疑問は、独立検証が速度とコストの主張を裏付けるか、そしてHaiku 5.5がOpenAIとの価格差縮小に間に合うほど早く登場するかだ。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
MomenticがAIエージェントMoを発表した
Qiagenは150人超のMD・PhDレベルの専門家を擁し、25年以上にわたり生物医学データを手作業でキュレーションしてきたとBhattacharya氏は述べた
NEAR ProtocolのNEARは2週間で2倍超

Michael Burry氏はSubstackで、AI設備投資は「この経済を支えている唯一のもの」であり、Trump政権は「失速させる余裕はない」と書き込んだ

日経マネーの対談で個人投資家・桶井道氏が語った

Anthropicは今年初め、Claudeエージェントが生物学の問題を読み推測する分子生物学ラボを開設し、950体のエージェントが21時間後に既知の酵素周辺の反復パターンを検出したと発表した
