
何が起きたか
Anthropicが Claude Opus 5をリリースした。人工知能指数(Artificial Analysis Intelligence Index)で61点を獲得し、Fable 5(60点)を上回った。また、コーディング、科学的推論、知識業務タスクを含むほぼすべてのベンチマークでFable 5と同等かそれ以上の成績を収めた。トークン価格は入力トークン100万個当たり5ドル、出力トークン100万個当たり25ドルのまま据え置かれている。
なぜ重要か
Opus 5は平均的な人工知能指数タスクではFable 5より低コスト(2.03ドル対2.75ドル)であり、知識業務ではかなり安い(「高」推論層で10.41ドル対Fable 5の22.30ドル)。同時に分析品質も優れている(分析品質Eloが2016対Fable 5の約1700)。このことは、最先端モデルがより費用対効果の高い競争になっており、互いに離れていくのではないことを示唆している。
注目点
「高」推論層はOpcus 5のコーディングタスクで最良の価値を提供する。時間制約がため試行回数を制限するため、より高コストの「最大」層を上回っている。「最大」では、Opus 5は知識業務で1タスク当たり36分以上かかり、Opus 4.8より約50パーセント長い。
こういう要約が、毎朝あなたのメールに届きます。
Claude Opus 5は最先端AIモデル間の収束地点に到達した。人工知能分析およびEpoch AIの両社は、主要なモデル間のパフォーマンス格差が著しく縮小したことを確認している。人工知能分析はOpcus 5を人工知能指数で61点でテストし、Fable 5より1ポイント、GPT-5.6 Solより2ポイント高いに過ぎない。Epoch AIの独立した評価もこの状況を強調している。Opus 5は全体的なEpoch能力指数で159点を獲得し、Fable 5は161点であり、優位性を主張するには小さすぎる差である。記事は明示的に「単一のモデルが離れるか明確な優位性を主張することはできない」と述べており、各モデルのリリースが決定的な改善をもたらす時代が終わろうとしていることを示唆している。
Opcus 5を区別するのは、革新的な能力ではなく、費用対効果と特化である。レポート作成、プレゼンテーション作成、データ分析などのタスクである知識業務では、Opus 5は劇的なコスト優位性を達成している。「高」推論層で1タスク当たり10.41ドル対Fable 5の22.30ドルであり、Eloランキングでもオプス5がFable 5を上回っている。その分析品質は特に強く、「最大」で分析品質Eloが2016に達し、Fable 5より約300ポイント上である。このパターンは、汎用的な優位性ではなく、Opus 5が特定のドメインと価格設定で優れていることを示唆している。推論層に関するデータは興味深い緊張を明らかにする。より高い推論層はより複雑で(エラーが多い)ソリューションを生成し、デフォルトの「高」層は信頼性とコストのバランスを取る。この洞察はAnthropicの独自のAPI設計と一致し、「高」をデフォルトとして設定している。これはより多くの計算がより良い結果をもたらすとは限らないという実践的な認識である。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
台湾の通信大手3社は2026年8月も成長を拡大した

Gartnerによると、世界のトークン使用量は2026年から2030年の間に約24倍に急増する見通しで、2028年までにAIコーディング費用は開発者の平均給与に達する

Simon WillisonはChatGPT WorkとGPT-6 Astra(Max)に、自宅発の5Kと10Kの周回ルートをOSMデータで設計するよう依頼

Fortuneの45分インタビューで、OpenAI CEOのSam Altmanは2026年のIPOを否定し、「今は上場するのに賢明とは言えない時期だ」「やるべきことがたくさんある」と述べた

5月、RubyGemsに数百の悪意ある・スパムパッケージがアップロードされ大規模障害が発生

Broadcomの2026会計年度第3四半期のAI半導体売上高は前年同期比221%増の167億ドルで、Hock Tan氏は第4四半期を同236%増の217億ドルと予想した
