AIToday
大規模言語モデルAIビジネス・産業THE DECODER掲載日時: 2026年7月25日 19:014分で読める

Claude Opus 5がFable 5を上回る

LINEで送る
Claude Opus 5がFable 5を上回る

3つのポイント

  1. 何が起きたか

    Anthropicが Claude Opus 5をリリースした。人工知能指数(Artificial Analysis Intelligence Index)で61点を獲得し、Fable 5(60点)を上回った。また、コーディング、科学的推論、知識業務タスクを含むほぼすべてのベンチマークでFable 5と同等かそれ以上の成績を収めた。トークン価格は入力トークン100万個当たり5ドル、出力トークン100万個当たり25ドルのまま据え置かれている。

  2. なぜ重要か

    Opus 5は平均的な人工知能指数タスクではFable 5より低コスト(2.03ドル対2.75ドル)であり、知識業務ではかなり安い(「高」推論層で10.41ドル対Fable 5の22.30ドル)。同時に分析品質も優れている(分析品質Eloが2016対Fable 5の約1700)。このことは、最先端モデルがより費用対効果の高い競争になっており、互いに離れていくのではないことを示唆している。

  3. 注目点

    「高」推論層はOpcus 5のコーディングタスクで最良の価値を提供する。時間制約がため試行回数を制限するため、より高コストの「最大」層を上回っている。「最大」では、Opus 5は知識業務で1タスク当たり36分以上かかり、Opus 4.8より約50パーセント長い。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Claude Opus 5は最先端AIモデル間の収束地点に到達した。人工知能分析およびEpoch AIの両社は、主要なモデル間のパフォーマンス格差が著しく縮小したことを確認している。人工知能分析はOpcus 5を人工知能指数で61点でテストし、Fable 5より1ポイント、GPT-5.6 Solより2ポイント高いに過ぎない。Epoch AIの独立した評価もこの状況を強調している。Opus 5は全体的なEpoch能力指数で159点を獲得し、Fable 5は161点であり、優位性を主張するには小さすぎる差である。記事は明示的に「単一のモデルが離れるか明確な優位性を主張することはできない」と述べており、各モデルのリリースが決定的な改善をもたらす時代が終わろうとしていることを示唆している。

Opcus 5を区別するのは、革新的な能力ではなく、費用対効果と特化である。レポート作成、プレゼンテーション作成、データ分析などのタスクである知識業務では、Opus 5は劇的なコスト優位性を達成している。「高」推論層で1タスク当たり10.41ドル対Fable 5の22.30ドルであり、Eloランキングでもオプス5がFable 5を上回っている。その分析品質は特に強く、「最大」で分析品質Eloが2016に達し、Fable 5より約300ポイント上である。このパターンは、汎用的な優位性ではなく、Opus 5が特定のドメインと価格設定で優れていることを示唆している。推論層に関するデータは興味深い緊張を明らかにする。より高い推論層はより複雑で(エラーが多い)ソリューションを生成し、デフォルトの「高」層は信頼性とコストのバランスを取る。この洞察はAnthropicの独自のAPI設計と一致し、「高」をデフォルトとして設定している。これはより多くの計算がより良い結果をもたらすとは限らないという実践的な認識である。

よくある質問
Claude Opus 5の費用は他のモデルと比べてどのくらいか。
トークン価格は入力トークン100万個当たり5ドル、出力トークン100万個当たり25ドルである。知識業務タスクの「高」推論層では、1タスク当たり10.41ドル対Fable 5の22.30ドル。平均的な人工知能指数タスクでは、1タスク当たり2.03ドル対Fable 5の2.75ドル。
コーディングタスクで最良の価値を得るには、どの推論層を使うべきか。
「高」推論層がコーディングタスクで最良の結果を提供する。Vals.aiは、最高層(「超高」と「最大」)がより複雑なソリューションを生成し、より頻繁にエラーを含むことを発見した。一方、「高」層はより単純なソリューションを生成し、要件をより確実に満たしている。
Opus 5がライバルに比べて劣る点は。
事実の正確性が弱点のままである。AA-Omniscienceではオプス5がFable 5に遅れをとっており、幻覚率は50パーセント。知識業務のプレゼンテーション品質では、プレゼンテーションEloが1628で、「最大」時のGPT-5.6 Solの1666より約40ポイント低い。
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • ChatGPT WorkとGPT-6が5Kルート生成Simon Willison's Weblog · 1時間前
  • RubyGems攻撃、OpenAIのAI関与と研究者The Verge AI · 1時間前
  • Tesla、AI支出上限でGrok 4.5へ誘導かTop Companies AI · 5時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へ民主主義はAIリスク分析の盲点に直面、専門家が警告