AIToday
大規模言語モデルAIビジネス・産業THE DECODER掲載日時: 2026年7月9日 4:002分で読める

Claude Fable 5、業界別ベンチマーク全部門制覇 ただし価格は100倍以上

LINEで送る
Claude Fable 5、業界別ベンチマーク全部門制覇 ただし価格は100倍以上

要点

  • Artificial AnalysisがAnthropicのClaude Fable 5の業界別ベンチマークテスト全部門での優位性を報告しました。

  • ただしClaude Fable 5は競争モデルより100倍以上のコストがかかり、同じ精度を求めないなら格安選択肢が存在することも明らかになっています。

3つのポイント

  1. 何が起きたか

    ベンチマーク企業Artificial Analysisが金融・法律・医療など6つの業界別性能指標を公開し、AnthropicのClaude Fable 5がすべての指標で首位を獲得しました。

  2. なぜ重要か

    最高性能には大きな価格差を伴っています。Claude Fable 5は戦略・運用指標で1タスク$3.48かかる一方、DeepSeek V4 Proは$0.03で12ポイント差をつけられており、企業がコスト対効果の選択を迫られる状況が生まれています。

  3. 注目点

    オープンウェイト(無償公開)モデルではGLM-5.2が業界別指標5部門で首位、エンジニアリング分野では53ポイント獲得し、Claude Sonnet 5と2ポイント差です。

この記事についてAIに質問する →

背景と解説

Artificial Analysisが公開した業界別ベンチマークは、LMArena(ユーザーがモデルを盲検比較するプラットフォーム)と一貫した結果を示しており、Claude Fable 5の性能優位性は複数の独立指標で確認されています。ただし本記事が浮き彫りにするのは、性能リーダーと格安選択肢のあいだに大きな経済的トレードオフが存在するということです。

Engineer向けには「最初に高性能モデルで解けるかどうか確認してから、安いモデルで実行する」といった使い分け戦略が示唆されており、企業がフロンティアモデルの高コストを正当化できるほどの性能差が現在のベンチマークでは捉え切れていない可能性も論じられています。

よくある質問

Claude Fable 5の価格はどのくらい高いのですか?
戦略・運用指標では1タスク$3.48かかり、DeepSeek V4 Proの$0.03と比べると100倍以上の価格差があります。
オープンウェイトモデルの中で最も性能が高いのはどれですか?
GLM-5.2がオープンウェイトモデルとしてエンジニアリング指標で53ポイント獲得し、業界別指標5部門で首位を占めています。
このベンチマークはどのような方法で作成されましたか?
米国O*NETの職業分類をもとに、各業界で実際に求められるスキルを定義し、その頻度で重み付けしたベンチマーク組を独立して実施しています。
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • DataAgentが1000万ドル調達、Kubernetes障害を自動修復SiliconANGLE AI · 4時間前
  • SK海力士定制HBM推升推理性能5.15倍DIGITIMES Asia · 4時間前
  • エヌビディア決算、統合回避戦略で退屈な内容にStratechery (Ben Thompson) · 4時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へDiscord、AI審査の不具合で8000人超を誤BAN 既に復旧