AIToday
大規模言語モデルAIビジネス・産業THE DECODER掲載日時: 2026年5月29日 7:001分で読める

Anthropicが「控えめだが実質的な改善」と述べるClaude Opus 4.8をリリース。ほとんどのベンチマークでGPT-5.5とGemini 3.1 Proを上回る

LINEで送る
Anthropicが「控えめだが実質的な改善」と述べるClaude Opus 4.8をリリース。ほとんどのベンチマークでGPT-5.5とGemini 3.1 Proを上回る

3つのポイント

  1. Claude Opus 4.8はアジェント型コーディング(SWE-Bench Pro)で69.2%を達成し、前世代のOpus 4.7の64.3%およびGPT-5.5の58.6%を上回った。また多分野推論(Humanity's Last Exam)ではツールなしで49.8%、ツール使用時で57.9%のスコアを記録

  2. 新機能「dynamic workflows」により、モデルは単一セッション内で数百の並列サブエージェントを起動できるようになり、数十万行のコードベース全体のマイグレーションに対応可能に。同時に「effort control」で応答の計算量を調整でき、「high」「extra」「max」の3段階から選択できる

  3. Fast Modeの価格が従来の3分の1に低下し、input tokensで$10 per million、output tokensで$50 per millionに。標準価格(input $5 per million、output $25 per million)は変わらず。GDPval-AAベンチマークではOpus 4.8がOpus 4.7比で15%少ないパスで済み、出力トークンは35%削減

この記事についてAIに質問する →

LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • フロンティアAI主導権、全てTHE DECODER · 1時間前
  • ジョン・ディア、農家向けAIチャットボット投入The Verge AI · 1時間前
  • Google Pics、AI編集でWorkspaceにThe Verge AI · 1時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へAnthropicが$65 billionを調達し、$965 billionの評価額でSeries Hラウンドを完了、OpenAIを上回る