
SpaceXAIが新モデル「Grok 4.6」をリリースしました。
同社の特別な訓練手法と強化学習により、科学やプログラミング領域での性能が向上しており、ベンチマークテストではClaude Fable 5に肩を並べる水準に達しています。
標準版は入力トークン2ドル per million、出力トークン6ドル per millionの価格設定です。
何が起きたか
SpaceXAIが大規模言語モデル「Grok 4.6」をリリースしました。同社によれば、このモデルはAnthropicのClaude Fable 5を一部の領域で上回る性能を持つとされています。
なぜ重要か
Grok 4.6は前モデルと比べ、科学やプログラミングタスクに特化した強化学習で性能を高めました。人工知能ベンチマーク「Artificial Analysis Intelligence Index」では61点を獲得し、OpenAIのGPT-5.6 Solと同等、Claude Fable 5より1点上のスコアです。
注目点
標準版の価格は入力トークン当たり2ドル per million、出力トークン当たり6ドル per millionで、より高速な版は2倍の料金で提供されます。Cursor(同社が6月に買収したプログラミングプラットフォーム)およびGrok Buildを通じて利用可能です。
SpaceXAIは本日、新しいフラッグシップ大規模言語モデル「Grok 4.6」をリリースしました。同社はこのモデルがAnthropicのClaude Fable 5を一部の領域で上回る性能を持つと主張しています。
SpaceXAIはかつてxAIとして知られていましたが、先月の社名変更はSpaceX Corpによる買収に伴うものです。Elon Musk氏が設立したこのAIプロバイダーは、6月に合併後の企業としてナスダックで過去最大規模のIPOを通じて上場しました。
Grok 4.6は前モデルのリリースからわずか1ヶ月後にロールアウトされています。同社によれば、主な改善点は前モデルへのより長いトレーニング期間投資です。このトレーニング実行ではGrok 4.6の推論能力を向上させるために設計されたAI生成データセットが使用され、同社はモデルに「高品質なエンジニアリングデータ」へのアクセスも提供しました。初期トレーニング後、2つの追加開発ステップが実施されました。最初のステップでは教師付き微調整(SFT)という訓練方法が使用され、2番目のステップでは強化学習が使用されました。SFTトレーニングでは、サンプルプロンプトと事前に用意された回答のセットを使ってLLMの出力を調整し、エンジニアはこの技術を主にLLMのプロンプト応答がユーザーフレンドリーな形式で出力されるよう確保するために使用します。SpaceXAIは前モデルのGrok 4.5を使ってGrok 4.6のSFTトレーニング段階を最適化し、この最適化ワークフローは科学およびプログラミングタスクに対応する能力の向上に焦点を当てました。
SpaceXAIはArtificial Analysis Intelligence Indexを用いてGrok 4.6を評価しました。このデータセットは科学、コーディング、金融サービスなどの分野にまたがる9つの人気のあるAIベンチマークを組み合わせたものです。Grok 4.6は61点を獲得し、OpenAI GroupのGPT-5.6 Solと同等であり、Claude Fable 5より1点上でした。同社はまた他の9つのベンチマークでモデルを比較しました。Grok 4.5はそのうち3つの領域でClaude Fable 5を上回りました。ベンチマークの一つであるAA-Briefcaseは、人間が数週間かかる知識作業プロジェクトを実行するLLMの能力を評価するもので、他の2つの評価は1ダース以上の業界にまたがるタスクで構成されています。
標準版のGrok 4.6は入力トークン当たり2ドル per million、出力トークン当たり6ドル per millionで価格設定されています。SpaceXAIはさらに高速な版も提供しており、それは2倍の料金となります。LLMはCursor(同社が6月に600億ドルで買収したプログラミングプラットフォーム)および内部開発されたプログラミングツール「Grok Build」を通じて利用可能です。
SpaceXAIは先月xAIからの社名変更を機にSpaceXへの買収を完了し、6月にはナスダックでの過去最大規模のIPOで上場しました。Grok 4.6は前モデルからわずか1ヶ月後のリリースであり、短期間での機能改善を示しています。同社はAI生成データセットと高品質エンジニアリングデータを活用した拡張トレーニングにより、科学・プログラミング領域での性能強化に注力しました。ベンチマークでClaude Fable 5に肩を並べるスコア(61点)を達成したことで、市場内での競争力の向上が示唆されます。
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できます
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
AIニュースの要点を毎朝1分で。
無料で登録