
何が起きたか
2026年9月までにAmazon Bedrock、Azure AI Foundry、Vertex AIは再販価格が分化し、Gemini 3.8 Flashの0.75ドル/3.75ドルからGPT-6 Astraの10.00ドル/50.00ドルに及ぶ。
なぜ重要か
オンデマンドのモデルアクセスを購入する側は、トークンあたりの支払額に大きな差があるため、同じワークロードでもプラットフォームによってコストが大きく異なる。
注目点
低価格なFlashティアは高速で安価な層であり、同等の推論競合ではない。本当の試金石は、Googleが価格を公表したときのGemini 3.1 Proのコストだ。
誰に効くか大量推論をどこで動かすかを選ぶクラウド調達およびFinOpsチームは、トークンあたりの請求額がおよそ桁違いに異なり得る状況に直面しており、プラットフォームの選択が運用コストを直接左右する。
こういう要約が、毎朝あなたのメールに届きます。
3つのプラットフォームは同じ売り文句から出発した——モデルを選び、エンドポイントを呼び出し、トークン単位で支払う——が、カタログ数は今やその数え方がいかに異なるかを示している。Bedrockは18以上のプロバイダーから100以上のモデルを報告し、Azure AI Foundryは毎月およそ50が追加される1万以上を挙げ、Vertex AIのModel Gardenは200を超える。Azureの数字にはフロンティアリリースだけでなく、多くの狭義のオープンウェイト派生モデルやファインチューニング済み派生モデルが含まれる。
ベンチマーク追跡サイトも同様に分裂した状況を伝えている。AnthropicのClaude Opus 5はSWE-bench Verifiedで97.00%と首位に立つが、Bedrock自身のモデルカードは依然としてClaude Opus 4.6をOpusティアの旗艦として掲載している。そのためBedrockの顧客は、導入するモデルIDによってはAnthropicの最高得点リリースより一世代遅れたものを動かしている可能性がある。GPT-6 AstraはTerminal-Bench v4.0のようなエージェント指向の指標で首位に立ち、Gemini 3.8 Flashはリーダーボードの頂点ではなく大量処理向けに作られている。
購入者にとって、判断は抽象的な勝者よりも、どの制約が先に効くかにかかっている。見出しの価格差は、Azureの地域別倍率によって覆り得る。EUの顧客がEU Data ZoneでGPT-6 Astraを動かす場合、現在は世界リスト価格よりおよそ20%高く、さらに年初に適用された9%の値上げが上乗せされる。GPT-6 AstraやGemini 3.1 Proのようなモデルへのローンチ週アクセスのためのキャパシティ確認は、リスト価格と同じくらい重要になりそうだ。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
Dellは前四半期に約610億ドルのAIサーバーを受注し、受注残は950億ドルに達した

Procter & GambleがSiemensと協力し、AIベースの品質検査技術の導入を拡大している

Bank of AmericaのCEO、Brian Moynihan氏は投資家に対し、AIが同行のレイオフ回避に役立ったと述べた

IntelはMLPerf Inference v6.1で、Xeon 6980P構成のままソフトウェア改善のみによりLlama 3.1 8BのServerを2.4倍、Offlineを56%高めた
