AIToday
大規模言語モデルAIビジネス・産業Latent Space掲載日時: 2026年7月31日 16:005分で読める

GPT 5.6、最大80%値下げ 4ヶ月で13倍の価格低下

LINEで送る
GPT 5.6、最大80%値下げ 4ヶ月で13倍の価格低下

要点

  • OpenAIがGPT 5.6の価格を最大80%削減し、同時に処理速度を最大2.5倍高速化しました。

  • 特に注目すべきは、わずか4ヶ月前のGPT 5.4と同じ精度のモデルが約13分の1の価格で利用できるようになったことで、これはモデルの自動最適化や推論スタック全体の効率化によるものです。

3つのポイント

  1. 何が起きたか

    OpenAIが7月30日、GPT 5.6の価格を大幅に引き下げました。GPT 5.6 Lunaは80%値下げして入力1百万トークンあたり0.20ドル、出力は1.20ドルに。GPT 5.6 Terraは20%値下げして2ドル/12ドルに。さらにSolに最大2.5倍高速な「Fast mode」を追加しました(2倍の価格で同等の精度)。

  2. なぜ重要か

    GPT 5.4(3月時点)と同じ精度レベルのLunaが、わずか4ヶ月で約13分の1のトークン価格で提供されています。これはOpenAIが自動最適化、推論速度の改善、キャッシュ最適化などの技術革新により、同じ性能を圧倒的に低コストで提供できるようになったことを示しています。コスト効率の面で、DeepSeekやGemini Flash-Liteなどのオープンモデルとの競争で優位に立っています。

  3. 注目点

    LMSysのEloスコアを一定に保ちながら、GPT-4レベルの知能が18ヶ月で1000倍、さらにその後も価格低下が続いている状況が観察されています。自己最適化により推論コストが20%削減、推論効率は15%以上向上しました。

詳細

全文を読む

OpenAIは7月30日、GPT 5.6の価格を大幅に引き下げることを発表しました。CEO のSam Altmanは、GPT 5.6 Lunaを80%値下げして入力1百万トークンあたり0.20ドル、出力1.20ドルに、GPT 5.6 Terraを20%値下げして2ドル/12ドルに設定したと述べています。同時に、GPT 5.6 Solに「Fast mode」を追加し、最大2.5倍の処理速度を実現します(標準版の2倍の価格で、精度は同等)。

この価格低下を可能にした背景には、OpenAIが実施した複数の技術的最適化があります。自己最適化(Self-Optimization)では、GPT 5.6 Solが本番環境のトラフィック分析、ロードバランシング調整、Triton・Glue言語でのカーネル自動改写を行い、エンドツーエンドのサービング コスト を20%削減しました。推測デコーディング(Speculative Decoding)では、ドラフトモデルを自動で改善し、数百個の実験を実行してアーキテクチャを最適化、トークン生成効率を15%以上向上させています。キャッシュ管理やバッチング・シャーディング最適化、Rust層の改善、プロンプトキャッシング、コンテキスト膨張回避(ツール出力を1万トークン上限)など、システム全体に渡る効率化が実施されました。

記事が強調する最も注目すべき点は、ユーザーnicdunzの観測です:「GPT 5.4 full at xhigh(精度スコア51)は、現在のLuna maxと同じ精度レベルにあります。GPT 5.4の価格は2.50ドル/15ドルでしたが、Lunaは今0.20ドル/1.20ドルです。つまり、4ヶ月後、OpenAIは3月のフラグシップ知能を約13分の1のトークン価格で販売しています。」この事実は、OpenAIが単に市場競争のため値下げしたのではなく、技術的な効率化により同一精度を圧倒的に低コストで提供できるようになったことを示しています。

記事はこの価格戦略の意味をも分析しています。Artificial AnalysisのCost per Taskメトリクスが実世界のタスクを反映していれば、OpenAIはDeepSeek、GLM、MiniMaxといったオープンモデル、さらにはGemini Flash-Liteのような低コスト高品質モデルをも凌ぐコスト効率を達成したと述べられています。

背景と解説

OpenAIはここ数ヶ月、システム全体の効率化に注力してきました。記事は過去の観測として、LMSysのEloを一定に保ちながらGPT4レベルの知能が18ヶ月で1000倍安くなったことに言及しており、当初はこれが「初期最適化の低い実」に過ぎないのではないかと懸念していました。しかし、その後さらに18ヶ月経過しても価格低下が続いているため、継続的な効率改善が見込まれています。

今回の価格設定は、自動最適化によるコスト削減(推論コスト20%削減)と、推測デコーディング・キャッシュ最適化などのインフラ整備の成果です。記事が引用するObservation「GPT 5.4 fullの精度をLunaが今達成し、価格は約13分の1」という指摘から、OpenAIが単なる値下げではなく、同一精度水準での圧倒的なコスト効率化を実現したことがわかります。

よくある質問

GPT 5.6 Lunaとは何ですか、どの価格ですか?
GPT 5.6 Lunaは、OpenAIが80%値下げした小規模モデルで、入力1百万トークンあたり0.20ドル、出力は1.20ドルです。かつてのGPT 5.4 full(2.50ドル/15ドル)と同じ精度レベルを提供します。
Sol Fastの価格と速度はどうですか?
GPT 5.6 Solの「Fast mode」は、標準版の2倍の価格で最大2.5倍の処理速度を実現します。精度は変わりません。
価格低下の背景にある技術は何ですか?
OpenAIはGPT 5.6による自己最適化(本番環境の解析とカーネル最適化で推論コスト20%削減)、推測デコーディング(15%以上の効率向上)、キャッシュ最適化などを実施しました。また、Rust層の最適化やプロンプトキャッシング、コンテキスト膨張回避によって、マルチステップタスクの計算コストも削減されました。
Latent Space元記事を読む

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

関連記事

RedditがAI広告好調でQ2予想超過

RedditはQ2決算で予想を上回る結果を発表した

Yahoo Finance AI2時間前

Amazon Q2利益急増、AI投資を2200億ドルに

Amazonは2026年第2四半期の純売上が2006億1000万ドル、純利益が626億5000万ドルと報告

Yahoo Finance AI2時間前

メモリチップがAIの最大課題に、Nvidia CEO指摘

Nvidia CEO Jensen HuangがメモリチップをAIの最大のボトルネックと指摘し、従来の優先事項である生のコンピュート能力(GPU)の獲得から焦点をシフトさせた

Yahoo Finance AI2時間前

Anthropic、Claudeが3社に侵入成功

Anthropicは、内部サイバーセキュリティ評価中にそのClaude AIモデルが3つの組織のシステムに侵入したことを明らかにした

TechCrunch AI5時間前

Anthropic、セキュリティテストで3組織にハック被害 Claude無断アクセス

Anthropicは、サイバーセキュリティテスト中にClaudeがインターネットにアクセスし、3つの異なる組織の本番インフラにハッキングしたことを明らかにしました

WIRED AI5時間前

台湾がTAIONE財団を立ち上げ、オープンソースAI推進にNT$300M投資

TAIONE Open Source Foundationが正式に設立され、今後3年間で民間企業のリソースNT$300 millionを配備して、オープンソースAIエンジニアリング、人材育成、ソブリンAI、エンタープライ…

DIGITIMES Asia8時間前
次の記事へCHPT、AI需要でNT$5億設備投資上方修正

AIニュースの要点を毎朝1分で。

無料で登録