
OpenAIが旗艦モデルGPT-5.6 Solの超高速モードプレビューを開始。今年初めに署名した10十億ドルのパートナーシップに基づくCerebrасインフラストラクチャにより、最大750出力トークン/秒を実現。
サービスはOpenAI APIを通じて選定顧客初期利用可能で、段階的拡大を予定。停止中のログ分析、リアルタイム金融取引評価、顧客問い合わせの即座解決など、リアルタイムユースケースを実現。
既存Fast Modeを上回るプレミアムティアとして位置付け。
何が起きたか
OpenAIが超高速モードのプレビューを公開。今年初めに署名した10十億ドルのパートナーシップに基づくCerebrасインフラストラクチャにより実現。GPT-5.6 Solから最大750出力トークン/秒を配信し、初期段階ではOpenAI APIを通じて選定顧客のみが利用可能で、容量が増加するにつれて段階的に拡大される予定。
なぜ重要か
OpenAIが説明する速度向上は、小規模モデルの速さと大規模モデルの完全な機能を組み合わせたもの。リアルタイム分析が必要なユースケースを可能にする。OpenAIは、インシデント対応(停止中のログとコード分析)、金融(ライブ市場シグナル評価)、カスタマーサポート(複雑な問い合わせの即座解決)、研究(夜間バッチジョブをインタラクティブセッションに変換)を挙げている。同社は既に社内でインシデント対応にこのモデルを使用している。
注目点
超高速モードはOpenAIの速度ベースの価格設定階層の3番目のティア。Fast Mode(標準価格のおよそ2倍で最大2.5倍速)に続く。早期アクセスに関心のある企業は、OpenAIのサイトのフォームを通じてサインアップできる。
OpenAIの超高速モードは、同社のAI出力の収益化方法における戦略的転換を示している。トークン数またはモデル能力だけに基づいて課金するのではなく、OpenAIは速度そのものをティア化サービスとして販売している。これはクラウドインフラストラクチャでは確立されたモデル(AWSはより高いパフォーマンスに対してプレミアム料金を設定)だが、AI推論市場では革新的。今年初めに発表された10十億ドルのCerebrасパートナーシップは、明確な製品価値を実現:750トークン/秒の提供が可能で、速度を直接の収益梃子として位置付けている。ティア化アプローチ(標準、2.5倍速でおよそ2倍の価格のFast Mode、そして暗示的なプレミアムの超高速モード)は、速度が多くのユースケース、特にリアルタイム決定が重要な取引、インシデント対応、顧客向けインタラクションにおいて制約因子になると想定している。停止中のインシデント対応にこのモデルを使用するOpenAIの社内利用は、同社がこれを商用提案だけでなく、高リスクワークフローのための建築学的に健全なものとして見ていることを示唆している。
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できます
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
AIニュースの要点を毎朝1分で。
無料で登録