AIToday
大規模言語モデルAIビジネス・産業Amazon AI Blog掲載日時: 2026年7月25日 1:00

OpenAI GPT-5.6モデルがAmazon Bedrockで利用可能に

LINEで送る
OpenAI GPT-5.6モデルがAmazon Bedrockで利用可能に

3つのポイント

  1. 何が起きたか

    OpenAIの3つのGPT-5.6モデル—推論タスク向けのSol、汎用本番向けのTerra、高速推論向けのLuna—がAmazon Bedrockで一般提供開始された。3つのモデルすべてが272Kトークンのコンテキストウィンドウ、テキストと画像入力、レベルなしから最大までの推論エフォートレベルをサポートし、bedrock-mantleエンドポイント上のOpenAI Responses APIを通じてアクセス可能である。

  2. なぜ重要か

    開発者は別のモデルインフラを管理することなく、AWS インフラを通じてフロンティアOpenAIモデルを使用でき、同時にVPC、AWS IAMポリシー、地域データレジデンシー要件の範囲内に留まることができる。価格設定はOpenAIのファーストパーティレートと一致し、使用量は既存のAWSコミットメントにカウントされる。

  3. 注目点

    SolとTerraは米国東部(バージニア北部)と米国東部(オハイオ州)で利用可能。Lunaは米国西部(オレゴン州)でも利用可能である。GPT-5.6はプロンプトキャッシング(デフォルトは暗黙的、細かい制御向けに明示的)をサポートし、繰り返しまたは複数ステップのワークロードのコストを削減する。開発者はAWSの認証情報または環境変数から自動更新される短期キーを使用して認証でき、新しいAmazon Bedrockコンソールはコード作成前にモデルをサイドバイサイドで比較できる機能を提供する。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

OpenAIがAmazon Bedrock上でGPT-5.6ファミリーをリリースしたことは、フロンティアモデルをAWSの管理インフラストラクチャに直接統合し、開発者が別のモデルエンドポイントを運用する必要をなくすものである。3段階のアプローチ—推論が多いタスク向けのSol、バランスの取れた本番作業向けのTerra、高スループット低遅延推論向けのLuna—により、チームは単一のAPIエコシステム内でさまざまなワークロードに対して能力とコストの両方を適切に設定できる。

この統合はAWSのセキュリティモデルを保持している。すべてのリクエストは顧客のIAMポリシー、VPC、CloudTrailログ内で動作し、オプションの地域レジデンシーを備えている。これにより、データガバナンス要件の対象となるエンタープライズワークロードの重要な懸念に対処する。OpenAIのファーストパーティオファリングとの価格パリティは、既存のAWSコミットメントへのクレジットと組み合わせて、採用の一般的な障壁を取り除く。プロンプトキャッシング機能(暗黙的および明示的モード)は、呼び出し間でコンテキストを繰り返す自律型および複数ターンの推論ワークロードの経済学を直接対象としている—開発者が自律型システムをスケーリングするにつれて、このパターンが支配的になる可能性が高い。

よくある質問
3つのGPT-5.6モデルは何であり、何に最適か?
Solは自律型コーディング、セキュリティ研究、科学分析、深い複数ステップの推論に適したフラッグシップ推論モデルである。Terraは汎用本番ワークロードのパフォーマンスとコストのバランスを取る。Lunaは分類、要約、ルーティングなど、高ボリューム、低遅延のワークロードにおける高速で低コストの推論に最適化されている。
各GPT-5.6モデルはどのAWSリージョンでサポートされているか?
SolとTerraは米国東部(バージニア北部)と米国東部(オハイオ州)で利用可能である。Lunaは米国西部(オレゴン州)でも利用可能である。
Amazon Bedrock上のGPT-5.6ではデータセキュリティはどのように機能するか?
すべてのモデル呼び出しはAWS IAMポリシーの下で実行され、VPC内にあり、AWS CloudTrailにログされる。地域内推論はリクエストを指定されたAWSリージョン内に保つことで、データレジデンシー準拠を実現する。分類器がフラグを立てたトラフィックはオフライン濫用検出のため最大30日間保持され、保持されたインプットとアウトプットはオプトインしない限りOpenAIと共有されない。
Amazon Bedrock上のGPT-5.6でコストを削減するにはどうすればよいか?
GPT-5.6は2つのモードでプロンプトキャッシングをサポートしている。暗黙的キャッシング(デフォルトで有効)は、コード変更なしに適格なリクエストを自動的にキャッシュし、明示的キャッシングはキャッシュブレークポイントをマークして、どのプロンプト部分をキャッシュするかを正確に制御できる。どちらの方式も、リクエストボリュームが増えるにつれて、共有コンテキストを繰り返し処理するコストを削減する。
Amazon AI Blog元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • アモデイ氏の提言でソフトと半導体が分裂Yahoo Finance AI · 4時間前
  • AI禁止か活用か 大学で対応分かれるFortune AI · 4時間前
  • パナソニック コネクト、AIで78.8万時間削減AINOW · 4時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

アモデイ氏の提言でソフトと半導体が分裂

Anthropic CEOのDario Amodei氏が週末にエッセイを公開し、「pacing the frontier」を提唱して高度AI能力の改善を鈍化させるよう求めた

NEWYahoo Finance AI4時間前

Amodei氏のAI減速提言で株安

Anthropic CEOのDario Amodei氏が土曜、AIモデル能力の向上ペースを緩めるよう求める3800語の論考を公開

NEWYahoo Finance AI4時間前

アルトマン氏、AIのペース配分を主張

サム・アルトマン氏は先進AIのための全国一律の安全枠組みを呼びかけ、OpenAIは大幅な能力向上をもたらし得る訓練の前に明示的な安全プロトコルを設定していると述べた

NEWTHE DECODER4時間前

AGIBOT共同創業者、具現化AIは3〜5年で「GPT-3.5」到達と予測

AGIBOTのYao Maoqing氏がFortune Leaders Forumで、具現化AIは3〜5年以内に「GPT-3.5」の水準に達すると述べた

NEWFortune AI4時間前

AI禁止か活用か 大学で対応分かれる

ノースカロライナ州立大学1年のアマンダ・カレンは、ほとんどの授業が引用しない限りAIを禁止していると述べ、全面禁止は現実的か疑問視

NEWFortune AI4時間前

AI書籍が著者圧迫か Stony Brook大研究

Stony Brook大学主導の研究で、Amazonの自主出版ジャンル小説14,419冊のうち2,880冊(約20%)が25%超のAI生成散文を含み、1,000冊近くは90%超がAI執筆だった

NEWFortune AI4時間前
次の記事へGoogleがAI計算需要の逼迫を背景に資本支出見通しを$195~205Bに引き上げ