AIToday
大規模言語モデルOpenAI Blog掲載日時: 2026年9月23日 6:00

OpenAIのGPT‑6、プロンプトキャッシュ高ヒット

LINEで送る
OpenAIのGPT‑6、プロンプトキャッシュ高ヒット

3つのポイント

  1. 何が起きたか

    GPT‑6でOpenAIはプロンプトキャッシュを導入し、デフォルトで高いキャッシュヒット率と、30分以内に再利用された対象共有プレフィックスの割引を実現した。

  2. なぜ重要か

    デフォルトのヒット率向上と再利用プレフィックスの割引は、同じ指示・ツール・コンテキストを繰り返し引き継ぐアプリの応答時間とコストを下げられる。

  3. 注目点

    効果はツール定義や指示をどれだけ安定させるかにかかり、変更はキャッシュミスを招く。新しい診断機能とダッシュボードがミスの発見と修正を助ける。

誰に効くか共有コンテキストで繰り返し呼び出しを行うAIエージェントやAPI駆動アプリを構築する開発者やチームは、プロンプトを安定させれば低遅延と低コストを得られる可能性がある。ツールや指示の変更が頻繁なチームは恩恵が少なくなるかもしれない。

わからないところ、AIに聞けます

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

GPT‑6は、コードベースのリファクタリングから調査の行き届いた文書作成まで、複雑なタスクに何時間も取り組む永続エージェントを支えるよう設計されている。こうしたエージェントは互いに積み重なる一連のAPIリクエストを行い、しばしば同じ指示・ツール定義・コンテキストを引き継ぐ。OpenAIはその共有コンテキストをキャッシュし、リクエスト間で計算を再利用することで応答時間を短縮し、キャッシュされた入力トークンの割引を開発者に提供する。

新しいプロンプトキャッシュシステムはそのエンジンを基盤に、デフォルトでより高いヒット率を実現し、ミスの可視化と修正を助けるツールを追加する。ダッシュボードはアプリの入力のうちどれだけがキャッシュから提供されたかを示し、診断ツールはリクエストを直近の応答と比較して何が変わったかを特定する。開発者は明示的なキャッシュブレークポイントの選択、キャッシュを壊さない推論強度の調整、ツール定義の安定維持、キャッシュの事前ウォームもできる。

これらの制御の価値は、開発者がプロンプトとツールの安定性をどれだけうまく管理するかにかかっている。設定を一貫して保つチームはデフォルトの性能向上をより多く享受できる一方、変更が多いチームは再利用がどこで失われているかを理解するために新しい診断機能を必要とするかもしれない。

よくある質問
キャッシュされたプレフィックスはどのくらいの間、割引の対象になりますか?
OpenAIは現在、30分以内に再利用された対象共有プレフィックスにキャッシュ割引を提供している。
OpenAIがキャッシュ用に提供する新しいツールは何ですか?
Prompt Caching Dashboardは入力のうちどれだけがキャッシュから提供されたかを表示する。診断ツールはリクエストがキャッシュミスした理由の特定を助ける。
キャッシュを壊さずに推論の強度を変更できますか?
GPT‑6モデルでは、リクエスト単位の推論強度を変えずにconfiguration_updateを追加することで、応答間で推論強度を変更してもキャッシュを壊さない。
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • MetaのAIエージェント、NYT記者が絶賛Top Companies AI · 4時間前
  • サイバー企業がAI攻撃対策サービス開始Top Companies AI · 4時間前
  • Rabbit OS3エージェント、R1不要でPC対応The Verge AI · 4時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へArm、エージェントAIでCPUコア4倍増へ