ToolNavs 便利なAIツールを発見
ツール投稿 ログイン
戻るAI情報
OpenAI、GPT-6向けプロンプトキャッシュを強化:キャッシュ入力トークンが最大90%割引

OpenAI、GPT-6向けプロンプトキャッシュを強化:キャッシュ入力トークンが最大90%割引

AI情報 Admin 3 回閲覧

2026年9月22日、OpenAIは公式ブログの記事「Better prompt caching for GPT-6」で、GPT-6ファミリー向けに改良されたプロンプトキャッシュシステムと、キャッシュ性能の監視・診断を支援する新しいツールを発表した。

まず、実際に何が変わったのか。GPT-6シリーズではデフォルトでキャッシュヒット率が向上し、30分以内のウィンドウで再利用された対象の共有プレフィックスに対して、キャッシュされた入力トークンが最大90%割引になる。OpenAIはあわせて「Prompt Caching Dashboard」を公開。ヒット率の推移を追跡し、入力構成チャートでキャッシュ済みトークンと未キャッシュトークンを比較できるため、ヒット率低下の原因特定に役立つ。想定外のキャッシュミスが発生した場合は、新しい診断ツールが当該リクエストと直近の成功レスポンスを比較し、モデル・ツール・設定・入力のどれが再利用を阻んだのかを特定し、影響を受けたトークン数の見積もりも示す。

エージェント開発者にうれしい2つの変更点

1つ目は、キャッシュプレフィックスのブレークポイントを明示的に設定できるようになったこと。プロンプトのどの部分をキャッシュし、キャッシュ区間をどこからどこまでにするかを開発者自身が決められる。2つ目は、推論の強さ(reasoning effort)の変更や利用ツールの増減が、以前のキャッシュ済みコンテキストを自動的に無効化しなくなったことだ。OpenAIの説明によれば、GPT-6は長時間稼働するエージェントを想定して設計されている。コードベースのリファクタリングから調査資料の作成まで、こうしたアプリケーションは同じ指示・ツール定義・コンテキストを運びながらAPIリクエストを連続発行する。キャッシュとは要するに、繰り返し送られる内容の料金を一度きりにする仕組みである。

計算が最もお得になるのは誰か

OpenAIはGitHubのデータを引用している。ここ数か月でキャッシュ改善により、数十億リクエストのうち再処理が必要なプロンプトトークンの割合が50%以上減少し、Copilotの応答も高速化したという。マルチターンの会話、ドキュメント処理パイプライン、エージェントシステムを運用するチームにとって、入力トークンはもともとコストの大半を占める。キャッシュ読み取りの90%割引は請求額に直結する。ただし境界線も押さえておきたい。割引対象は30分ウィンドウ内の対象共有プレフィックスに限られ、出力トークンは対象外だ。短いプロンプトの一問一答型アプリでは、キャッシュの恩恵は限られる。本当に節約したいなら、ダッシュボードと診断ツールでプロンプト構造を最適化する必要がある。有効化しただけで万事解決、とはいかない。

おすすめツール

もっと見る