GPT-6 SolのAPI料金:キャッシュと長い入力の計算方法

GPT-6 Solの入力・出力・キャッシュ料金を整理。272K超の入力に適用される条件と、検算できる費用表・計算スクリプトを紹介します。

淡色のカードにクリップボードの黒い線画と幾何学模様、記事の英語タイトルを配置した表紙。

GPT-6 SolのOpenAI直接契約APIでは、Standardの短い入力に対する通常入力が100万トークン当たり2米ドル、出力が10米ドルです。 ただし、キャッシュと入力長、処理モードを無視すると請求額を正しく見積もれません。

モデルページ料金文書を2026年9月23日に確認しました。以下は100万テキストトークン当たりの米ドル建て料金で、Ofoxの料金やサブスクリプション枠ではありません。

入力が272Kを超えたらリクエスト全体で切り替わる

Standard通常入力キャッシュ読み取りキャッシュ書き込み出力
入力272K以下20.202.5010
入力272K超40.40515

長い入力の料金は、超過分だけでなくリクエスト全体に適用されます。モデルの最大コンテキスト容量と、料金が変わる境界は別です。

BatchとFlexは該当するStandard料金の半額、Fastは2倍です。別々のモードを自由に組み合わせて割引を重ねることはできません。対応する地域処理では追加料金も確認し、現在のEUデータレジデンシーはStandardのみという条件も考慮します。実際に使ったモードで計算してください。

キャッシュ書き込みを通常入力にも重ねない

キャッシュ文書に合わせ、通常入力、読み取り、書き込みを重複しない区分にします。同じトークンを通常入力と書き込みの両方で数えないようにします。

費用 = (通常入力 × 入力単価 + 読み取り × 読み取り単価
      + 書き込み × 書き込み単価 + 課金対象出力 × 出力単価) / 1,000,000

利用量データに総入力とキャッシュの内訳がある場合は、各フィールドの定義を確認して分けます。出力には該当する推論トークンも含め、画面に見えた文字だけを数えないでください。

固定したトークン数で検算する

通常入力20,000、読み取り60,000、書き込み20,000、出力5,000のStandardリクエストを仮定します。これは実測ではなく、重複のない数量による計算例です。

区分計算米ドル
通常入力20,000 × 2 / 1M0.040
読み取り60,000 × 0.20 / 1M0.012
書き込み20,000 × 2.50 / 1M0.050
出力5,000 × 10 / 1M0.050
合計各区分の合計0.152

CSVの料金・計算表Python計算スクリプトで検算できます。スクリプトは通信せず、実際の請求やキャッシュ命中率を取得しません。

通常入力300,000、出力5,000でキャッシュを使わない場合は、長い入力の料金で 0.3 × 4 + 0.005 × 15 = 1.275米ドル です。適用される追加料金は別です。最初の272Kだけ安い単価を使う計算は過小見積もりになります。

単価が半額でも作業費用は半額とは限らない

発表では、旧GPT-5.6 Solのプロモーション価格である入力4・出力20米ドルと、新しい2・10米ドルを比較しています。この2項目の単価は50%低下しています。

一方、実際の作業では入力、推論、ツール、再試行が変わります。過去の請求には当時の料金を残し、新料金での再計算は仮定として分けてください。単価の比較だけでは、同じ合格条件を満たす総費用は分かりません。

合格した作業単位で記録する

モデルID、事業者、処理モード、入力長、キャッシュ内訳、出力、ツール費用、合格結果を保存します。失敗した試行も含め、捨てた回答の費用を集計から落とさないようにします。

SolとOpus 5.5の比較では同じ数量での計算を、GPT-6の選び方では評価の始め方を扱います。ゲートウェイを使う場合は、その経路の実際の料金を確認してください。

よくある質問

272Kを超えた分だけ高くなりますか?
いいえ。入力が272Kを超えると、リクエスト全体に該当する長い入力の料金が適用されます。
キャッシュ書き込みには通常入力料金も加算しますか?
同じトークンを重複して数えません。書き込みとして課金される数量は通常入力と分けて扱います。
単価が半額なら作業費用も半額ですか?
トークン数、ツール、再試行、合格率が変わるため、必ず半額になるとは限りません。