GPT‑6.1 Sol APIの料金計算:キャッシュと長い入力で何が変わる?
入力・キャッシュ読み書き・出力を分けてSolの料金を計算。長い入力の境界、処理モード、複数リクエストの照合とオフライン計算器を解説。
GPT‑6.1 SolのStandard API料金は、100万トークンあたり入力 2ドル、出力 10ドルです。ただし、Agentの予算はこの2つだけでは決まりません。キャッシュの読み書き、長い入力、処理モード、ツール料金を分けて考える必要があります。この記事では1リクエストの計算から複数ターンの照合まで扱います。
2026年9月30日に公式モデルページとAPI料金表を確認しました。以下は米ドルによる仮定の計計算例であり、実際の請求書や有料推論の測定結果ではありません。Ofoxの販売価格やChatGPTの契約クレジットとも別です。
重複しない4つの区分に分ける
| Standard、入力272,000トークン以下 | 100万トークンあたりUSD |
|---|---|
| 通常の非キャッシュ入力 | 2.00 |
| キャッシュ読み取り | 0.10 |
| キャッシュ書き込み | 2.50 |
| 出力(課金対象の推論トークンを含む) | 10.00 |

実際の英語ドキュメントのスクリーンショットです。公開料金の記録であり、請求書や生成テストではありません。
通常入力をU、読み取りをR、書き込みをW、出力をOとすると、短い入力のStandard料金は次の式です。U・R・Wは重複させません。
USD = (2 × U + 0.10 × R + 2.50 × W + 10 × O) / 1,000,000
APIの入力合計にキャッシュ分が含まれる場合、合計を通常料金で計算してからキャッシュ代を足すと二重計上になります。まず、そのエンドポイントのusage項目を確認して区分してください。内訳がない項目は不明であり、ゼロとは限りません。付属計算器は各区分を明示的に受け取り、提供元ごとのレスポンス形式を推測しません。
推論トークンも同様です。出力合計に含まれているなら、その詳細値を再加算しません。逆に、画面に見えた回答だけ数えると過小評価する場合があります。請求対象の出力合計で計算し、推論の内訳は説明用に使います。
長い入力ではリクエスト全体の単価が変わる
入力が 272,000トークンを超えると、入力・キャッシュ料金は2倍、出力は1.5倍になり、リクエスト全体に適用されます。超過分だけの加算ではありません。この条件では272,000ちょうどは短い側です。
| Standard、長い入力 | 100万トークンあたりUSD |
|---|---|
| 通常入力 | 4.00 |
| キャッシュ読み取り | 0.20 |
| キャッシュ書き込み | 5.00 |
| 出力 | 15.00 |
判定に使うのは新規入力だけでなく全入力です。通常入力20,000と読み取り260,000なら合計280,000なので長い側に入ります。「新しい部分は2万だけ」として短い料金を使ってはいけません。
通常入力300,000、出力10,000では、300000 × 4 / 1M + 10000 × 15 / 1M = 1.35ドルです。短い単価では0.70ドルになりますが、このリクエストには適用できません。Agentの履歴が増えると、最初の短い質問より履歴の方が料金を左右します。
総コンテキスト1,050,000は、その全量を入力できるという意味ではありません。最大入力と最大出力は別に定義されています。回答用の余裕を確保し、ツール定義や結果も入力予算に含め、文字数を正確なトークン数として扱わないでください。
4つの予計算例
税、ツール、保存、地域処理の加算は含みません。
| 例 | U | R | W | O | Standard USD |
|---|---|---|---|---|---|
| 短い非キャッシュ要求 | 20,000 | 0 | 0 | 5,000 | 0.090 |
| 参考資料を再利用 | 10,000 | 100,000 | 0 | 5,000 | 0.080 |
| 最初のキャッシュ書き込み | 10,000 | 0 | 100,000 | 5,000 | 0.320 |
| 長い非キャッシュ要求 | 300,000 | 0 | 0 | 10,000 | 1.350 |
2行目と3行目は別のリクエストです。キャッシュを作る前の書き込みを読み取り料金に置き換えることはできません。1回の書き込みと9回のヒットなら、0.32 + 9 × 0.08 = 1.04ドル。毎回110,000の通常入力と5,000の出力を10回処理すれば2.70ドルです。
ただし9回とも実際にヒットし、区分が請求と一致することが前提です。プレフィックスの変更、有効期限、ルーティング、キャッシュ対象外の要求で結果は変わります。出力量も一定とは限りません。節約保証ではなく負荷の例として読み、書き込み・ヒット・ミスを併記してください。
キャッシュを実際に再利用できるか確認する
現在のキャッシュ仕様ではGPT‑5.6以降に prompt_cache_options.ttl="30m" を使い、最後の書き込みまたは再利用から少なくとも30分保持すると説明しています。対象となるプレフィックス(入力の共通する先頭部分)は、最低1,024個の可視入力トークンが必要です。これは保持期間の条件であり、内容を変更したリクエストや無関係なリクエストが同じキャッシュにヒットする保証ではありません。古い prompt_cache_retention: "24h" を流用しないでください。
暗黙的な境界と明示的な境界を区別します。明示モードで必要なブレークポイントを指定しなければ、キャッシュは書き込まれません。変わらない共通資料を先に、リクエストごとに変わる内容を後に置き、実際のキャッシュ使用量を確認して初回書き込みも予算に含めます。呼び出し間隔が短いことや文章の繰り返しだけでは、ヒットした証拠になりません。
Standard・Fast・Batch・Flex
FastはStandardの2倍、BatchとFlexはそれぞれ半額です。別々の処理モードであり、クーポンのように重ねません。対象モデル、エンドポイント、処理内容の適格性を確認します。Batchを通常の対話要求への自動割引と考えたり、FlexにStandardと同じ遅延保証があると考えたりしないでください。
0.09ドルの例は同じトークン量ならFastで0.18、Batch/Flexで0.045。1.35ドルの長い例は2.70と0.675です。回答が変われば使用量も変わります。
地域処理には適用される場合10%の加算があります。実際に該当オプションを利用する場合だけ計算します。またEUデータレジデンシーではFastを利用できません。表に係数があるだけで、両立しないオプションを組み合わせないでください。
オフライン計算器を使う
Python計算器をダウンロードして実行します。標準ライブラリのみで動作し、通信もAPIキーも不要です。
python3 cost_calculator.py --ordinary 10000 --read 100000 --write 0 --output 5000 --mode standard
期待値は 0.080000 USDです。--mode を fast、batch、flex に変更できます。--regional は予算用の加算であり、利用資格を調べる機能ではありません。負数と --region eu --mode fast は拒否します。
計算はローカルテスト済みですが、有料Sol要求の請求書とは照合していません。モデルの容量上限も検証しないため、計算できた入力がAPIに受理されるとは限りません。料金は日付付きの固定値で自動更新されません。後日使う際は再確認し、計算時の版を保存してください。ツール料金を含まないことは、ツールが無料という意味ではありません。
メッセージではなく要求単位で照合する
1タスクに複数のモデル要求があり、指示、履歴、ツール定義と結果が毎回異なる量で送られます。最初の料金に画面上のメッセージ数を掛けるだけでは不正確です。
task_id, request_id, model, timestamp, mode, region,
input_total, ordinary_input, cache_read, cache_write,
output_total, reasoning_detail, tool_type, tool_quantity,
token_estimate_usd, tool_charge_usd, billing_adjustment_usd
各行で入力区分の合計と総量を確認し、長い入力の判定を個別に行います。出力合計と推論詳細を分け、実際のツール使用分を加算してからタスク単位に集計します。要求IDがあれば、非公開のプロンプトを保存せずに差額を調査しやすくなります。
成功要求だけでなく、課金使用量のある失敗と再試行も含めます。すべてのHTTP失敗が有料とは限りませんが、有用な回答がなかったからゼロとも言えません。usageと請求根拠を確認してください。合格タスクあたりの費用を求めるには、最終検証結果も必要です。
請求と合わないときの順序
まずドルとクレジット、百万と千、APIと契約、単発とタスク全体を区別します。次にキャッシュ分類と二重計上、入力長、モード、地域、推論出力、最後にツールや再試行、提供元の調整を調べます。
ゲートウェイ独自の価格や表示項目もあり得ます。OpenAI料金からOfox割引を推測せず、正確なモデルと現行カタログを別途確認してください。SolとAstraの選択、英語のアップグレードガイド、ツール移行も合わせて判断すると、入力単価だけでは見えない条件を整理できます。


