Opus 5.5は40%安い?単価と作業コストを分けて確認
Claude Opus 5.5の入力・出力・キャッシュ料金を比較。公式の40%という説明と固定トークン数での計算が異なる理由を解説します。
Claude Opus 5.5のAnthropic直接契約APIは、通常入力100万トークン当たり4米ドル、出力20米ドルです。Opus 5の対応単価より20%低くなっています。 発表の40%は、トークン使用量の変化も含む典型的な作業コストについての開発元推計です。
Anthropicの発表と料金文書を2026年9月23日に確認しました。以下は100万トークン当たりの米ドルで、追加料金は別途、Ofoxの料金ではありません。
下がる割合は料金区分で異なる
| 区分 | Opus 5 | Opus 5.5 | 単価低下 |
|---|---|---|---|
| 通常入力 | 5 | 4 | 20% |
| 出力 | 25 | 20 | 20% |
| 読み取り | 0.50 | 0.20 | 60% |
| 5分キャッシュ書き込み | 6.25 | 5 | 20% |
| 1時間キャッシュ書き込み | 10 | 8 | 20% |
読み取り中心の処理と、新規入力や出力中心の処理では、同じ使用量でも値下げ幅が変わります。モデルが使うトークン自体が減ればさらに下がる可能性がありますが、開発元の作業構成を自分の用途で再現できるとは限りません。
「典型的な作業で約40%」という説明にはAnthropicによる推計という帰属を残してください。すべての請求、契約プラン、ゲートウェイが40%安くなるとは言えません。
同じ数量で計算するとどうなるか
通常入力20,000、読み取り60,000、5分キャッシュ書き込み20,000、出力5,000を両モデルで使うと仮定します。区分は重複させません。
| 内訳 | Opus 5 | Opus 5.5 |
|---|---|---|
| 通常入力 | 0.100米ドル | 0.080米ドル |
| 読み取り | 0.030米ドル | 0.012米ドル |
| 書き込み | 0.125米ドル | 0.100米ドル |
| 出力 | 0.125米ドル | 0.100米ドル |
| 合計 | 0.380米ドル | 0.292米ドル |
この固定数量では約23.2%低下します。出力や入力の削減を仮定していないため、40%という典型的な作業の推計と矛盾しません。これは算術例であり、モデルの性能試験ではありません。
料金表CSVと計算スクリプトで再計算できます。実際の判断では、画面に見える文字数ではなく課金対象の利用量を使います。
キャッシュの保持時間も確認する
5分と1時間では書き込み単価が違います。後で何回再利用するかを考え、初回書き込みも予算に含めます。一度しか使わない前置きから、繰り返し読み取りの節約は得られません。
総入力と内訳を扱う場合はフィールド定義を確認し、通常入力と書き込みで同じ数量を二重計上しないでください。OpenAIの30分保持や長い入力の境界をAnthropicへそのまま適用することもできません。
FastとBatchは別の選択肢
Opus 5.5のFastは入力8・出力40米ドル、Batchは入力2・出力10米ドルです。FastとBatchを組み合わせることはできません。Fastで生成が速くなっても、ツール実行や人の確認を含む作業全体が同じ倍率で短くなるとは限りません。
対話では待ち時間を減らす価値を、オフライン処理では非同期完了が期限に合うかを考えます。キャッシュ、地域、利用可能なモードも確認し、入力と出力だけですべての費用を推定しないようにします。
サブスクリプション枠はAPI単価と別
発表には5時間枠の拡大と保存できる利用上限リセットもありますが、無制限利用や一定のメッセージ数を保証するものではありません。
Claude Codeでの選択と上限で操作の意味を確認し、別モデルとの料金比較にはSolとOpus 5.5を参照してください。外部サービスを購入する際は、そのサービスの実際の料金を確認します。
よくある質問
- すべてのリクエストが40%安くなりますか?
- いいえ。40%は開発元による典型的な作業コストの推計です。通常入力・出力は20%、読み取りは60%の単価低下です。
- FastとBatchを併用できますか?
- できません。異なる処理の選択肢であり、料金を重ねて割り引くことはできません。
- 例ではなぜ約23.2%なのですか?
- すべてのトークン数を固定して単価だけを比較しているためです。典型的な作業の推計には使用量の変化も含まれます。


