Sonnet 5.5のAPI料金:キャッシュとタスク完了までの費用を計算する

Sonnet 5.5の入力・出力・キャッシュ・Batch料金を計算例で解説。トークン単価と、再試行を含めたタスク完了までの費用を区別します。

値札の線画と「Sonnet 5.5 API」のタイトル。

Claude Sonnet 5.5の標準Claude API料金は、入力100万トークン当たり2ドル、出力100万トークン当たり10ドルです。キャッシュ読み取りは100万トークン当たり0.20ドル。2026年9月29日に確認した提供元の公示料金であり、Ofoxの見積もりやClaudeの月額契約料金ではありません。予算を組む際には、アプリケーションが合格基準を満たす成果物を完成させるまでに、何トークン課金されるかを考えます。

Sonnet 5から移行しても単価表は変わりません。Anthropicが多くの用途で費用削減を説明しているのは、モデルの動作や消費トークン数についてです。すべてのリクエストへの一律割引ではありません。公式モデル仕様を確認し、実際に処理する仕事に合わせて見積もりましょう。

Sonnet 5.5の料金表

区分100万トークン当たりの米ドル料金集計するもの
キャッシュを使わない入力$2.00キャッシュ作成・読み取りとして課金されない入力
出力$10.00課金対象の思考を含む出力
5分キャッシュの作成$2.50この保存期間のキャッシュに書き込むトークン
1時間キャッシュの作成$4.00この保存期間のキャッシュに書き込むトークン
キャッシュ読み取り$0.20プロンプトキャッシュから実際に読み取ったトークン

モデルの仕様ページには、Batch APIの入力・出力50%割引と、キャッシュ可能なプロンプトの最小長512トークンも記載されています。ただし、長さを満たすだけではキャッシュは作られません。設定を行い、使用量フィールドを確認してください。キャッシュ分を通常入力にも足して二重計上しないようにします。

ツール料金、データの保存地域に関するオプション、サービス固有の料金は料金ドキュメント全体で別途確認します。提供事業者によって機能、通貨、課金ルールが異なる場合があります。他のエンドポイントにこの計算を当てはめる前に、その事業者の条件を確認してください。

小さなリクエストの例:0.04ドルは月額予算ではない

キャッシュなし入力10,000トークン、課金対象出力2,000トークンの仮想リクエストなら、計算は次のとおりです。

入力:10,000 / 1,000,000 × $2  = $0.02
出力: 2,000 / 1,000,000 × $10 = $0.02
合計:                           $0.04

すべてがこの使用量なら、1,000リクエストで追加料金を除き40ドルです。これは算数の例であり、Sonnetの標準的な応答長を測定した値ではありません。思考が長くなる、ツールの往復が増える、再試行するといった変化で合計も変わります。画面上の回答の単語数に推測した換算係数を掛けても、正確な請求額は求められません。

キャッシュを使うと計算はどう変わるか

10件のリクエストで100,000トークンの共通プレフィックスを使うとします。5分キャッシュを1回作成し、有効期間内に9回実際にヒットし、それ以外の入力・出力はないという前提です。作成0.25ドルと読み取り9 × 0.02ドルで、合計は0.43ドル。10回ともキャッシュを使わない場合の2.00ドルに対し、このプレフィックスだけでは1.57ドル、78.5%の削減です。

アプリケーション全体が78.5%安くなるわけではありません。プレフィックスの変更、キャッシュミス、大量の出力があれば、全体の削減率は小さくなります。リクエストごとに作成量と読み取り量を記録しましょう。キャッシュ向けの構造にしたことは、実際にキャッシュ読み取り料金が適用された証拠にはなりません。

非対話処理で利用条件を満たす場合は、Batchも別に評価できます。入力・出力50%割引を先ほどのキャッシュなし0.04ドルの例に適用すると、同じ前提で0.02ドルです。この例はBatchとキャッシュを組み合わせた計算ではなく、あらゆる組み合わせの課金を説明するものでもありません。

合格したタスク当たりの費用を記録する

バグ修正、文書作成、データ抽出では、次のような記録表を使えます。

タスクID | モデル | Effort | 入力 | キャッシュ作成 | キャッシュ読み取り
出力 | ツール料金 | 試行回数 | 合格したか | 合計USD

失敗と再試行もそのタスクの費用に含めます。テスト合格、必須項目の正確性、成果物のチェックリストなど、合格基準を先に定めてから総費用を合格件数で割ります。月額契約の使用量は別欄に記録してください。CLIのAPI換算推定額が、そのまま月額契約の請求書に載るとは限りません。

Effortを記録する理由もあります。Artificial Analysisの公開時評価では、maxで出力消費が非常に多いことが報告されています。ただし、そのベンチマークから個別の請求額は予測できません。構造化出力の問題があった公開前環境での測定で、再評価の注意書きも重要です。タスク使用量を測る理由にはなりますが、Sonnetは常に高価だと断定する根拠にはなりません。

次に確認すること

単価が分かっていても請求額を説明できない場合は、事業者を切り替える前に、実際の出力トークン数、キャッシュヒット、再試行数を比較します。設定調整はSonnet 5.5のeffortガイド、モデル選択はコーディングでのSonnetとOpusの比較を参照してください。

Ofoxのモデルカタログでは、現在掲載されているモデルや提供事業者の情報を確認できます。本記事は、特定のSonnetエンドポイント、料金、機能がOfoxで利用できると確認したものではありません。送信前に正確なモデルとプロトコルを確認してください。

よくある質問

Sonnet 5からトークン単価は下がりましたか?
いいえ。現在の公式資料では同じ単価です。それでもタスクで使うトークン数が増減すれば、単価が変わらなくても合計費用は変わります。
Claude ProやTeamの契約にはAPIクレジットが含まれますか?
月額契約の利用枠をAPIクレジットとして扱わないでください。クライアントが使う課金経路を確認し、対象プランとClaude APIの料金表を別々に確認します。
maxなら最も安くタスクを終えられますか?
一律の保証はありません。複数のeffortで、再試行や所要時間を含めた合格結果を比較してください。設定を上げても合格率が改善せず、出力だけ大幅に増える場合があります。