Gemini 3.8 Flash vs DeepSeek V4 Flash:59 対 52、費用は 2.6 倍

Artificial Analysis で Gemini 3.8 Flash は 59、DeepSeek V4 Flash は 52。同じ指数を走らせた費用は $826 対 $323。価格、速度、そしてどちらがどの条件で勝つか。

Gemini 3.8 Flash vs DeepSeek V4 Flash:59 対 52、費用は 2.6 倍

Gemini 3.8 Flash は Artificial Analysis Intelligence Index で high effort なら 59、DeepSeek V4 Flash 0731 は 52 です。同じ指数を走らせた費用は Gemini 3.8 Flash が $825.83、DeepSeek が $323.26。7 ポイントの差に対して費用は 2.6 倍です。low effort では Gemini は DeepSeek と 52 で同点になりますが、そこでの AA の Cost per Task は $0.24 対 DeepSeek の $0.11 です。

Google は 2026 年 9 月 2 日、3.7 Flash と同じ価格で Gemini 3.8 Flash をリリースし、Artificial Analysis はこれを「その知能水準で最も安いモデル」と呼びました。多くの人が横に並べるのは DeepSeek V4 Flash 0731 でしょう。同じクラスでトークン単価が最も安いからです。どちらの主張も正しい。ただし答えている問いが違います。この記事はその 2 つを分けて扱います。

要点:どちらを選ぶか

  • 追加の 7 ポイントが必要なら Gemini 3.8 Flash。 high effort で Artificial Analysis Intelligence Index 59。DeepSeek の現行ラインナップは最高でも 53 です。画像・音声・ファイルも受け付け、出力速度は約 302 トークン/秒。
  • 52 で足りるなら DeepSeek V4 Flash 0731。 同じスコアで AA の Cost per Task は DeepSeek がピークレートで $0.11、Gemini 3.8 Flash の low effort が $0.24。オフピークなら DeepSeek はさらに半額です。引き換えに、出力は約 2.2 倍遅く、入力はテキストのみ。
  • 定価を比べないこと。 指数を完走するのに DeepSeek は 2 億 1000 万の出力トークンを書き、Gemini 3.8 Flash は 1 億 2000 万でした。請求額を決める 2 つの要素のうち、トークン単価は小さい方です。
  • 2027 年 1 月 1 日に注意。 その日に Gemini 3.8 Flash は $1.50 / $7.50 に倍増します。以下の Gemini の数字はすべて 2026 年の数字として読んでください。

Gemini 3.8 Flash で Google が変えたもの

Gemini 3.8 Flash は Google にとって 6 週間で 3 つ目の Flash です。7 月 21 日に 3.6 Flash、8 月 13 日に 3.7 Flash、そして今回。トークン単価は動いていません。100 万トークンあたり入力 $0.75、出力 $3.75。3.7 Flash と同じ導入価格で、2026 年 12 月 31 日に期限が来ます。

動いたのはモデルがどれだけ書くかです。Google の発表は珍しく率直です(以下の引用は訳文)。「3.8 Flash はより熱心に働きます。複雑なタスクではより高い勤勉さを示し、追加の推論ステップを実行し、ツールを反復的に呼び出します。時には、特に高い effort レベルでは、性能を最大化するためにより多くのトークンを使うことがあります。」効率優先のワークロードへの Google の助言は、effort レベルを下げるか、「引き続き完全にサポートされる Gemini 3.7 Flash に頼り続ける」ことです。

同じリリースで Gemini 3.8 Flash Cyber も登場しました。脆弱性検出に特化した派生版で、Google の Fairwind Program 参加者に限定されています。汎用の API モデルではないため、ここでは比較しません。

スペック早見表

項目Gemini 3.8 FlashDeepSeek V4 Flash 0731
リリース2026-09-022026-07-31
コンテキストウィンドウ1M トークン1M トークン
最大出力64K トークン384K トークン
入力モダリティテキスト、画像、音声、動画、ファイルテキストのみ
推論の制御low / medium(デフォルト)/ high。minimal はエラーthinking オン(デフォルト)/ オフ。effort は low / high / max
重みクローズドオープン(MIT)
AA Intelligence Index59 high / 57 medium / 52 low52 max effort
AA 出力速度約 302 トークン/秒約 138 トークン/秒
AA 指数完走の出力トークン1 億 2000 万2 億 1000 万
AA 指数完走の費用$825.83$323.26

Intelligence Index、トークン、費用の数値は 2026 年 9 月 3 日時点の Artificial Analysis によるものです。DeepSeek のビジョン対応ビルド deepseek-v4-flash-vision-exp は別モデルで、この表の対象ではありません。

Artificial Analysis 上の Gemini 3.8 Flash:59 対 52、そして天井

Gemini 3.8 Flash は Artificial Analysis Intelligence Index で DeepSeek V4 Flash 0731 を 7 ポイント上回ります(59 対 52)。ただし high effort の場合に限ります。 Artificial Analysis はモデルと推論レベルごとに 1 つの総合スコアを公開しています。近傍のスコアを並べると次の通りです。

モデルAA Intelligence Index
Gemini 3.8 Flash(high)59
Gemini 3.8 Flash(medium、デフォルト)57
Gemini 3.7 Flash(high)56
DeepSeek V4 Pro 0813(max)53
Gemini 3.8 Flash(low)52
DeepSeek V4 Flash 0731(max)52
Gemini 3.6 Flash(high)52

この表から 2 つのことが読み取れます。

第一に、目玉の 7 ポイント差は high effort でしか存在しません。デフォルトの medium で運用すれば差は 5 ポイント。low まで下げれば 2 つのモデルは 52 で同点です。

第二に、差より天井の方が重要です。DeepSeek V4 Flash 0731 の 52 は、DeepSeek 自身のフラッグシップ V4 Pro 0813 の 53 より 1 ポイント低いだけ。タスクが 57 や 59 を必要とするなら、選べる DeepSeek のモデルはありません。この比較が成立するのは 52 以下だけです。

出力トークン:DeepSeek V4 Flash 2 億 1000 万 対 Gemini 3.8 Flash 1 億 2000 万

DeepSeek V4 Flash 0731 は Artificial Analysis の指数を完走するのに 2 億 1000 万の出力トークンを使い、Gemini 3.8 Flash(high)は 1 億 2000 万でした。DeepSeek は 1.75 倍書いています。 Artificial Analysis は各モデルが指数完走に費やした出力トークン数を記録しています。Gemini 3.8 Flash(high)の 1 億 2000 万は、同等モデルの中央値 7100 万に対して「非常に冗長」と AA が注記しています。DeepSeek V4 Flash 0731 の 2 億 1000 万は「同規模のオープンウェイトモデルの中では高い方(中央値:1 億 1000 万)」です。

つまり両方とも口数が多いのですが、DeepSeek はその 1.75 倍で、そのトークンはすべて出力レートで課金されます。速度が追い打ちをかけます。138 トークン/秒の DeepSeek は、同じ数のトークンを吐き出すのに Gemini 3.8 Flash の約 2.2 倍の時間がかかり、しかもより多く吐き出します。

3.8 Flash について言えば、AA はタスクあたり平均出力トークンが 3.7 Flash 比で 30% 増えて 4 万 8000 になり、high effort の Cost per Task が $0.40 から $0.58 に上がったと計測しました。同じ価格表で請求額は約 45% 増(AA の丸めではおよそ 40%)。Google が警告していたのはこの数字です。

Gemini 3.8 Flash の価格 vs DeepSeek V4 Flash の価格:定価、そして請求額

まず定価。100 万トークンあたりドル。

$ / 1M トークンGemini 3.8 Flash(2026-12-31 まで)Gemini 3.8 Flash(2027-01-01 から)DeepSeek V4 Flash ピークDeepSeek V4 Flash オフピーク
入力0.751.500.440.22
キャッシュ入力0.0750.150.0140.007
出力3.757.501.320.66

DeepSeek のピーク時間帯は月曜から金曜の UTC 01:00〜04:00 と 06:00〜10:00。それ以外はすべてオフピークで、ちょうど半額です。この枠は平日 1 日 7 時間なので、スケジュールできるバッチ処理がピーク列を払うことはほとんどありません。このレートは DeepSeek の 2026 年 8 月 13 日の変更履歴で告知され、8 月 16 日 16:00 UTC に発効したもので、DeepSeek は「ピーク/オフピーク料金を採用し、オフピーク価格はピーク時間帯価格の半額に設定する」と述べました。それ以前の V4 Flash は入力 $0.14、出力 $0.28 だったので、オフピーク列であってもリリース時の価格の 1.6〜2.4 倍です。

次に請求額。Artificial Analysis が Intelligence Index 全体を走らせた費用は、Gemini 3.8 Flash(high)が $825.83、DeepSeek V4 Flash 0731 が $323.26(ピークレートの $0.44 / $1.32 で計算)。同じタスクセットで、7 ポイントに対して 2.6 倍の差です。

AA は指数総額とは別に Cost per Task も公開しています。Gemini 3.8 Flash は high $0.58、medium $0.41、low $0.24、DeepSeek V4 Flash 0731 はピークレート $0.44 / $1.32 で $0.11。オフピークは DeepSeek の全行を半額にするので約 $0.055。この最後の数字は私たちの計算で、AA が公表している数値ではありません。AA の 2 つの指標は倍率で一致しません。指数総額では 2.6 倍、Cost per Task では 5.3 倍です。ワークロード全体の総額か、呼び出しあたりの平均か、自分の買い方に合う方を引用してください。

52 ポイントのモデルを並べます。

AA スコア 52タスクあたり費用
Gemini 3.8 Flash(low)$0.24
DeepSeek V4 Flash 0731、ピークまたはピーク固定のホスト$0.11(AA)
DeepSeek V4 Flash 0731、オフピーク約 $0.055(推算)

同じ知能で、DeepSeek はピークレートでもタスクあたり約半額、オフピークなら約 4 分の 1 です。Gemini 3.8 Flash の low effort が追加の $0.13 で買うものは、約 2.2 倍速い出力と、画像・音声・動画・ファイルの入力です。

キャッシュと 2027 年の値上げ

キャッシュ。 Gemini 3.8 Flash はキャッシュ入力を $0.075 で読みます。新規入力の 10 分の 1 です。DeepSeek はキャッシュヒットをピーク $0.014 で読み、ミスの 31 分の 1。プロンプトが長い共通プレフィックスを持つなら、DeepSeek のキャッシュはどちらの価格表でも最も安い入力トークンです。持たないなら、この列は無関係です。

2027 年の崖。 2027 年 1 月 1 日に Gemini 3.8 Flash のレートは倍になります。トークン数が変わらなければ、$0.58 / $0.41 / $0.24 のタスクあたり費用はおよそ $1.16 / $0.82 / $0.48 になります。DeepSeek の料金ページが約束しているのは「製品価格は変動する可能性があり、DeepSeek は調整する権利を留保する」の一文だけです。12 か月の費用モデルにはこの 2 行が必要です。

Gemini 3.8 Flash を選ぶとき

  • タスクが 53 より上を必要とする。その線の上に DeepSeek の選択肢はない。
  • 入力に画像、音声、動画、PDF が含まれる。
  • レイテンシが重要。約 302 トークン/秒、AA の Time per Task は low で 0.8 分、high で 2.5 分。
  • トラフィックを UTC 7 時間の枠に合わせてスケジュールできない。

DeepSeek V4 Flash 0731 を選ぶとき

  • 52 で足り、オフピークで走らせられるか、プロンプトが長いキャッシュ済みプレフィックスを共有している。
  • 1 回の呼び出しで 384K の出力トークンが必要。
  • 後で自分でホストできるオープンウェイトが欲しい。
  • テキストのみで問題ない。ビジョン版は別の実験的モデル。

どちらも正解でないとき

すでに Gemini 3.7 Flash を使っていて仕事が回っているなら、Google 自身が、そのままでよいと言っています。3.7 Flash は AA タスクあたり $0.40 で 56、3.8 Flash の medium は $0.41 で 57。その 1 ポイントはほぼ無料ですが、59 のために high に上げるのは無料ではなく、3.7 Flash は完全にサポートされ続けます。effort レベルごとの価格の詳細は Gemini 3.7 Flash API ガイドを参照してください。

DeepSeek V4 Flash と Gemini 3.6 Flash で迷っていたなら、以前の比較は 52 の水準で今も有効です。3.8 Flash の low effort は自身の $0.75 / $3.75 でその同点に加わり、AA によれば 3.6 Flash の high よりタスクあたり費用は約 30% 低くなります。

Ofox で両方を試す:1 つのエンドポイント、1 つのキー

DeepSeek V4 Flash 0731 は Ofox のカタログに deepseek/deepseek-v4-flash-0731 として掲載され、100 万トークンあたり入力 $0.44、出力 $1.32、キャッシュ読み取り $0.014 です。DeepSeek のピーク時間帯レートと同じ数字を一律で課金します。Ofox にオフピーク枠はありません。つまり、まさにこのレートで AA が計測したタスクあたり $0.11 が当てはまる行で、オフピークの行は当てはまりません。

Gemini 3.8 Flash は 2026 年 9 月 3 日時点で Ofox のカタログにありません。 google/gemini-3.7-flash はあり、Google プロバイダー経路で入力 $0.75、出力 $3.75(同じモデルページの CloudVertex 経路は $1.50 / $7.50 で、/v1/modelspricing フィールドが現在返すのは後者)。3.8 Flash と同じトークン単価です。下のループは今日は DeepSeek 対 3.7 Flash を走らせます。3.8 Flash が来たら文字列 1 つの変更です。何を呼び出せるかの最終的な根拠は GET /v1/models の稼働中カタログです。

from openai import OpenAI

client = OpenAI(base_url="https://api.ofox.io/v1", api_key="YOUR_OFOX_API_KEY")

MODELS = [
    "deepseek/deepseek-v4-flash-0731",
    "google/gemini-3.7-flash",   # 3.8 Flash が掲載されたら google/gemini-3.8-flash に差し替え
]

prompt = "Refactor this function to remove the nested loop. Return only code."

for model in MODELS:
    r = client.chat.completions.create(
        model=model,
        messages=[{"role": "user", "content": prompt}],
    )
    u = r.usage
    print(f"{model:36} in={u.prompt_tokens:6} out={u.completion_tokens:6}")

レイテンシだけでなく completion_tokens を記録してください。この記事で定価以外のすべては、あなた自身のトラフィックにおけるこの列に帰着します。

出典

価格、指数スコア、トークン数は 2026 年 9 月 3 日に確認。Ofox カタログの掲載状況は同日に稼働中の /v1/models エンドポイントで確認し、Ofox の価格はモデルページから取得。

よくある質問

Gemini 3.8 Flash は DeepSeek V4 Flash より優れていますか?
Artificial Analysis Intelligence Index では優れています。Gemini 3.8 Flash は high effort で 59、デフォルトの medium で 57、low で 52。DeepSeek V4 Flash 0731 は max effort で 52 です。DeepSeek の現行ラインナップに 59 に届くモデルはなく、V4 Pro 0813 が 53 です。low effort では Gemini 3.8 Flash と DeepSeek V4 Flash はこの指数上で同点です。
Gemini 3.8 Flash と DeepSeek V4 Flash の料金はどれくらい違いますか?
定価では、Gemini 3.8 Flash は 100 万トークンあたり入力 $0.75、出力 $3.75(2026 年 12 月 31 日まで。2027 年 1 月 1 日から $1.50 と $7.50)。DeepSeek V4 Flash はピーク時間帯で入力 $0.44(キャッシュミス)、キャッシュヒット $0.014、出力 $1.32、オフピークはその半額です。Artificial Analysis が Intelligence Index 全体を走らせた費用は Gemini 3.8 Flash(high)が $825.83、DeepSeek V4 Flash 0731 が $323.26 で、2.6 倍の差です。
実際の費用差が定価の差より小さいのはなぜですか?
AA の指数総額での差は 2.6 倍で、出力単価の比 2.8 倍を下回ります。DeepSeek V4 Flash 0731 がはるかに多くのトークンを書くからです。Artificial Analysis の記録では、指数全体で DeepSeek は 2 億 1000 万の出力トークン、Gemini 3.8 Flash は 1 億 2000 万で、1.75 倍です。AA が別途算出する Cost per Task では差は 5.3 倍($0.58 対 $0.11)に広がります。出力速度は逆方向に差を広げます。Gemini 3.8 Flash が約 302 トークン/秒、DeepSeek が 138 です。
Gemini 3.8 Flash は 3.7 Flash よりトークンを多く使いますか?
使います。Google は 3.8 Flash が「より熱心に働く」とし、「特に高い effort レベルでは、性能を最大化するためにより多くのトークンを使うことがある」と述べています。Artificial Analysis はタスクあたり平均出力トークンが 30% 増えて 4 万 8000 になり、high effort での指数タスクあたり費用が 3.7 Flash の $0.40 から 3.8 Flash の $0.58 に上がったと計測しました。トークン単価は同一です。
両方を今日 Ofox 経由で呼び出せますか?
DeepSeek V4 Flash 0731 は Ofox のカタログに deepseek/deepseek-v4-flash-0731 として掲載され、100 万トークンあたり入力 $0.44、出力 $1.32、キャッシュ読み取り $0.014 です。DeepSeek のピーク時間帯レートと同じ数字で、オフピーク枠はありません。Gemini 3.8 Flash は 2026 年 9 月 3 日時点でカタログにありません。google/gemini-3.7-flash はあり、3.8 Flash と同じ $0.75 / $3.75 です。