Gemini 3.8 Flash vs DeepSeek V4 Flash:多 7 分,账单 2.6 倍
Gemini 3.8 Flash 在 Artificial Analysis 拿 59 分,DeepSeek V4 Flash 52 分;跑完同一套测试花 $826 对 $323。差距从哪来、同分时 DeepSeek 便宜多少、2027 年涨价后怎么算。
Gemini 3.8 Flash 在 Artificial Analysis 智能指数 high 档拿 59 分,DeepSeek V4 Flash 0731 拿 52 分;跑完同一套指数前者花 $825.83,后者 $323.26,7 分差距对应 2.6 倍账单。调到 low 档两者在 52 分打平,但 AA 的每任务成本是 Gemini $0.24 对 DeepSeek $0.11。
Google 在 2026 年 9 月 2 日发布 Gemini 3.8 Flash,价格与 3.7 Flash 完全相同,Artificial Analysis 称它是「同等智力水平下最便宜的模型」。多数人拿来对比的会是 DeepSeek V4 Flash 0731,因为它是同一重量级里单价最低的那个。两句话都对,但回答的不是同一个问题。这篇把它们分开算。
先说结论:选哪个
- 要那多出来的 7 分,选 Gemini 3.8 Flash。 它在 Artificial Analysis 智能指数 high 档拿 59 分,DeepSeek 现役全系最高只有 53。它还收图片、音频和文件,输出速度约每秒 302 个 token。
- 52 分够用,选 DeepSeek V4 Flash 0731。 同为 52 分,AA 的每任务成本是 DeepSeek 高峰价 $0.11 对 Gemini 3.8 Flash low 档 $0.24,非高峰再减半。你让出的是约 2.2 倍的输出速度差距和多模态输入。
- 别比标价。 DeepSeek 跑完整套指数写了 2.1 亿 token,Gemini 3.8 Flash 写了 1.2 亿。单价只是账单里较小的那一半。
- 盯住 2027 年 1 月 1 日。 那天 Gemini 3.8 Flash 涨到 $1.50 / $7.50。下面所有 Gemini 的数字都只算 2026 年的。
9 月 2 日变了什么
Gemini 3.8 Flash 是 Google 六周内的第三个 Flash:7 月 21 日 3.6 Flash,8 月 13 日 3.7 Flash,然后是它。单价没动:每百万 token 输入 $0.75、输出 $3.75,和 3.7 Flash 同一档首发价,2026 年 12 月 31 日到期。
动的是模型写多少。Google 的发布文在这点上说得少见地直白(以下引文为译文):「3.8 Flash 更肯下功夫。面对复杂任务,它表现出更强的钻研劲头——执行额外的推理步骤、反复调用工具。有时它会消耗更多 token 来把表现拉满,尤其在较高的 effort 档位。」对讲效率的场景,Google 的建议是调低 effort,或者「继续用 Gemini 3.7 Flash,它仍然得到完整支持」。
同一天还发了 Gemini 3.8 Flash Cyber,一个做漏洞检测的变体,只向 Google 的 Fairwind 计划成员开放。它不是通用 API 模型,本文不比它。
规格速览
| 规格 | Gemini 3.8 Flash | DeepSeek V4 Flash 0731 |
|---|---|---|
| 发布 | 2026-09-02 | 2026-07-31 |
| 上下文 | 1M token | 1M token |
| 最大输出 | 64K token | 384K token |
| 输入模态 | 文本、图片、音频、视频、文件 | 仅文本 |
| 推理控制 | low / medium(默认)/ high;传 minimal 报错 | 思考开(默认)/ 关;effort 分 low / high / max |
| 权重 | 闭源 | 开放(MIT) |
| AA 智能指数 | 59 high / 57 medium / 52 low | 52 max |
| AA 输出速度 | 约 302 token/s | 约 138 token/s |
| 跑完 AA 指数的输出 token | 1.2 亿 | 2.1 亿 |
| 跑完 AA 指数的花费 | $825.83 | $323.26 |
智能指数、token 数和花费来自 Artificial Analysis,2026 年 9 月 3 日读数。DeepSeek 带视觉的 deepseek-v4-flash-vision-exp 是另一个模型,不在这张表里。
Artificial Analysis 跑分:Gemini 3.8 Flash 59 分对 DeepSeek 52 分
Gemini 3.8 Flash 在 Artificial Analysis 智能指数上比 DeepSeek V4 Flash 0731 高 7 分,59 对 52,但只在 high 档成立。 Artificial Analysis 给每个模型的每个推理档位一个综合分。这一带的排位:
| 模型 | AA 智能指数 |
|---|---|
| Gemini 3.8 Flash(high) | 59 |
| Gemini 3.8 Flash(medium,默认) | 57 |
| Gemini 3.7 Flash(high) | 56 |
| DeepSeek V4 Pro 0813(max) | 53 |
| Gemini 3.8 Flash(low) | 52 |
| DeepSeek V4 Flash 0731(max) | 52 |
| Gemini 3.6 Flash(high) | 52 |
这张表能读出两件事。
第一,标题上的 7 分差距只在 high 档存在。按默认的 medium 上线,差距是 5 分;调到 low,两者在 52 分打平。
第二,天花板比差距更要紧。DeepSeek V4 Flash 0731 的 52 分,只比 DeepSeek 自家旗舰 V4 Pro 0813 的 53 分低 1 分。如果你的任务需要 57 或 59,DeepSeek 那边没有可选的模型。这场对比只在 52 分及以下成立。
输出 token:DeepSeek V4 Flash 2.1 亿对 Gemini 3.8 Flash 1.2 亿
DeepSeek V4 Flash 0731 跑完 Artificial Analysis 指数输出了 2.1 亿 token,Gemini 3.8 Flash(high)是 1.2 亿,DeepSeek 写了 1.75 倍。 Artificial Analysis 会记录每个模型跑完指数用了多少输出 token。Gemini 3.8 Flash(high)用了 1.2 亿,AA 标注为「非常啰嗦」,同类模型中位数是 7100 万。DeepSeek V4 Flash 0731 用了 2.1 亿,「在同等规模的开放权重模型里处于偏高一端(中位数:1.1 亿)」。
所以两个都话多,但 DeepSeek 写的是 Gemini 的 1.75 倍,而且每一个 token 都按输出价计费。速度让这件事雪上加霜:每秒 138 个 token,DeepSeek 吐出同样多的 token 要花 Gemini 3.8 Flash 约 2.2 倍的时间,而它还吐得更多。
单看 3.8 Flash,AA 测到每任务平均输出 token 比 3.7 Flash 多 30%,到 4.8 万;high 档每任务成本从 $0.40 涨到 $0.58。同一张价目表,账单高约 45%(AA 把它约成 40% 左右)。Google 提醒的就是这个数。
Gemini 3.8 Flash 价格 vs DeepSeek V4 Flash 价格:先看标价,再看账单
先看标价。每百万 token,美元:
| 每百万 token,美元 | Gemini 3.8 Flash(至 2026-12-31) | Gemini 3.8 Flash(2027-01-01 起) | DeepSeek V4 Flash 高峰 | DeepSeek V4 Flash 非高峰 |
|---|---|---|---|---|
| 输入 | 0.75 | 1.50 | 0.44 | 0.22 |
| 缓存输入 | 0.075 | 0.15 | 0.014 | 0.007 |
| 输出 | 3.75 | 7.50 | 1.32 | 0.66 |
DeepSeek 的高峰时段是周一到周五 UTC 01:00–04:00 和 06:00–10:00,其余时间都算非高峰,价格正好减半。这个窗口工作日每天只有 7 小时,能排期的批处理任务基本碰不到高峰价。这套费率见于 DeepSeek 2026 年 8 月 13 日的更新日志,8 月 16 日 16:00 UTC 生效,官方中文原话是「我们将采用峰谷定价,闲时价格为高峰时段价格的一半」。此前 V4 Flash 标价输入 $0.14、输出 $0.28,所以即便是非高峰那一列,也是首发价的 1.6 到 2.4 倍。
再看账单。Artificial Analysis 跑完整套智能指数,Gemini 3.8 Flash(high)花了 $825.83,DeepSeek V4 Flash 0731 花了 $323.26,后者按 $0.44 / $1.32 的高峰价计。同一套任务,7 分差距,2.6 倍价差。
AA 还单独给出一个「每任务成本」,和指数总花费是两套算法:Gemini 3.8 Flash high $0.58、medium $0.41、low $0.24,DeepSeek V4 Flash 0731 按 $0.44 / $1.32 的高峰价是 $0.11。非高峰把 DeepSeek 每一行都减半,约 $0.055,这最后一个数是我们算的,AA 没有给出。两套 AA 数字给出的倍数并不一致:指数总额是 2.6 倍,每任务成本是 5.3 倍,按你的采购方式取用,整体工作量看总额,单次调用看均值。
把 52 分的几个放到一起:
| 同为 AA 52 分 | 每任务成本 |
|---|---|
| Gemini 3.8 Flash(low) | $0.24 |
| DeepSeek V4 Flash 0731,高峰价或一口价中转 | $0.11(AA) |
| DeepSeek V4 Flash 0731,非高峰 | 约 $0.055(推算) |
同等智力下,DeepSeek 即便按高峰价,每任务也只要一半左右,非高峰只要四分之一。Gemini 3.8 Flash low 档多花的这 $0.13,换来的是约 2.2 倍的输出速度,以及图片、音频、视频和文件输入。
两个会动账单的细节
缓存。 Gemini 3.8 Flash 读缓存 $0.075,是新输入的十分之一。DeepSeek 缓存命中高峰价 $0.014,是未命中的三十一分之一。如果你的 prompt 共享一段长前缀,DeepSeek 的缓存是两张价目表上最便宜的输入 token。如果不共享,这一列跟你无关。
2027 年的断崖。 2027 年 1 月 1 日 Gemini 3.8 Flash 单价翻倍,token 用量不变的话,三档每任务成本会从 $0.58 / $0.41 / $0.24 变成约 $1.16 / $0.82 / $0.48。DeepSeek 的定价页只有一句「产品价格可能发生变动,DeepSeek 保留修改价格的权利」。做十二个月的成本模型,这两行都得放进去。
什么时候选 Gemini 3.8 Flash
- 任务需要 53 分以上。那条线之上没有 DeepSeek 可选。
- 输入里有图片、音频、视频或 PDF。
- 在乎延迟:约每秒 302 个 token,AA 的每任务时长 low 档 0.8 分钟、high 档 2.5 分钟。
- 你的流量没法绕着每天 7 小时的 UTC 窗口排。
什么时候选 DeepSeek V4 Flash 0731
- 52 分够用,而且能跑非高峰,或者 prompt 共享很长的缓存前缀。
- 一次调用需要 384K 输出 token。
- 想要开放权重,以后自己部署。
- 只有文本就够。视觉版是另一个实验性模型。
什么时候两个都不选
如果你已经在用 Gemini 3.7 Flash 而且够用,Google 自己都说别动。3.7 Flash 56 分,AA 每任务 $0.40;3.8 Flash medium 档 57 分,$0.41。那 1 分几乎免费,但为了 59 分上 high 档就不免费了,而 3.7 Flash 仍然得到完整支持。各档位的价格细节见 Gemini 3.7 Flash API 接入指南。
如果你在 DeepSeek V4 Flash 和 Gemini 3.6 Flash 之间犹豫,之前那篇对比在 52 分这一层依然成立;3.8 Flash 的 low 档以自己 $0.75 / $3.75 的单价挤进了这个 52 分平局,而且按 AA 的数据,每任务成本比 3.6 Flash high 档低约 30%。
通过 Ofox 同时试:一个端点,一把 Key
DeepSeek V4 Flash 0731 在 Ofox 目录里,ID 是 deepseek/deepseek-v4-flash-0731,每百万 token 输入 $0.44、输出 $1.32、缓存读取 $0.014。这几个数字和 DeepSeek 高峰时段费率一致,一口价:Ofox 上没有非高峰窗口。也就是说 AA 按这组费率测出的每任务 $0.11 就是适用于你的那一行,非高峰那一行不适用。
Gemini 3.8 Flash 截至 2026 年 9 月 3 日尚未进入 Ofox 目录。 google/gemini-3.7-flash 在,Google 线路输入 $0.75、输出 $3.75(同页 CloudVertex 线路为 $1.50 / $7.50,/v1/models 的 pricing 字段目前返回的是后者),和 3.8 Flash 单价相同。下面这段循环今天跑的是 DeepSeek 对 3.7 Flash;3.8 Flash 上架后改一个字符串就行。GET /v1/models 返回的目录才是能调什么的最终依据。
from openai import OpenAI
client = OpenAI(base_url="https://api.ofox.io/v1", api_key="YOUR_OFOX_API_KEY")
MODELS = [
"deepseek/deepseek-v4-flash-0731",
"google/gemini-3.7-flash", # 3.8 Flash 上架后换成 google/gemini-3.8-flash
]
prompt = "重构这个函数,去掉嵌套循环。只返回代码。"
for model in MODELS:
r = client.chat.completions.create(
model=model,
messages=[{"role": "user", "content": prompt}],
)
u = r.usage
print(f"{model:36} in={u.prompt_tokens:6} out={u.completion_tokens:6}")
记 completion_tokens,不要只记延迟。这篇里所有不是标价的结论,最后都落在你自己流量上的这一列。
来源
- https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
- https://ai.google.dev/gemini-api/docs/pricing
- https://ai.google.dev/gemini-api/docs/latest-model
- https://artificialanalysis.ai/articles/gemini-3-8-flash
- https://artificialanalysis.ai/models/gemini-3-8-flash
- https://artificialanalysis.ai/models/deepseek-v4-flash
- https://artificialanalysis.ai/models/releases/deepseek-v4-flash
- https://api-docs.deepseek.com/quick_start/pricing
- https://api-docs.deepseek.com/updates
- https://ofox.io/zh/models/deepseek/deepseek-v4-flash-0731
价格、指数分数与 token 数均于 2026 年 9 月 3 日核对。Ofox 目录收录情况同日核对自线上 /v1/models 接口,Ofox 价格取自模型页。
常见问题
- Gemini 3.8 Flash 比 DeepSeek V4 Flash 强吗?
- 按 Artificial Analysis 智能指数,是的。Gemini 3.8 Flash 在 high 档拿 59 分,默认的 medium 档 57 分,low 档 52 分;DeepSeek V4 Flash 0731 在 max 档拿 52 分。DeepSeek 现役全系没有一个到 59,旗舰 V4 Pro 0813 是 53 分。把 Gemini 3.8 Flash 调到 low,两者在这个指数上打平。
- Gemini 3.8 Flash 和 DeepSeek V4 Flash 各要多少钱?
- 官方标价:Gemini 3.8 Flash 每百万 token 输入 $0.75、输出 $3.75,到 2026 年 12 月 31 日为止,2027 年 1 月 1 日起变为 $1.50 和 $7.50。DeepSeek V4 Flash 高峰时段输入 $0.44(缓存未命中)、缓存命中 $0.014、输出 $1.32,非高峰时段减半。Artificial Analysis 跑完整套智能指数,Gemini 3.8 Flash(high)花了 $825.83,DeepSeek V4 Flash 0731 花了 $323.26,差 2.6 倍。
- 为什么实际成本差距比标价差距小?
- 按 AA 的指数总额算差距是 2.6 倍,低于 2.8 倍的输出单价比,因为 DeepSeek V4 Flash 0731 写得多得多:Artificial Analysis 记录到 DeepSeek 跑完指数输出了 2.1 亿 token,Gemini 3.8 Flash 是 1.2 亿,是它的 1.75 倍。AA 另外算的每任务成本则把差距拉大到 5.3 倍($0.58 对 $0.11)。输出速度则把差距往另一个方向拉:Gemini 3.8 Flash 约每秒 302 个 token,DeepSeek 约 138 个。
- Gemini 3.8 Flash 比 3.7 Flash 更费 token 吗?
- 是。Google 自己说 3.8 Flash「更肯下功夫」,「有时会消耗更多 token 来把表现拉满,尤其在较高的 effort 档位」。Artificial Analysis 测到每任务平均输出 token 涨了 30%,到 4.8 万,high 档每任务成本从 3.7 Flash 的 $0.40 涨到 3.8 Flash 的 $0.58,而两者单价完全相同。
- 现在能通过 Ofox 同时调这两个模型吗?
- DeepSeek V4 Flash 0731 在 Ofox 目录里,ID 是 deepseek/deepseek-v4-flash-0731,每百万 token 输入 $0.44、输出 $1.32、缓存读取 $0.014,数字与 DeepSeek 高峰时段费率一致,不分时段。Gemini 3.8 Flash 截至 2026 年 9 月 3 日尚未进入 Ofox 目录;google/gemini-3.7-flash 在,价格和 3.8 Flash 一样是 $0.75 / $3.75。


