Gemini 3.8 Flash vs DeepSeek V4 Flash: 59 против 52, счёт в 2.6 раза выше

Gemini 3.8 Flash набирает 59 на Artificial Analysis, DeepSeek V4 Flash — 52, а прогон одного и того же индекса стоил $826 против $323. Цена, скорость и когда выигрывает каждая.

Gemini 3.8 Flash vs DeepSeek V4 Flash: 59 против 52, счёт в 2.6 раза выше

Gemini 3.8 Flash набирает 59 на Artificial Analysis Intelligence Index при высоком effort; DeepSeek V4 Flash 0731 — 52. Прогон одного и того же индекса стоил $825.83 на Gemini 3.8 Flash и $323.26 на DeepSeek: разрыв в 2.6 раза за семь баллов. При низком effort Gemini идёт вровень с DeepSeek на 52, но стоимость задачи по AA там $0.24 против $0.11 у DeepSeek.

Google выпустила Gemini 3.8 Flash 2 сентября 2026 года по той же цене, что и 3.7 Flash, и Artificial Analysis назвала её «самой дешёвой моделью на своём уровне интеллекта». DeepSeek V4 Flash 0731 — модель, которую большинство поставит рядом, потому что она самая дешёвая за токен в той же весовой категории. Оба утверждения верны. Это ответы на разные вопросы, и этот текст держит их порознь.

Коротко: что выбрать

  • Берите Gemini 3.8 Flash, если вам нужны лишние семь баллов. При высоком effort она набирает 59 на Artificial Analysis Intelligence Index; вся текущая линейка DeepSeek упирается в 53. Она также принимает изображения, аудио и файлы и выдаёт около 302 токенов в секунду.
  • Берите DeepSeek V4 Flash 0731, если 52 достаточно. На этом балле стоимость задачи по AA — $0.11 у DeepSeek по пиковому тарифу против $0.24 у Gemini 3.8 Flash при низком effort, а вне пика у DeepSeek ещё вдвое меньше. Взамен вы получаете вывод примерно в 2.2 раза медленнее и только текстовый вход.
  • Не сравнивайте прейскуранты. Чтобы пройти индекс, DeepSeek написала 210M выходных токенов, Gemini 3.8 Flash — 120M. Цена за токен — меньшая половина счёта.
  • Следите за 1 января 2027 года. В этот день Gemini 3.8 Flash дорожает вдвое, до $1.50 / $7.50. Все цифры по Gemini ниже — цифры 2026 года.

Что Google изменила в Gemini 3.8 Flash

Gemini 3.8 Flash — третий релиз Flash у Google за шесть недель, после 3.6 Flash 21 июля и 3.7 Flash 13 августа. Цена за токен не сдвинулась: $0.75 за миллион входных токенов и $3.75 за выходные, тот же вводный тариф, что и у 3.7 Flash, истекающий 31 декабря 2026 года.

Сдвинулось то, сколько модель пишет. Анонс Google на редкость прямолинеен (цитаты далее — в переводе): «3.8 Flash работает усерднее. На сложных задачах она проявляет большую старательность — выполняет дополнительные шаги рассуждения и итеративно вызывает инструменты. Иногда модель может использовать больше токенов, чтобы максимизировать результат, особенно на более высоких уровнях effort». Для нагрузок, где важна эффективность, совет Google — снизить уровень effort или «продолжать полагаться на Gemini 3.7 Flash, которая остаётся полностью поддерживаемой».

Тем же релизом вышла Gemini 3.8 Flash Cyber — вариант для поиска уязвимостей, доступный только участникам программы Google Fairwind. Это не универсальная API-модель, и здесь она не сравнивается.

Краткое сравнение характеристик

ПараметрGemini 3.8 FlashDeepSeek V4 Flash 0731
Релиз2 сен 202631 июл 2026
Контекстное окно1M токенов1M токенов
Максимальный вывод64K токенов384K токенов
Входные модальностиТекст, изображения, аудио, видео, файлыТолько текст
Управление рассуждениемlow / medium (по умолчанию) / high; minimal возвращает ошибкуthinking включён (по умолчанию) / выключен; effort low / high / max
ВесаЗакрытыеОткрытые (MIT)
AA Intelligence Index59 high / 57 medium / 52 low52 max effort
Скорость вывода по AA~302 токена/с~138 токенов/с
Выходных токенов на прогон индекса AA120M210M
Стоимость прогона индекса AA$825.83$323.26

Индекс, токены и стоимость — по данным Artificial Analysis на 3 сентября 2026 года. Сборка DeepSeek с поддержкой изображений, deepseek-v4-flash-vision-exp, — отдельная модель, и в этой таблице её нет.

Gemini 3.8 Flash на Artificial Analysis: 59 против 52 и потолок

Gemini 3.8 Flash опережает DeepSeek V4 Flash 0731 на семь баллов по Artificial Analysis Intelligence Index, 59 против 52, но только при высоком effort. Artificial Analysis публикует один сводный балл на модель и уровень рассуждения. Вот соседние строки:

МодельAA Intelligence Index
Gemini 3.8 Flash (high)59
Gemini 3.8 Flash (medium, по умолчанию)57
Gemini 3.7 Flash (high)56
DeepSeek V4 Pro 0813 (max)53
Gemini 3.8 Flash (low)52
DeepSeek V4 Flash 0731 (max)52
Gemini 3.6 Flash (high)52

Из таблицы следуют две вещи.

Во-первых, заголовочный разрыв в семь баллов есть только при высоком effort. Запустите Gemini 3.8 Flash на medium по умолчанию — разрыв сократится до пяти. Опустите до low — модели сравняются на 52.

Во-вторых, потолок важнее разрыва. DeepSeek V4 Flash 0731 с 52 баллами всего на один балл ниже собственного флагмана DeepSeek, V4 Pro 0813 с 53. Если задаче нужны 57 или 59, в линейке DeepSeek брать нечего. Сравнение существует только на 52 и ниже.

Выходные токены: DeepSeek V4 Flash 210M против Gemini 3.8 Flash 120M

DeepSeek V4 Flash 0731 потратила 210M выходных токенов на прохождение индекса Artificial Analysis; Gemini 3.8 Flash (high) — 120M, то есть DeepSeek пишет в 1.75 раза больше. Artificial Analysis фиксирует, сколько выходных токенов каждая модель тратит на прохождение индекса. 120M у Gemini 3.8 Flash (high) AA помечает как «очень многословно» на фоне медианы 71M для сопоставимых моделей. 210M у DeepSeek V4 Flash 0731 — «в верхней части диапазона по сравнению с другими моделями с открытыми весами похожего размера (медиана: 110M)».

Обе разговорчивы, но DeepSeek — в 1.75 раза больше, и каждый из этих токенов тарифицируется по цене выхода. Скорость усугубляет дело: при 138 токенах в секунду DeepSeek нужно примерно в 2.2 раза больше времени, чем Gemini 3.8 Flash, чтобы выдать то же число токенов, а выдаёт она больше.

Конкретно по 3.8 Flash AA измерила рост среднего числа выходных токенов на задачу на 30% по сравнению с 3.7 Flash, до 48k, и рост стоимости задачи с $0.40 до $0.58 при высоком effort. Тот же прейскурант, счёт примерно на 45% выше (AA округляет до ~40%). Именно об этой цифре предупреждала Google.

Цена Gemini 3.8 Flash против цены DeepSeek V4 Flash: прейскурант, затем счёт

Сначала прейскурант. Доллары за миллион токенов:

$ за 1M токеновGemini 3.8 Flash (до 31 дек 2026)Gemini 3.8 Flash (с 1 янв 2027)DeepSeek V4 Flash, пикDeepSeek V4 Flash, вне пика
Вход0.751.500.440.22
Кэшированный вход0.0750.150.0140.007
Выход3.757.501.320.66

Пиковые часы DeepSeek — с 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу; всё остальное время — вне пика, ровно вдвое дешевле. Это окно — семь часов в сутки по будням, так что пакетная задача, которую можно запланировать, почти никогда не заплатит по пиковой колонке. Эти тарифы объявлены в записи журнала изменений DeepSeek от 13 августа 2026 года и вступили в силу 16 августа в 16:00 UTC; DeepSeek сообщила, что «введёт пиковое/внепиковое ценообразование, при котором внепиковые цены составляют половину цен пиковых часов». До этой даты V4 Flash стоила $0.14 за вход и $0.28 за выход, так что даже внепиковая колонка — это рост в 1.6–2.4 раза относительно стартовых цен.

Теперь счёт. Artificial Analysis заплатила $825.83 за полный прогон Intelligence Index на Gemini 3.8 Flash (high) и $323.26 на DeepSeek V4 Flash 0731 по $0.44 / $1.32, пиковому тарифу. На одном и том же наборе задач это разрыв в 2.6 раза за семь баллов.

AA также печатает стоимость задачи (Cost per Task), рассчитанную отдельно от суммы за индекс: $0.58 high, $0.41 medium и $0.24 low для Gemini 3.8 Flash и $0.11 для DeepSeek V4 Flash 0731 по её пиковому тарифу $0.44 / $1.32. Вне пика каждая строка DeepSeek делится на два, то есть примерно $0.055; это последнее число — наша арифметика, а не цифра, которую печатает AA. Две меры AA не сходятся в соотношении: 2.6 раза по сумме за индекс против 5.3 раза по стоимости задачи, так что цитируйте ту, что соответствует тому, как вы покупаете: итог по всей нагрузке или среднее на вызов.

Поставим модели с 52 баллами рядом:

При балле AA 52Стоимость задачи
Gemini 3.8 Flash (low)$0.24
DeepSeek V4 Flash 0731, пик или хост с фиксированным пиковым тарифом$0.11 (AA)
DeepSeek V4 Flash 0731, вне пика~$0.055 (расчёт)

При равном интеллекте DeepSeek стоит примерно вдвое дешевле за задачу даже по пиковому тарифу и примерно вчетверо вне пика. То, что Gemini 3.8 Flash при низком effort покупает за лишние $0.13, — это вывод примерно в 2.2 раза быстрее и вход в виде изображений, аудио, видео и файлов.

Кэширование и подорожание 2027 года

Кэширование. Gemini 3.8 Flash читает кэшированный вход по $0.075 — десятая часть свежего входа. DeepSeek читает попадание в кэш по $0.014 в пик, одна тридцать первая от промаха. Если у ваших промптов общий длинный префикс, кэш DeepSeek — самый дешёвый входной токен в обоих прейскурантах. Если нет, эта колонка вам не важна.

Обрыв 2027 года. 1 января 2027 года тарифы Gemini 3.8 Flash удваиваются, так что её лесенка $0.58 / $0.41 / $0.24 за задачу станет примерно $1.16 / $0.82 / $0.48, если число токенов не изменится. Страница цен DeepSeek не обещает ничего сверх фразы «Цены на продукты могут меняться, и DeepSeek оставляет за собой право их корректировать». Любая модель затрат на двенадцать месяцев должна включать обе эти строки.

Когда выбирать Gemini 3.8 Flash

  • Задаче нужно больше 53. Выше этой линии у DeepSeek вариантов нет.
  • На входе изображения, аудио, видео или PDF.
  • Важна задержка: ~302 токена в секунду и время на задачу по AA 0.8 минуты при низком effort против 2.5 при высоком.
  • Вы не можете подстроить трафик под семичасовое окно по UTC.

Когда выбирать DeepSeek V4 Flash 0731

  • 52 достаточно, и вы можете работать вне пика, или у ваших промптов общие длинные кэшированные префиксы.
  • Нужно 384K выходных токенов за один вызов.
  • Нужны открытые веса, чтобы позже разместить модель у себя.
  • Достаточно только текста. Сборка с изображениями — отдельная экспериментальная модель.

Когда не подходит ни одна

Если вы уже на Gemini 3.7 Flash и она справляется, Google сама говорит оставаться. 3.7 Flash набирает 56 за $0.40 на задачу AA; 3.8 Flash на medium — 57 за $0.41. Этот балл почти бесплатный, а переход на высокий effort ради 59 — нет, и 3.7 Flash остаётся полностью поддерживаемой. Подробности о ценах по уровням effort — в руководстве по API Gemini 3.7 Flash.

Если вы выбирали между DeepSeek V4 Flash и Gemini 3.6 Flash, прежнее сравнение по-прежнему верно на уровне 52; 3.8 Flash при низком effort присоединяется к этой ничьей по своим $0.75 / $3.75 и, по данным AA, со стоимостью задачи примерно на 30% ниже, чем у 3.6 Flash при высоком effort.

Попробуйте обе через Ofox: один эндпоинт, один ключ

DeepSeek V4 Flash 0731 есть в каталоге Ofox как deepseek/deepseek-v4-flash-0731 по $0.44 за вход, $1.32 за выход и $0.014 за чтение кэша за миллион токенов. Это те же цифры, что пиковый тариф DeepSeek, но фиксированные: внепикового окна на Ofox нет. А значит, применима именно строка с $0.11 за задачу по AA, измеренная ровно по этим тарифам; внепиковая строка — нет.

Gemini 3.8 Flash нет в каталоге Ofox по состоянию на 3 сентября 2026 года. google/gemini-3.7-flash есть — по $0.75 за вход и $3.75 за выход через провайдера Google (маршрут CloudVertex на той же странице модели — $1.50 / $7.50, и именно эту, большую, цифру сейчас отдаёт поле pricing в /v1/models), то есть по той же цене за токен, что у 3.8 Flash. Цикл ниже сегодня гоняет DeepSeek против 3.7 Flash; когда появится 3.8 Flash, это замена одной строки. Последнее слово о том, что можно вызвать, — за живым каталогом GET /v1/models.

from openai import OpenAI

client = OpenAI(base_url="https://api.ofox.io/v1", api_key="YOUR_OFOX_API_KEY")

MODELS = [
    "deepseek/deepseek-v4-flash-0731",
    "google/gemini-3.7-flash",   # заменить на google/gemini-3.8-flash, когда появится в каталоге
]

prompt = "Refactor this function to remove the nested loop. Return only code."

for model in MODELS:
    r = client.chat.completions.create(
        model=model,
        messages=[{"role": "user", "content": prompt}],
    )
    u = r.usage
    print(f"{model:36} in={u.prompt_tokens:6} out={u.completion_tokens:6}")

Логируйте completion_tokens, а не только задержку. Всё в этом тексте, что не является ценой из прейскуранта, сводится к этой колонке на вашем собственном трафике.

Источники

Цены, баллы индекса и число токенов проверены 3 сентября 2026 года. Наличие в каталоге Ofox проверено по живому эндпоинту /v1/models в тот же день; цены Ofox — со страниц моделей.

Часто задаваемые вопросы

Gemini 3.8 Flash лучше, чем DeepSeek V4 Flash?
По индексу Artificial Analysis Intelligence Index — да: Gemini 3.8 Flash набирает 59 при высоком effort, 57 при среднем (по умолчанию) и 52 при низком. DeepSeek V4 Flash 0731 набирает 52 при максимальном effort. В текущей линейке DeepSeek нет модели с 59; V4 Pro 0813 набирает 53. При низком effort Gemini 3.8 Flash и DeepSeek V4 Flash на этом индексе равны.
Сколько стоит Gemini 3.8 Flash по сравнению с DeepSeek V4 Flash?
По прейскуранту Gemini 3.8 Flash стоит $0.75 за миллион входных токенов и $3.75 за выходные до 31 декабря 2026 года, затем $1.50 и $7.50 с 1 января 2027-го. DeepSeek V4 Flash в пиковые часы стоит $0.44 за вход (промах кэша), $0.014 за попадание в кэш и $1.32 за выход, а вне пика — вдвое меньше. Artificial Analysis заплатила $825.83 за полный прогон Intelligence Index на Gemini 3.8 Flash (high) и $323.26 на DeepSeek V4 Flash 0731 — разница в 2.6 раза.
Почему реальная разница в стоимости меньше разницы в прейскуранте?
По сумме за индекс у AA разрыв 2.6 раза — меньше, чем соотношение цен на выход 2.8 раза, потому что DeepSeek V4 Flash 0731 пишет гораздо больше токенов: Artificial Analysis зафиксировала 210M выходных токенов у DeepSeek за весь индекс против 120M у Gemini 3.8 Flash, то есть в 1.75 раза больше. Отдельно рассчитанная AA стоимость задачи расширяет разрыв до 5.3 раза ($0.58 против $0.11). Скорость вывода раздвигает разрыв в другую сторону: около 302 токенов в секунду у Gemini 3.8 Flash против 138 у DeepSeek.
Gemini 3.8 Flash тратит больше токенов, чем 3.7 Flash?
Да. Google говорит, что 3.8 Flash «работает усерднее» и «может использовать больше токенов, чтобы максимизировать результат, особенно на более высоких уровнях effort». Artificial Analysis измерила рост среднего числа выходных токенов на задачу на 30%, до 48k, и рост стоимости задачи индекса с $0.40 у 3.7 Flash до $0.58 у 3.8 Flash при высоком effort — при одинаковых ценах за токен.
Можно ли вызвать обе модели через Ofox сегодня?
DeepSeek V4 Flash 0731 есть в каталоге Ofox как deepseek/deepseek-v4-flash-0731 по $0.44 за вход, $1.32 за выход и $0.014 за чтение кэша за миллион — те же цифры, что пиковый тариф DeepSeek, без внепикового окна. Gemini 3.8 Flash в каталоге нет по состоянию на 3 сентября 2026 года; google/gemini-3.7-flash есть, по тем же $0.75 / $3.75, что и у 3.8 Flash.