DeepSeek V4.1 Flash

Chat
deepseek/deepseek-v4.1-flash

DeepSeek V4.1 Flash is DeepSeek's latest efficiency-optimized Mixture-of-Experts model with a 1M-token context window and up to 384K output tokens. It adds native multimodal vision understanding, supports thinking mode (on by default), tool calls, JSON output and prompt caching, and per DeepSeek surpasses V4 Pro on quality, cost and speed. Served upstream under the official model id deepseek-flash.

Контекстное окно
1M
Макс. выходных токенов
384K
Дата релиза
2026-09-10
Возможности
ЗрениеFunction CallingРассуждениеКэширование промптов
Доступные провайдеры
DeepSeek
Поддерживаемые протоколы
openaianthropic

Providers

DeepSeek
Входные токены
$0.3/M
Выходные токены
$1.2/M
Чтение кэша
$0.006/M
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Примеры кода

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.io/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4.1-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Часто задаваемые вопросы

DeepSeek V4.1 Flash на Ofox.ai стоит $0.3/M за миллион входных токенов и $1.2/M за миллион выходных токенов. Оплата по потреблению, без абонплаты.