DeepSeek V4.1 Flash

Chat
deepseek/deepseek-v4.1-flash

DeepSeek V4.1 Flash is DeepSeek's latest efficiency-optimized Mixture-of-Experts model with a 1M-token context window and up to 384K output tokens. It adds native multimodal vision understanding, supports thinking mode (on by default), tool calls, JSON output and prompt caching, and per DeepSeek surpasses V4 Pro on quality, cost and speed. Served upstream under the official model id deepseek-flash.

Ventana de Contexto
1M
Tokens de Salida Máximos
384K
Lanzamiento
2026-09-10
Capacidades
VisiónFunction CallingRazonamientoPrompt Caching
Proveedores Disponibles
DeepSeek
Protocolos Soportados
openaianthropic

Providers

DeepSeek
Tokens de Entrada
$0.3/M
Tokens de Salida
$1.2/M
Lectura de Caché
$0.006/M
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Ejemplos de Código

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.io/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4.1-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Preguntas Frecuentes

DeepSeek V4.1 Flash en Ofox.ai cuesta $0.3/M por millón de tokens de entrada y $1.2/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.