DeepSeek V4 Flash 0731

Chat
deepseek/deepseek-v4-flash-0731

DeepSeek V4 Flash 0731 es la instantánea fechada del 2026-07-31 del modelo de mezcla de expertos optimizado para eficiencia de DeepSeek, con 284B de parámetros totales y 13B activados. Está pensado para inferencia rápida y cargas de alto rendimiento, manteniéndose sólido en tareas de programación y análisis. Admite uso de herramientas y caché de prompts; no expone un modo de pensamiento separado. Ventana de contexto: 1M tokens, salida: 384K. El techo de salida de 384K, inusualmente alto, encaja con trabajos que emiten artefactos largos —reescrituras de archivos completos, traducción masiva, informes generados— en una sola respuesta. Disponible mediante los protocolos compatible con OpenAI y Anthropic a través de Ofox.

Ventana de Contexto
1M
Tokens de Salida Máximos
384K
Lanzamiento
2026-07-31
Capacidades
Function CallingPrompt Caching
Proveedores Disponibles
VolcengineBedrock2
Protocolos Soportados
openaianthropic

Providers

Bedrock2
Tokens de Entrada
$0.44/M
Tokens de Salida
$1.32/M
Lectura de Caché
$0.014/M
Protocols
openai/v1/chat/completions
Volcengine
Tokens de Entrada
$0.44/M
Tokens de Salida
$1.32/M
Lectura de Caché
$0.014/M
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Ejemplos de Código

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.io/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash-0731",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Preguntas Frecuentes

DeepSeek V4 Flash 0731 en Ofox.ai cuesta $0.44/M por millón de tokens de entrada y $1.32/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.