DeepSeek V4 Flash 0731
Chatdeepseek/deepseek-v4-flash-0731DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.
Ventana de Contexto
1M
Tokens de Salida Máximos
384K
Lanzamiento
2026-07-31
Capacidades
Function CallingPrompt Caching
Proveedores Disponibles
AliyunVolcengineAzure
Protocolos Soportados
openaianthropic
Providers
Aliyun
Tokens de Entrada
$0.44/M
Tokens de Salida
$1.32/M
Lectura de Caché
$0.014/M
Escritura de Caché
$0.55/M
Búsqueda Web
$0.01/R
Protocols
anthropic
Azure
Tokens de Entrada
$0.44/M
Tokens de Salida
$1.32/M
Lectura de Caché
$0.014/M
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Volcengine
Tokens de Entrada
$0.44/M
Tokens de Salida
$1.32/M
Lectura de Caché
$0.014/M
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Ejemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.io/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="deepseek/deepseek-v4-flash-0731",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Modelos Relacionados
Preguntas Frecuentes
DeepSeek V4 Flash 0731 en Ofox.ai cuesta $0.44/M por millón de tokens de entrada y $1.32/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.
DeepSeek V4 Flash 0731 soporta una ventana de contexto de 1M tokens con salida máxima de 384K tokens, permitiéndote procesar documentos extensos y mantener conversaciones largas.
Simplemente configura tu base URL a https://api.ofox.io/v1 y usa tu API key de Ofox. La API es compatible con OpenAI — solo cambia la base URL y la API key en tu código existente.
DeepSeek V4 Flash 0731 soporta las siguientes capacidades: Function Calling, Prompt Caching. Accede a todas las funciones a través de la API unificada de Ofox.ai.