DeepSeek V4 Flash 0731

Chat
deepseek/deepseek-v4-flash-0731

O DeepSeek V4 Flash 0731 é o snapshot datado de 2026-07-31 do modelo Mixture-of-Experts otimizado para eficiência da DeepSeek, com 284B de parâmetros totais e 13B ativados. Foi construído para inferência rápida e cargas de alta vazão, mantendo-se forte em tarefas de programação e análise. Suporta uso de ferramentas e cache de prompts; não expõe um modo de pensamento separado. Janela de contexto: 1M tokens, saída: 384K. O teto de saída de 384K, incomumente alto, combina com trabalhos que emitem artefatos longos — reescritas de arquivos inteiros, tradução em massa, relatórios gerados — em uma única resposta. Disponível pelos protocolos compatíveis com OpenAI e Anthropic via Ofox.

Janela de Contexto
1M
Tokens Máx de Saída
384K
Lançamento
2026-07-31
Capacidades
Function CallingPrompt Caching
Provedores Disponíveis
Bedrock2Volcengine
Protocolos Suportados
openaianthropic

Providers

Bedrock2
Tokens de Entrada
$0.44/M
Tokens de Saída
$1.32/M
Leitura de Cache
$0.014/M
Protocols
openai/v1/chat/completions
Volcengine
Tokens de Entrada
$0.44/M
Tokens de Saída
$1.32/M
Leitura de Cache
$0.014/M
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Exemplos de Código

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.io/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash-0731",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Perguntas Frequentes

DeepSeek V4 Flash 0731 na Ofox.ai custa $0.44/M por milhão de tokens de entrada e $1.32/M por milhão de tokens de saída. Pague por uso, sem mensalidade.