DeepSeek V4.1 Flash
Chatdeepseek/deepseek-v4.1-flashDeepSeek V4.1 Flash is DeepSeek's latest efficiency-optimized Mixture-of-Experts model with a 1M-token context window and up to 384K output tokens. It adds native multimodal vision understanding, supports thinking mode (on by default), tool calls, JSON output and prompt caching, and per DeepSeek surpasses V4 Pro on quality, cost and speed. Served upstream under the official model id deepseek-flash.
Janela de Contexto
1M
Tokens Máx de Saída
384K
Lançamento
2026-09-10
Capacidades
VisãoFunction CallingRaciocínioPrompt Caching
Provedores Disponíveis
DeepSeek
Protocolos Suportados
openaianthropic
Providers
DeepSeek
Tokens de Entrada
$0.3/M
Tokens de Saída
$1.2/M
Leitura de Cache
$0.006/M
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Exemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.io/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="deepseek/deepseek-v4.1-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Modelos Relacionados
Perguntas Frequentes
DeepSeek V4.1 Flash na Ofox.ai custa $0.3/M por milhão de tokens de entrada e $1.2/M por milhão de tokens de saída. Pague por uso, sem mensalidade.
DeepSeek V4.1 Flash suporta uma janela de contexto de 1M tokens com saída máxima de 384K tokens, permitindo processar documentos grandes e manter conversas longas.
Basta definir sua base URL como https://api.ofox.io/v1 e usar sua API key Ofox. A API é compatível com OpenAI — apenas mude a base URL e a API key no seu código existente.
DeepSeek V4.1 Flash suporta as seguintes capacidades: Visão, Function Calling, Raciocínio, Prompt Caching. Acesse todos os recursos pela API unificada Ofox.ai.