DeepSeek V4 Flash 0731

Chat
deepseek/deepseek-v4-flash-0731

DeepSeek V4 Flash 0731 est l'instantané daté du 2026-07-31 du modèle Mixture-of-Experts optimisé pour l'efficacité de DeepSeek, avec 284B de paramètres au total et 13B activés. Il est conçu pour l'inférence rapide et les charges à haut débit tout en restant solide sur les tâches de code et d'analyse. Il prend en charge l'appel d'outils et la mise en cache des prompts ; il n'expose pas de mode réflexion distinct. Fenêtre de contexte : 1M tokens, sortie : 384K. Ce plafond de sortie de 384K, inhabituellement élevé, convient aux travaux produisant de longs artefacts — réécritures de fichiers entiers, traduction en masse, rapports générés — en une seule réponse. Disponible via les protocoles compatible OpenAI et Anthropic chez Ofox.

Fenêtre de contexte
1M
Tokens de sortie max
384K
Publié
2026-07-31
Capacités
Function CallingPrompt Caching
Fournisseurs disponibles
VolcengineBedrock2
Protocoles supportés
openaianthropic

Providers

Bedrock2
Tokens d'entrée
$0.44/M
Tokens de sortie
$1.32/M
Lecture cache
$0.014/M
Protocols
openai/v1/chat/completions
Volcengine
Tokens d'entrée
$0.44/M
Tokens de sortie
$1.32/M
Lecture cache
$0.014/M
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Exemples de code

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.io/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash-0731",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Questions fréquentes

DeepSeek V4 Flash 0731 sur Ofox.ai coûte $0.44/M par million de tokens d'entrée et $1.32/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.