DeepSeek V4.1 Flash

Chat
deepseek/deepseek-v4.1-flash

DeepSeek V4.1 Flash is DeepSeek's latest efficiency-optimized Mixture-of-Experts model with a 1M-token context window and up to 384K output tokens. It adds native multimodal vision understanding, supports thinking mode (on by default), tool calls, JSON output and prompt caching, and per DeepSeek surpasses V4 Pro on quality, cost and speed. Served upstream under the official model id deepseek-flash.

上下文視窗
1M
最大輸出 Token
384K
發布日期
2026-09-10
能力
視覺函式呼叫推理提示快取
可用供應商
DeepSeek
支援的協定
openaianthropic

供应商

DeepSeek
輸入 Token
$0.3/M
輸出 Token
$1.2/M
快取讀取
$0.006/M
接入协议
openai/v1/chat/completions/v1/responses
anthropic

程式碼範例

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.io/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4.1-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

常見問題

DeepSeek V4.1 Flash 在 Ofox.ai 上的價格為輸入 $0.3/M/百萬 Token,輸出 $1.2/M/百萬 Token。按量計費,無月費。