DeepSeek V4.1 Flash API 怎么接?Python 和 curl 调用教程
用 deepseek-flash 调用 DeepSeek V4.1 Flash,核对 API 地址和模型 ID,运行 Python、curl 示例,并区分旧型号、账单与请求报错。
直连 DeepSeek V4.1 Flash API 时,使用 model="deepseek-flash",Base URL 为文档中的 https://api.deepseek.com。 产品展示名称与请求 ID 不是同一个字符串。第三方网关可能另有模型 ID 和凭据要求。
示例依据官方快速入门及 2026 年 9 月 10 日更新日志编写。这些是经过文档核对的配置示例,没有做付费端到端实测。实际执行生成请求可能消耗余额。
先确认账户和模型
从准备实际调用的供应商获取凭据。DeepSeek 直连 Key 配 DeepSeek 端点,Ofox Key 配 Ofox 文档指定的路由。不要把一家供应商的端点与另一家的 Key 组合使用。
以下示例将凭据保存在本地环境变量 DEEPSEEK_API_KEY 中,不要提交到代码仓库或打印到日志。deepseek-flash 发布说明解释了为什么底层模型变化后,旧 V4 Flash 名称仍可能被接受。
Python:先获得一次文本回复
在项目环境中运行 python -m pip install openai,安装官方 OpenAI Python 包,再通过其兼容客户端调用:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DEEPSEEK_API_KEY"],
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-flash",
messages=[{"role": "user", "content": "Reply with one short greeting."}],
max_tokens=128,
extra_body={"thinking": {"type": "disabled"}},
)
print(response.choices[0].message.content)
print(response.usage)
这里刻意不启用思考和工具,让第一次诊断请求保持简单。它不能展示推理 Agent 的成本或行为。基础请求成功后,再逐项加入所需能力,并核对对应文档参数。
curl:核对实际 HTTP 请求
curl --fail-with-body https://api.deepseek.com/chat/completions \
-H "Authorization: Bearer $DEEPSEEK_API_KEY" \
-H "Content-Type: application/json" \
--data '{"model":"deepseek-flash","messages":[{"role":"user","content":"Reply with one short greeting."}],"max_tokens":128,"thinking":{"type":"disabled"}}'
这份 JSON 表达的是同一个简单文本任务。命令失败时,保留脱敏后的错误正文;只看状态码,可能漏掉请求路由或账户错误。不要把包含认证头的详细请求记录直接贴进支持工单。
使用 JavaScript 时,对应的 OpenAI SDK 配置项是 baseURL,请求中的模型和 JSON 字段相同。应按已安装 SDK 的接口文档填写,不要机械照搬 Python 参数名称。
客户端与协议要匹配
| 客户端或操作 | 需要验证的内容 |
|---|---|
| Chat Completions | /chat/completions 与 messages 请求 |
| Codex / Responses | Responses 配置与模型目录元数据 |
| Claude Code / Anthropic 格式 | Anthropic 兼容基础路径与模型映射 |
| 图片理解 | 使用受支持的图片内容块,而非仅在普通字符串里写图片文件名 |
完整客户端要求见 Codex 配置教程或 Claude Code 配置教程。一次文本回复成功,不能验证工具循环、图片输入或流式解析器。
找不到模型或请求失败,怎么查?
先查请求发往哪里,再查准确 ID。旧客户端目录可能尚未收录 deepseek-flash;网关也可能使用另一个名称。不要把 expires-on-0910 测试配置当成正式模型约定。记录真实响应,不要假定各平台都会对未知模型返回相同错误码。
DeepSeek 的错误码文档区分了 401 认证失败、402 余额不足、400 请求格式、422 参数和 429 速率限制。确认是余额问题后,充值才与修复有关;充值不能修正错误请求正文或不支持的型号。对临时失败有计划地控制请求频率和重试,不要无限循环。
为批量调用充值前,先用价格与预算算例估算。选择 Ofox 时,先查模型目录和认证指南,明确目标路由与计费条件后再注册。本文直连示例不代表网关配置完全相同。
决定在哪个平台充值前,先按API 购买检查清单核对模型、协议与计费条件。
常见问题
- V4.1 Flash 的官方 API 模型 ID 是什么?
- 直连 DeepSeek API 时使用 deepseek-flash。网关可能使用不同 ID,应查看其自身目录。
- DeepSeek 的 Key 能配 Ofox 端点吗?
- 使用实际调用平台签发的凭据,不要把一家供应商的 Key 与另一家的端点混用。
- 文本调用成功,就代表 Codex 或 Claude Code 配好了吗?
- 不代表。这些客户端需要各自的协议和模型配置,还要验证实际需要的工具工作流。


