Qwen: Qwen3.5 Flash
Chatbailian/qwen3.5-flashQwen3.5-Flash 是阿里 Qwen3.5 系列的高速视觉语言模型,基于混合线性注意力与稀疏 MoE 架构,推理吞吐量高。纯文本与多模态能力相较 Qwen3 Flash 显著提升。上下文 1M tokens,输出 64K。支持 OpenAI 与 Anthropic 双协议。
上下文窗口
1M
最大输出 Token
64K
发布日期
2026-02-23
能力
视觉函数调用推理提示缓存视频输入
可用供应商
Aliyun
支持的协议
openaianthropic
供应商
Aliyun
输入 Token
$0.1/M
输出 Token
$0.4/M
缓存读取
$0.01/M
缓存写入
$0.125/M
网络搜索
$0.01/R
接入协议
openai
/v1/chat/completions/v1/responsesanthropic
代码示例
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.io/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="bailian/qwen3.5-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
第三方评测
LMArena ↗评测条目:qwen3.5-flash
Qwen: Qwen3.5 Flash 在 LMArena 文本榜单(风格控制) 综合类别中获得 1398 分,在 374 个模型中排名第 129,基于 53,387 次人类偏好投票(更新于 2026-07-12)。
| 类别 | Arena 分数 | 95% 置信区间 | 排名 | 投票数 |
|---|---|---|---|---|
| 综合 | 1398 | 1394–1402 | 第 129 / 374 名 | 53,387 |
| 困难任务 | 1415 | 1411–1420 | 第 134 / 374 名 | 34,166 |
| 编程 | 1437 | 1431–1443 | 第 134 / 369 名 | 15,155 |
| 数学 | 1404 | 1393–1416 | 第 117 / 362 名 | 2,952 |
| 创意写作 | 1339 | 1332–1347 | 第 155 / 372 名 | 8,270 |
| 指令遵循 | 1382 | 1376–1388 | 第 137 / 374 名 | 16,970 |
| 中文 | 1451 | 1438–1463 | 第 101 / 344 名 | 2,528 |
来源:LMArena · CC BY 4.0 · 更新于 2026-07-12 · 评测方法 ↗ · 排名为 LMArena 文本榜单(风格控制) 各类别内的比较,分数来自第三方人类偏好评测,并非 OFOX 官方评分。
相关模型
常见问题
Qwen: Qwen3.5 Flash 在 Ofox.ai 上的价格为输入 $0.1/M/百万 Token,输出 $0.4/M/百万 Token。按量计费,无月费。
Qwen: Qwen3.5 Flash 支持 1M Token 的上下文窗口,最大输出 64K Token,可处理大型文档并维持长对话。
只需将 base URL 设置为 https://api.ofox.io/v1,并使用你的 Ofox API Key。API 兼容 OpenAI 格式——只需更改 base URL 和 API Key 即可。
Qwen: Qwen3.5 Flash 支持以下能力:视觉, 函数调用, 推理, 提示缓存, 视频输入。通过 Ofox.ai 统一 API 访问所有功能。