Qwen: Qwen3.8 Flash
Chatbailian/qwen3.8-flash阿里云百炼 Qwen3.8 系列 Flash 轻量高速原生多模态模型, 1M context, 支持图像/视频理解与深度推理 (reasoning_content, 可按请求开关), 面向高并发低成本场景, 兼顾编程与办公任务. 通过 DashScope OpenAI-compatible 端点提供.
Kontextfenster
1M
Max. Ausgabe-Tokens
131K
Veröffentlicht
2026-08-25
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheVideo-Eingabe
Verfügbare Anbieter
Aliyun
Unterstützte Protokolle
openaianthropic
Providers
Aliyun
Eingabe-Tokens
$0.15/M
Ausgabe-Tokens
$0.47/M
Cache-Lesen
$0.016/M
Cache-Schreiben
$0.2/M
Websuche
$0.01/R
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Code-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.io/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="bailian/qwen3.8-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Verfügbarkeit & Status
Verwandte Modelle
Häufig gestellte Fragen
Qwen: Qwen3.8 Flash auf Ofox.ai kostet $0.15/M pro Million Eingabe-Tokens und $0.47/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.
Qwen: Qwen3.8 Flash unterstützt ein Kontextfenster von 1M Tokens mit max. Ausgabe von 131K Tokens, was die Verarbeitung großer Dokumente und lange Konversationen ermöglicht.
Einfach Ihre Base-URL auf https://api.ofox.io/v1 setzen und Ihren Ofox API Key verwenden. Die API ist OpenAI-kompatibel — einfach Base-URL und API Key in Ihrem bestehenden Code ändern.
Qwen: Qwen3.8 Flash unterstützt folgende Fähigkeiten: Vision, Function Calling, Reasoning, Prompt Caching, Websuche, Video-Eingabe. Zugriff auf alle Features über die einheitliche Ofox.ai API.