Qwen: Qwen3.5 Flash
Chatbailian/qwen3.5-flashQwen3.5-Flash est le modèle vision-langage optimisé pour la vitesse dans la série Qwen3.5 d'Alibaba, utilisant une conception hybride alliant attention linéaire et MoE sparse pour un débit d'inférence élevé. Il présente des améliorations significatives par rapport à Qwen3 Flash sur les tâches texte et multimodales. Contexte : 1M tokens, sortie : 64K. Disponible via les protocoles OpenAI et Anthropic.
Providers
/v1/chat/completions/v1/responsesExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.io/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="bailian/qwen3.5-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
Qwen: Qwen3.5 Flash obtient 1398 dans la catégorie générale du classement texte LMArena (contrôle de style), se classant 129e sur 374 modèles sur la base de 53 387 votes de préférence humaine (mis à jour le 2026-07-12).
| Catégorie | Score Arena | IC à 95 % | Rang | Votes |
|---|---|---|---|---|
| Général | 1398 | 1394–1402 | 129e sur 374 | 53 387 |
| Prompts difficiles | 1415 | 1411–1420 | 134e sur 374 | 34 166 |
| Programmation | 1437 | 1431–1443 | 134e sur 369 | 15 155 |
| Mathématiques | 1404 | 1393–1416 | 117e sur 362 | 2 952 |
| Écriture créative | 1339 | 1332–1347 | 155e sur 372 | 8 270 |
| Suivi d'instructions | 1382 | 1376–1388 | 137e sur 374 | 16 970 |
| Chinois | 1451 | 1438–1463 | 101e sur 344 | 2 528 |
Source : LMArena · CC BY 4.0 · Mis à jour le 2026-07-12 · Méthodologie ↗ · Les rangs comparent les modèles au sein de chaque catégorie du classement texte LMArena (contrôle de style). Les scores proviennent d'évaluations de préférence humaine tierces, et non d'OFOX.