Qwen: Qwen3.5 Flash
Chatbailian/qwen3.5-flashQwen3.5-Flash é o modelo vision-language otimizado para velocidade da série Qwen3.5 da Alibaba, usando design híbrido de linear attention e sparse MoE para alto throughput de inferência. Apresenta melhorias significativas sobre o Qwen3 Flash em tarefas de texto e multimodais. Context: 1M tokens, output: 64K. Disponível via protocolos OpenAI e Anthropic.
Providers
/v1/chat/completions/v1/responsesExemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.io/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="bailian/qwen3.5-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
Qwen: Qwen3.5 Flash obtém 1398 na categoria geral do ranking de texto do LMArena (controle de estilo), ficando em 129º de 374 modelos com base em 53.387 votos de preferência humana (atualizado em 2026-07-12).
| Categoria | Pontuação Arena | IC de 95% | Posição | Votos |
|---|---|---|---|---|
| Geral | 1398 | 1394–1402 | 129º de 374 | 53.387 |
| Prompts difíceis | 1415 | 1411–1420 | 134º de 374 | 34.166 |
| Programação | 1437 | 1431–1443 | 134º de 369 | 15.155 |
| Matemática | 1404 | 1393–1416 | 117º de 362 | 2.952 |
| Escrita criativa | 1339 | 1332–1347 | 155º de 372 | 8.270 |
| Seguimento de instruções | 1382 | 1376–1388 | 137º de 374 | 16.970 |
| Chinês | 1451 | 1438–1463 | 101º de 344 | 2.528 |
Fonte: LMArena · CC BY 4.0 · Atualizado em 2026-07-12 · Metodologia ↗ · As posições comparam modelos dentro de cada categoria do ranking de texto do LMArena (controle de estilo). As pontuações vêm de avaliações de preferência humana de terceiros, não da OFOX.