Z.ai: GLM-5.3-Flash
Chat-50%z-ai/glm-5.3-flashGLM-5.3-Flash 是 z.ai 国际站 (api.z.ai) 轻量高速模型, 原生多模态输入 (图片/视频), 面向高效编码与长程 agent 任务. 1M context, 常驻 thinking (不可关闭, 支持 low/high/max 三档 reasoning effort), 支持 prompt caching / tool calling / web search. 通过 OpenAI-compatible + Anthropic 双协议接入 (无 responses 端点).
Ventana de Contexto
1M
Tokens de Salida Máximos
131K
Lanzamiento
2026-08-26
Capacidades
VisiónFunction CallingRazonamientoPrompt CachingBúsqueda WebEntrada de Video
Proveedores Disponibles
Z.ai
Protocolos Soportados
openaianthropic
Providers
Z.ai
-50%Tokens de Entrada
$0.075/M
$0.15/M
Tokens de Salida
$0.25/M
$0.5/M
Lectura de Caché
$0.015/M
$0.03/M
Búsqueda Web
$0.01/R
Protocols
openai
/v1/chat/completionsanthropic
Ejemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.io/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5.3-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Disponibilidad y estado
Modelos Relacionados
Preguntas Frecuentes
Z.ai: GLM-5.3-Flash en Ofox.ai cuesta $0.15/M por millón de tokens de entrada y $0.5/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.
Z.ai: GLM-5.3-Flash soporta una ventana de contexto de 1M tokens con salida máxima de 131K tokens, permitiéndote procesar documentos extensos y mantener conversaciones largas.
Simplemente configura tu base URL a https://api.ofox.io/v1 y usa tu API key de Ofox. La API es compatible con OpenAI — solo cambia la base URL y la API key en tu código existente.
Z.ai: GLM-5.3-Flash soporta las siguientes capacidades: Visión, Function Calling, Razonamiento, Prompt Caching, Búsqueda Web, Entrada de Video. Accede a todas las funciones a través de la API unificada de Ofox.ai.