20% en todo GPT 🎉 30% en DeepSeekMás info

Z.ai: GLM-5.3-FlashX

Chat-59%
z-ai/glm-5.3-flashx

GLM-5.3-FlashX es el modelo ligero y de alta velocidad de z.ai en su sitio internacional (api.z.ai), orientado a la codificación eficiente y a tareas de Agent de largo recorrido, con una velocidad de inferencia de hasta 200 tokens/s que ofrece una experiencia de modelo más rápida y fluida. Admite entrada multimodal nativa (imágenes, vídeo), contexto de 1M, thinking permanente (no se puede desactivar y ofrece tres niveles de reasoning effort: low, high y max), prompt caching, tool calling y web search, y se integra mediante los protocolos OpenAI-compatible y Anthropic (no admite el endpoint Responses).

Ventana de Contexto
1M
Tokens de Salida Máximos
131K
Lanzamiento
2026-08-26
Capacidades
VisiónFunction CallingRazonamientoPrompt CachingBúsqueda WebEntrada de Video
Proveedores Disponibles
Z.ai
Protocolos Soportados
openaianthropic

Providers

Z.aiprovider.type: "zai"
-59%
Tokens de Entrada
$0.15/M
$0.37/M
Tokens de Salida
$0.5/M
$1.25/M
Lectura de Caché
$0.03/M
$0.075/M
Búsqueda Web
$0.01/R
Protocols
openai/v1/chat/completions
anthropic

Ejemplos de Código

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.io/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="z-ai/glm-5.3-flashx",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Preguntas Frecuentes

Z.ai: GLM-5.3-FlashX en Ofox.ai cuesta $0.37/M por millón de tokens de entrada y $1.25/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.