Z.ai: GLM-5.3-FlashX
Chat-59%z-ai/glm-5.3-flashxGLM-5.3-FlashX ist ein leichtgewichtiges Hochgeschwindigkeitsmodell des internationalen Angebots von z.ai (api.z.ai) für Coding und Long-Range-Agenten. Mit einer Inferenzgeschwindigkeit von bis zu 200 tokens/s sorgt es für ein schnelleres Modellerlebnis. Es bietet native Multimodalität (Bilder, Videos), 1M Kontext, stets aktiviertes Denken (nicht abschaltbar, unterstützt drei Stufen: low, max), Prompt-Aufrufe und Web Search sowie eine duale Anbindung über OpenAI und Anthropic (der Responses-Endpunkt wird nicht unterstützt).
Kontextfenster
1M
Max. Ausgabe-Tokens
131K
Veröffentlicht
2026-08-26
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheVideo-Eingabe
Verfügbare Anbieter
Z.ai
Unterstützte Protokolle
openaianthropic
Providers
Z.ai
provider.type: "zai"-59%
Eingabe-Tokens
$0.15/M
$0.37/M
Ausgabe-Tokens
$0.5/M
$1.25/M
Cache-Lesen
$0.03/M
$0.075/M
Websuche
$0.01/R
Protocols
openai
/v1/chat/completionsanthropic
Code-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.io/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5.3-flashx",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Verwandte Modelle
Häufig gestellte Fragen
Z.ai: GLM-5.3-FlashX auf Ofox.ai kostet $0.37/M pro Million Eingabe-Tokens und $1.25/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.
Z.ai: GLM-5.3-FlashX unterstützt ein Kontextfenster von 1M Tokens mit max. Ausgabe von 131K Tokens, was die Verarbeitung großer Dokumente und lange Konversationen ermöglicht.
Einfach Ihre Base-URL auf https://api.ofox.io/v1 setzen und Ihren Ofox API Key verwenden. Die API ist OpenAI-kompatibel — einfach Base-URL und API Key in Ihrem bestehenden Code ändern.
Z.ai: GLM-5.3-FlashX unterstützt folgende Fähigkeiten: Vision, Function Calling, Reasoning, Prompt Caching, Websuche, Video-Eingabe. Zugriff auf alle Features über die einheitliche Ofox.ai API.