GLM 5.3 Flash
Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.
Übersicht
Empfohlene Einsatzzwecke und ein präzises technisches Profil aus demselben geprüften Modelldatensatz, der auf dieser Seite verwendet wird.
Frequent implementation, terminal, debugging, and repository tasks that benefit from fast feedback and efficient inference.
Understand screenshots, charts, PDFs, presentations, spreadsheets, and rendered documents as part of multi-step workflows.
Use tools, inspect results, and iterate through research, file processing, content production, and business operations.
| Modell-ID | glm-5.3-flash | Anbieter | Z.ai |
| Protokoll | OPENAI-kompatibel | DIT-Verfügbarkeit | 1 aktive Route |
| Eingabe | Text, Image, Video, File | Ausgabe | Text |
| Kontextfenster | 1.048.576 Token | Maximale Ausgabe | 163.840 Token |
| Veröffentlicht | 30. Aug. 2026 | Wissensstand | Nicht veröffentlicht |
| Endpunkt | Pfad | Status |
|---|---|---|
| Chat Completions | /v1/chat/completions | Unterstützt |
Anbieter
DIT-Marktrouting und offizielle Upstream-Referenz nach Preis, Geschwindigkeit und Verfügbarkeit vergleichen. Lieferantenidentitäten bleiben privat.
| Anbieter | Eingabe /M | Ausgabe /M | Cache-Lesen /M | Latenz | Durchsatz | Verfügbarkeit |
|---|---|---|---|---|---|---|
DIT-Markt 40% günstiger Aggregiertes Angebot · 1 aktive Route | —Daten ausstehend | —Daten ausstehend | —< 50 Anfragen | |||
Z.ai offiziell Referenz Direkter Upstream · geprüfter Listenpreis | $0.15 | $0.5 | $0.03 | —Nicht veröffentlicht | —Nicht veröffentlicht | Nicht veröffentlichtKeine Statusquelle |
Preise in USD pro 1 Mio. Token. DIT-Leistung und Verfügbarkeit erscheinen erst nach 50 berechtigten Anfragen; Lieferantenidentitäten und Kundendaten bleiben privat.
Preise
DIT-Marktpreise direkt mit geprüften offiziellen Preisen vergleichen, damit Einsparungen sichtbar und prüfbar bleiben.
| Nutzung | Offiziell | DIT-Markt | Ersparnis | Abrechnungsbasis |
|---|---|---|---|---|
| Eingabe-Token | $0.15 | $0.09 | ~40% | Pro 1 Mio. Token |
| Ausgabe-Token | $0.5 | $0.3 | ~40% | Pro 1 Mio. Token |
| Zwischengespeicherte Eingabe | $0.03 | $0.018 | ~40% | Pro 1 Mio. Cache-Token |
Z.ai lists a temporary 50% promotional rate through September 9, 2026; comparisons on this page use the reviewed standard list price.
Leistung
Latenz, Durchsatz, Aktivität und Anfrageerfolg verwenden nur datenschutzsichere DIT-Laufzeitaggregate, sobald der Schwellenwert erreicht ist.
DIT-Laufzeitmetriken ausstehend
Benchmarks
Geprüfte Bewertungsergebnisse mit Konfigurationshinweisen und Quellenlink bei jedem Wert.
| Benchmark | Kategorie | Wert | Konfiguration | Quelle |
|---|---|---|---|---|
| Terminal Bench 2.1 | Programmierung | 84.3 | Official evaluation reported by Z.ai. | Quelle ↗ |
| DeepSWE v1.1 | Bewertung | 63.4 | Official coding-agent evaluation reported by Z.ai. | Quelle ↗ |
| Toolathlon Verified | Bewertung | 78.4 | Official tool-use evaluation reported by Z.ai. | Quelle ↗ |
| OfficeQA Pro | Bewertung | 62.4 | Official multimodal professional-work evaluation reported by Z.ai. | Quelle ↗ |
Schnellstart
Kopierfertige Anfrage an den kompatiblen DIT-Endpunkt mit der geprüften Modellkennung.
curl https://api.dit.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [{"role":"user","content":"Explain dynamic model routing."}]
}'Quellen
Herkunft auf Feldebene macht Preise, Limits, Funktionen und Benchmarks einzeln überprüfbar.
| Quelle | Typ | Deckt ab | Geprüft |
|---|---|---|---|
| Z.ai GLM-5.3-Flash announcement ↗ | Offiziell | Technisches Profil, Veröffentlicht, Modalitäten, Funktionen, Benchmarks | 1. Sept. 2026 |
| Z.ai GLM-5.3-Flash model card ↗ | Hugging Face | Kontext, Maximale Ausgabe, Reasoning-Stärke, Endpunkt | 1. Sept. 2026 |
| Z.ai model pricing ↗ | Offiziell | Preise | 1. Sept. 2026 |
Offizielle Quellen haben Vorrang. Metadaten Dritter bleiben nur erhalten, wenn Feld und Prüfdatum angezeigt werden.
Modelle ähnlich wie GLM 5.3 Flash
Geprüfte Modelle, sortiert nach Funktionsüberschneidung, Protokollkompatibilität und Kontextähnlichkeit.
Häufig gestellte Fragen
Die Antworten verwenden dieselben geprüften Fakten und Preisfelder wie die Tabellen oben.
Was ist GLM 5.3 Flash?+
Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.
Was kostet GLM 5.3 Flash?+
Der geprüfte offizielle Tarif beträgt $0,15 pro 1 Mio. Eingabe-Token und $0,5 pro 1 Mio. Ausgabe-Token. DIT-Preise werden nur bei einer aktiven DIT-Route angezeigt.
Wie lang ist der Kontext von GLM 5.3 Flash?+
GLM 5.3 Flash unterstützt ein geprüftes Kontextfenster von 1.048.576 Token und bis zu 163.840 Ausgabe-Token.
Welche Funktionen unterstützt GLM 5.3 Flash?+
Geprüfte Funktionen umfassen Reasoning, Tool calling, Visual understanding, Long context, Agentic workflows. Endpunktspezifische Limits stehen in der verlinkten offiziellen Dokumentation.
Welche Ein- und Ausgaben unterstützt GLM 5.3 Flash?+
Geprüfte Eingabemodalitäten: Text, Image, Video, File. Geprüfte Ausgabemodalitäten: Text.
Welche API-Endpunkte und Reasoning-Stufen unterstützt GLM 5.3 Flash?+
GLM 5.3 Flash ist für Chat Completions dokumentiert. Die Reasoning-Stärke kann auf low, high, max, dokumentierter Standard ist max gesetzt werden.
Ist GLM 5.3 Flash auf DIT verfügbar?+
GLM 5.3 Flash hat derzeit 1 aktive Route. DIT wählt berechtigtes Angebot nach Preis und Zustand und wechselt automatisch, wenn eine andere Route verfügbar ist.
Wann wurde GLM 5.3 Flash veröffentlicht?+
GLM 5.3 Flash wurde am 30. Aug. 2026 veröffentlicht.