Modelle/Z.ai/GLM 5.3 Flash
Z.ai

GLM 5.3 Flash

z-ai/glm-5.3-flash
Auf DIT verfügbar
API-Key erhalten

Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.

ModalitätenText + Image + Video + File Text
DIT Ein / Aus$0,09 / $0,3pro 1 Mio. Token
Kontext1.05Mgeprüftes Kontextfenster
Max. Ausgabe163.8KToken pro Antwort
Veröffentlicht30. Aug. 2026openai-kompatibel
Funktionen
Reasoning
Tool calling
Visual understanding
Long context
Agentic workflows

Übersicht

Empfohlene Einsatzzwecke und ein präzises technisches Profil aus demselben geprüften Modelldatensatz, der auf dieser Seite verwendet wird.

Fast agentic coding

Frequent implementation, terminal, debugging, and repository tasks that benefit from fast feedback and efficient inference.

Empfohlener Einsatz
Visual document work

Understand screenshots, charts, PDFs, presentations, spreadsheets, and rendered documents as part of multi-step workflows.

Empfohlener Einsatz
Everyday automation

Use tools, inspect results, and iterate through research, file processing, content production, and business operations.

Empfohlener Einsatz
Technisches ProfilGeprüfte Modellmetadaten
Modell-IDglm-5.3-flashAnbieterZ.ai
ProtokollOPENAI-kompatibelDIT-Verfügbarkeit
1 aktive Route
EingabeText, Image, Video, FileAusgabeText
Kontextfenster1.048.576 TokenMaximale Ausgabe163.840 Token
Veröffentlicht30. Aug. 2026WissensstandNicht veröffentlicht
Reasoning-Steuerung
Offizielle Kennungen und wählbare Reasoning-Stärke
Aliasse
Kein Alias veröffentlicht
Reasoning-Stärke
low
high
max
Standard: max
Offizielle Tool-Unterstützung
Für dieses Modell dokumentierte Erstanbieter-Tools
Function calling
Vision
Structured outputs
3 dokumentierte Tools
Unterstützte API-EndpunkteOffizielle Modell-API
EndpunktPfadStatus
Chat Completions/v1/chat/completions
Unterstützt
Nicht unterstütztExplizite Einschränkungen in der offiziellen Modelldokumentation
Audio input
Audio output
Image output
Video output

Anbieter

DIT-Marktrouting und offizielle Upstream-Referenz nach Preis, Geschwindigkeit und Verfügbarkeit vergleichen. Lieferantenidentitäten bleiben privat.

Marktabdeckung1 aktive Route
AuswahlstrategiePreis + Zustand + automatisches Failover
Laufzeitfenster30 Tage
AnbieterEingabe /MAusgabe /MCache-Lesen /MLatenzDurchsatzVerfügbarkeit
DIT-Markt
40% günstiger
Aggregiertes Angebot · 1 aktive Route
$0.15$0.09$0.5$0.3$0.03$0.018Daten ausstehendDaten ausstehend< 50 Anfragen
Z.ai offiziell
Referenz
Direkter Upstream · geprüfter Listenpreis
$0.15$0.5$0.03Nicht veröffentlichtNicht veröffentlichtNicht veröffentlichtKeine Statusquelle

Preise in USD pro 1 Mio. Token. DIT-Leistung und Verfügbarkeit erscheinen erst nach 50 berechtigten Anfragen; Lieferantenidentitäten und Kundendaten bleiben privat.

Preise

DIT-Marktpreise direkt mit geprüften offiziellen Preisen vergleichen, damit Einsparungen sichtbar und prüfbar bleiben.

Aktueller Preisvergleich
Effektiven DIT-Tarif mit dem geprüften offiziellen Listenpreis vergleichen.
Effektiv
USD / 1 Mio. Token
Bis zu 40% günstiger
Direkter Tarifvergleich · geprüfte Standardpreise pro 1 Mio. Token
Preiszusammensetzung
DIT-Effektivtarif
$0,408Kombinierter Tarif
Zwischengespeicherte EingabeEingabeAusgabe
Relative Preiszusammensetzung, kein geschätzter Rechnungsanteil
PreisvergleichGeprüfte Quelle ↗
NutzungOffiziellDIT-MarktErsparnisAbrechnungsbasis
Eingabe-Token$0.15$0.09~40%Pro 1 Mio. Token
Ausgabe-Token$0.5$0.3~40%Pro 1 Mio. Token
Zwischengespeicherte Eingabe$0.03$0.018~40%Pro 1 Mio. Cache-Token

Z.ai lists a temporary 50% promotional rate through September 9, 2026; comparisons on this page use the reviewed standard list price.

Leistung

Latenz, Durchsatz, Aktivität und Anfrageerfolg verwenden nur datenschutzsichere DIT-Laufzeitaggregate, sobald der Schwellenwert erreicht ist.

Benchmarks

Geprüfte Bewertungsergebnisse mit Konfigurationshinweisen und Quellenlink bei jedem Wert.

Benchmark-Verteilung
Exakte geprüfte Werte veröffentlichter Bewertungen.
Skala 0–100, wenn die Quelle einen Index oder Prozentsatz veröffentlicht
Fähigkeitsprofil
Form über geprüfte Benchmark-Dimensionen
Terminal Bench 2.184.3DeepSWE v1.163.4Toolathlon Verified78.4OfficeQA Pro62.4
Nur Profilform; Benchmark-Kategorien werden nicht gemittelt
Geprüfte Bewertungen4 Ergebnisse
BenchmarkKategorieWertKonfigurationQuelle
Terminal Bench 2.1
Programmierung
84.3Official evaluation reported by Z.ai.Quelle ↗
DeepSWE v1.1
Bewertung
63.4Official coding-agent evaluation reported by Z.ai.Quelle ↗
Toolathlon Verified
Bewertung
78.4Official tool-use evaluation reported by Z.ai.Quelle ↗
OfficeQA Pro
Bewertung
62.4Official multimodal professional-work evaluation reported by Z.ai.Quelle ↗

Schnellstart

Kopierfertige Anfrage an den kompatiblen DIT-Endpunkt mit der geprüften Modellkennung.

cURLopenai-kompatibel
curl https://api.dit.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{"role":"user","content":"Explain dynamic model routing."}]
  }'

Quellen

Herkunft auf Feldebene macht Preise, Limits, Funktionen und Benchmarks einzeln überprüfbar.

Geprüfte Quellen3 Referenzen · geprüft am 1. Sept. 2026
QuelleTypDeckt abGeprüft
Z.ai GLM-5.3-Flash announcement
Offiziell
Technisches Profil, Veröffentlicht, Modalitäten, Funktionen, Benchmarks1. Sept. 2026
Z.ai GLM-5.3-Flash model card
Hugging Face
Kontext, Maximale Ausgabe, Reasoning-Stärke, Endpunkt1. Sept. 2026
Z.ai model pricing
Offiziell
Preise1. Sept. 2026

Offizielle Quellen haben Vorrang. Metadaten Dritter bleiben nur erhalten, wenn Feld und Prüfdatum angezeigt werden.

Modelle ähnlich wie GLM 5.3 Flash

Geprüfte Modelle, sortiert nach Funktionsüberschneidung, Protokollkompatibilität und Kontextähnlichkeit.

Häufig gestellte Fragen

Die Antworten verwenden dieselben geprüften Fakten und Preisfelder wie die Tabellen oben.

Was ist GLM 5.3 Flash?+

Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.

Was kostet GLM 5.3 Flash?+

Der geprüfte offizielle Tarif beträgt $0,15 pro 1 Mio. Eingabe-Token und $0,5 pro 1 Mio. Ausgabe-Token. DIT-Preise werden nur bei einer aktiven DIT-Route angezeigt.

Wie lang ist der Kontext von GLM 5.3 Flash?+

GLM 5.3 Flash unterstützt ein geprüftes Kontextfenster von 1.048.576 Token und bis zu 163.840 Ausgabe-Token.

Welche Funktionen unterstützt GLM 5.3 Flash?+

Geprüfte Funktionen umfassen Reasoning, Tool calling, Visual understanding, Long context, Agentic workflows. Endpunktspezifische Limits stehen in der verlinkten offiziellen Dokumentation.

Welche Ein- und Ausgaben unterstützt GLM 5.3 Flash?+

Geprüfte Eingabemodalitäten: Text, Image, Video, File. Geprüfte Ausgabemodalitäten: Text.

Welche API-Endpunkte und Reasoning-Stufen unterstützt GLM 5.3 Flash?+

GLM 5.3 Flash ist für Chat Completions dokumentiert. Die Reasoning-Stärke kann auf low, high, max, dokumentierter Standard ist max gesetzt werden.

Ist GLM 5.3 Flash auf DIT verfügbar?+

GLM 5.3 Flash hat derzeit 1 aktive Route. DIT wählt berechtigtes Angebot nach Preis und Zustand und wechselt automatisch, wenn eine andere Route verfügbar ist.

Wann wurde GLM 5.3 Flash veröffentlicht?+

GLM 5.3 Flash wurde am 30. Aug. 2026 veröffentlicht.