GLM 5.3 Flash
Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.
Vue d’ensemble
Cas d’usage recommandés et profil technique précis, issus du même enregistrement vérifié utilisé sur toute cette page.
Frequent implementation, terminal, debugging, and repository tasks that benefit from fast feedback and efficient inference.
Understand screenshots, charts, PDFs, presentations, spreadsheets, and rendered documents as part of multi-step workflows.
Use tools, inspect results, and iterate through research, file processing, content production, and business operations.
| ID du modèle | glm-5.3-flash | Fournisseur | Z.ai |
| Protocole | Compatible OPENAI | Disponibilité DIT | 1 route active |
| Entrée | Text, Image, Video, File | Sortie | Text |
| Fenêtre de contexte | 1 048 576 tokens | Sortie maximale | 163 840 tokens |
| Publication | 30 août 2026 | Limite des connaissances | Non publié |
| Endpoint | Chemin | État |
|---|---|---|
| Chat Completions | /v1/chat/completions | Pris en charge |
Fournisseurs
Comparez le routage du marché DIT à la référence officielle selon le prix, la vitesse et la disponibilité. L’identité des fournisseurs reste privée.
| Fournisseur | Entrée /M | Sortie /M | Lecture cache /M | Latence | Débit | Disponibilité |
|---|---|---|---|---|---|---|
Marché DIT 40% de moins Offre agrégée · 1 route active | —Données en attente | —Données en attente | —< 50 requêtes | |||
Officiel Z.ai Référence Fournisseur direct · prix catalogue vérifié | $0.15 | $0.5 | $0.03 | —Non publié | —Non publié | Non publiéAucune source d’état |
Prix en USD par million de tokens. Performances et disponibilité DIT apparaissent après 50 requêtes éligibles ; l’identité des fournisseurs et le trafic client restent privés.
Tarifs
Comparez directement les tarifs du marché DIT aux prix officiels vérifiés afin que les économies restent visibles et contrôlables.
| Usage | Officiel | Marché DIT | Économie | Base de facturation |
|---|---|---|---|---|
| Tokens d’entrée | $0.15 | $0.09 | ~40% | Par million de tokens |
| Tokens de sortie | $0.5 | $0.3 | ~40% | Par million de tokens |
| Entrée en cache | $0.03 | $0.018 | ~40% | Par million de tokens en cache |
Z.ai lists a temporary 50% promotional rate through September 9, 2026; comparisons on this page use the reviewed standard list price.
Performances
Latence, débit, activité et réussite des requêtes utilisent uniquement des agrégats DIT respectueux de la vie privée lorsque le seuil est atteint.
Métriques d’exécution DIT en attente
Benchmarks
Résultats d’évaluation vérifiés, avec notes de configuration et liens sources pour chaque score.
| Benchmark | Catégorie | Score | Configuration | Source |
|---|---|---|---|---|
| Terminal Bench 2.1 | Programmation | 84.3 | Official evaluation reported by Z.ai. | Source ↗ |
| DeepSWE v1.1 | Évaluation | 63.4 | Official coding-agent evaluation reported by Z.ai. | Source ↗ |
| Toolathlon Verified | Évaluation | 78.4 | Official tool-use evaluation reported by Z.ai. | Source ↗ |
| OfficeQA Pro | Évaluation | 62.4 | Official multimodal professional-work evaluation reported by Z.ai. | Source ↗ |
Démarrage rapide
Requête prête à copier pour l’endpoint DIT compatible avec l’identifiant vérifié du modèle.
curl https://api.dit.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [{"role":"user","content":"Explain dynamic model routing."}]
}'Sources
La provenance par champ permet de vérifier séparément tarifs, limites, capacités et benchmarks.
| Source | Type | Couvre | Vérifié |
|---|---|---|---|
| Z.ai GLM-5.3-Flash announcement ↗ | Officiel | Profil technique, Publication, Modalités, Capacités, Benchmarks | 1 sept. 2026 |
| Z.ai GLM-5.3-Flash model card ↗ | Hugging Face | Contexte, Sortie maximale, Effort de raisonnement, Endpoint | 1 sept. 2026 |
| Z.ai model pricing ↗ | Officiel | Tarifs | 1 sept. 2026 |
Les sources officielles sont prioritaires. Les métadonnées tierces ne sont conservées que si le champ et la date de vérification sont affichés.
Modèles similaires à GLM 5.3 Flash
Modèles vérifiés classés selon les capacités communes, la compatibilité du protocole et la similarité du contexte.
Questions fréquentes
Les réponses utilisent les mêmes faits et champs tarifaires vérifiés que les tableaux ci-dessus.
Qu’est-ce que GLM 5.3 Flash ?+
Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.
Combien coûte GLM 5.3 Flash ?+
Le tarif officiel vérifié est de $0,15 par million de tokens d’entrée et $0,5 par million de tokens de sortie. Le tarif DIT n’apparaît que lorsqu’une route DIT active existe.
Quelle est la longueur de contexte de GLM 5.3 Flash ?+
GLM 5.3 Flash prend en charge une fenêtre de contexte vérifiée de 1 048 576 tokens et jusqu’à 163 840 tokens de sortie.
Quelles capacités GLM 5.3 Flash prend-il en charge ?+
Les capacités vérifiées comprennent Reasoning, Tool calling, Visual understanding, Long context, Agentic workflows. Consultez la documentation officielle liée pour les limites propres à chaque endpoint.
Quelles entrées et sorties GLM 5.3 Flash prend-il en charge ?+
Modalités d’entrée vérifiées : Text, Image, Video, File. Modalités de sortie vérifiées : Text.
Quels endpoints API et niveaux de raisonnement GLM 5.3 Flash prend-il en charge ?+
GLM 5.3 Flash est documenté pour Chat Completions. L’effort de raisonnement peut être réglé sur low, high, max, avec max comme valeur par défaut documentée.
GLM 5.3 Flash est-il disponible sur DIT ?+
GLM 5.3 Flash dispose actuellement de 1 route active. DIT sélectionne l’offre éligible selon le prix et la santé, avec basculement automatique si une autre route est disponible.
Quand GLM 5.3 Flash a-t-il été publié ?+
GLM 5.3 Flash a été publié le 30 août 2026.