Modèles/Z.ai/GLM 5.3 Flash
Z.ai

GLM 5.3 Flash

z-ai/glm-5.3-flash
Disponible sur DIT
Obtenir une clé API

Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.

ModalitésText + Image + Video + File Text
Entrée / sortie DIT$0,09 / $0,3par million de tokens
Contexte1.05Mfenêtre de contexte vérifiée
Sortie max.163.8Ktokens par réponse
Publication30 août 2026Compatible openai
Capacités
Reasoning
Tool calling
Visual understanding
Long context
Agentic workflows

Vue d’ensemble

Cas d’usage recommandés et profil technique précis, issus du même enregistrement vérifié utilisé sur toute cette page.

Fast agentic coding

Frequent implementation, terminal, debugging, and repository tasks that benefit from fast feedback and efficient inference.

Usage recommandé
Visual document work

Understand screenshots, charts, PDFs, presentations, spreadsheets, and rendered documents as part of multi-step workflows.

Usage recommandé
Everyday automation

Use tools, inspect results, and iterate through research, file processing, content production, and business operations.

Usage recommandé
Profil techniqueMétadonnées du modèle vérifiées
ID du modèleglm-5.3-flashFournisseurZ.ai
ProtocoleCompatible OPENAIDisponibilité DIT
1 route active
EntréeText, Image, Video, FileSortieText
Fenêtre de contexte1 048 576 tokensSortie maximale163 840 tokens
Publication30 août 2026Limite des connaissancesNon publié
Contrôles de raisonnement
Identifiants officiels et effort de raisonnement sélectionnable
Alias
Aucun alias publié
Effort de raisonnement
low
high
max
Par défaut : max
Prise en charge officielle des outils
Outils propriétaires documentés pour ce modèle
Function calling
Vision
Structured outputs
3 outils documentés
Endpoints API pris en chargeSurface API officielle du modèle
EndpointCheminÉtat
Chat Completions/v1/chat/completions
Pris en charge
Non pris en chargeLimites explicites de la documentation officielle du modèle
Audio input
Audio output
Image output
Video output

Fournisseurs

Comparez le routage du marché DIT à la référence officielle selon le prix, la vitesse et la disponibilité. L’identité des fournisseurs reste privée.

Couverture du marché1 route active
Stratégie de sélectionPrix + santé + basculement automatique
Fenêtre d’exécution30 jours
FournisseurEntrée /MSortie /MLecture cache /MLatenceDébitDisponibilité
Marché DIT
40% de moins
Offre agrégée · 1 route active
$0.15$0.09$0.5$0.3$0.03$0.018Données en attenteDonnées en attente< 50 requêtes
Officiel Z.ai
Référence
Fournisseur direct · prix catalogue vérifié
$0.15$0.5$0.03Non publiéNon publiéNon publiéAucune source d’état

Prix en USD par million de tokens. Performances et disponibilité DIT apparaissent après 50 requêtes éligibles ; l’identité des fournisseurs et le trafic client restent privés.

Tarifs

Comparez directement les tarifs du marché DIT aux prix officiels vérifiés afin que les économies restent visibles et contrôlables.

Comparaison actuelle des prix
Tarif effectif DIT comparé au prix catalogue officiel vérifié.
Effectif
USD / million de tokens
Jusqu’à 40% de moins
Comparaison directe · prix standard vérifiés par million de tokens
Composition du prix
Composition du tarif effectif DIT
$0,408tarif combiné
Entrée en cacheEntréeSortie
Composition relative, pas une estimation de la part de facture
Comparaison des prixSource vérifiée ↗
UsageOfficielMarché DITÉconomieBase de facturation
Tokens d’entrée$0.15$0.09~40%Par million de tokens
Tokens de sortie$0.5$0.3~40%Par million de tokens
Entrée en cache$0.03$0.018~40%Par million de tokens en cache

Z.ai lists a temporary 50% promotional rate through September 9, 2026; comparisons on this page use the reviewed standard list price.

Performances

Latence, débit, activité et réussite des requêtes utilisent uniquement des agrégats DIT respectueux de la vie privée lorsque le seuil est atteint.

Benchmarks

Résultats d’évaluation vérifiés, avec notes de configuration et liens sources pour chaque score.

Distribution des benchmarks
Scores vérifiés exacts des évaluations publiées.
Échelle de 0 à 100 lorsque la source publie un indice ou un pourcentage
Profil de capacités
Forme selon les dimensions de benchmark vérifiées
Terminal Bench 2.184.3DeepSWE v1.163.4Toolathlon Verified78.4OfficeQA Pro62.4
Forme du profil uniquement ; les catégories ne sont pas moyennées
Évaluations vérifiées4 résultats
BenchmarkCatégorieScoreConfigurationSource
Terminal Bench 2.1
Programmation
84.3Official evaluation reported by Z.ai.Source ↗
DeepSWE v1.1
Évaluation
63.4Official coding-agent evaluation reported by Z.ai.Source ↗
Toolathlon Verified
Évaluation
78.4Official tool-use evaluation reported by Z.ai.Source ↗
OfficeQA Pro
Évaluation
62.4Official multimodal professional-work evaluation reported by Z.ai.Source ↗

Démarrage rapide

Requête prête à copier pour l’endpoint DIT compatible avec l’identifiant vérifié du modèle.

cURLCompatible openai
curl https://api.dit.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{"role":"user","content":"Explain dynamic model routing."}]
  }'

Sources

La provenance par champ permet de vérifier séparément tarifs, limites, capacités et benchmarks.

Sources vérifiées3 références · vérifié le 1 sept. 2026
SourceTypeCouvreVérifié
Z.ai GLM-5.3-Flash announcement
Officiel
Profil technique, Publication, Modalités, Capacités, Benchmarks1 sept. 2026
Z.ai GLM-5.3-Flash model card
Hugging Face
Contexte, Sortie maximale, Effort de raisonnement, Endpoint1 sept. 2026
Z.ai model pricing
Officiel
Tarifs1 sept. 2026

Les sources officielles sont prioritaires. Les métadonnées tierces ne sont conservées que si le champ et la date de vérification sont affichés.

Modèles similaires à GLM 5.3 Flash

Modèles vérifiés classés selon les capacités communes, la compatibilité du protocole et la similarité du contexte.

Questions fréquentes

Les réponses utilisent les mêmes faits et champs tarifaires vérifiés que les tableaux ci-dessus.

Qu’est-ce que GLM 5.3 Flash ?+

Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.

Combien coûte GLM 5.3 Flash ?+

Le tarif officiel vérifié est de $0,15 par million de tokens d’entrée et $0,5 par million de tokens de sortie. Le tarif DIT n’apparaît que lorsqu’une route DIT active existe.

Quelle est la longueur de contexte de GLM 5.3 Flash ?+

GLM 5.3 Flash prend en charge une fenêtre de contexte vérifiée de 1 048 576 tokens et jusqu’à 163 840 tokens de sortie.

Quelles capacités GLM 5.3 Flash prend-il en charge ?+

Les capacités vérifiées comprennent Reasoning, Tool calling, Visual understanding, Long context, Agentic workflows. Consultez la documentation officielle liée pour les limites propres à chaque endpoint.

Quelles entrées et sorties GLM 5.3 Flash prend-il en charge ?+

Modalités d’entrée vérifiées : Text, Image, Video, File. Modalités de sortie vérifiées : Text.

Quels endpoints API et niveaux de raisonnement GLM 5.3 Flash prend-il en charge ?+

GLM 5.3 Flash est documenté pour Chat Completions. L’effort de raisonnement peut être réglé sur low, high, max, avec max comme valeur par défaut documentée.

GLM 5.3 Flash est-il disponible sur DIT ?+

GLM 5.3 Flash dispose actuellement de 1 route active. DIT sélectionne l’offre éligible selon le prix et la santé, avec basculement automatique si une autre route est disponible.

Quand GLM 5.3 Flash a-t-il été publié ?+

GLM 5.3 Flash a été publié le 30 août 2026.