Modelli/Z.ai/GLM 5.3 Flash
Z.ai

GLM 5.3 Flash

z-ai/glm-5.3-flash
Disponibile su DIT
Ottieni una chiave API

Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.

ModalitàText + Image + Video + File Text
Input / output DIT$0,09 / $0,3per 1 M di token
Contesto1.05Mfinestra di contesto verificata
Output massimo163.8Ktoken per risposta
Rilascio30 ago 2026Compatibile con openai
Capacità
Reasoning
Tool calling
Visual understanding
Long context
Agentic workflows

Panoramica

Casi d’uso consigliati e profilo tecnico preciso, generati dallo stesso record verificato usato in tutta la pagina.

Fast agentic coding

Frequent implementation, terminal, debugging, and repository tasks that benefit from fast feedback and efficient inference.

Uso consigliato
Visual document work

Understand screenshots, charts, PDFs, presentations, spreadsheets, and rendered documents as part of multi-step workflows.

Uso consigliato
Everyday automation

Use tools, inspect results, and iterate through research, file processing, content production, and business operations.

Uso consigliato
Profilo tecnicoMetadati modello verificati
ID modelloglm-5.3-flashProviderZ.ai
ProtocolloCompatibile con OPENAIDisponibilità DIT
1 route attiva
InputText, Image, Video, FileOutputText
Finestra di contesto1.048.576 tokenOutput massimo163.840 token
Rilascio30 ago 2026Cutoff conoscenzeNon pubblicato
Controlli di ragionamento
Identificatori ufficiali e intensità di ragionamento selezionabile
Alias
Nessun alias pubblicato
Intensità di ragionamento
low
high
max
Predefinito: max
Supporto strumenti ufficiale
Strumenti proprietari documentati per questo modello
Function calling
Vision
Structured outputs
3 strumenti documentati
Endpoint API supportatiSuperficie API ufficiale del modello
EndpointPercorsoStato
Chat Completions/v1/chat/completions
Supportato
Non supportatoLimitazioni esplicite nella documentazione ufficiale del modello
Audio input
Audio output
Image output
Video output

Provider

Confronta il routing del mercato DIT con il riferimento ufficiale per prezzo, velocità e disponibilità. L’identità dei fornitori resta privata.

Copertura del mercato1 route attiva
Strategia di selezionePrezzo + stato + failover automatico
Finestra runtime30 giorni
ProviderInput /MOutput /MLettura cache /MLatenzaThroughputDisponibilità
Mercato DIT
40% in meno
Offerta aggregata · 1 route attiva
$0.15$0.09$0.5$0.3$0.03$0.018Dati in attesaDati in attesa< 50 richieste
Z.ai ufficiale
Riferimento
Upstream diretto · prezzo di listino verificato
$0.15$0.5$0.03Non pubblicatoNon pubblicatoNon pubblicatoNessuna fonte di stato

Prezzi in USD per 1 M di token. Prestazioni e disponibilità DIT compaiono dopo 50 richieste idonee; identità dei fornitori e traffico clienti restano privati.

Prezzi

Confronta direttamente le tariffe DIT con i prezzi ufficiali verificati per rendere il risparmio visibile e controllabile.

Confronto prezzi attuale
Tariffa effettiva DIT confrontata con il prezzo ufficiale verificato.
Effettivo
USD / 1 M di token
Fino al 40% in meno
Confronto diretto · prezzi standard verificati per 1 M di token
Composizione del prezzo
Composizione tariffa effettiva DIT
$0,408tariffa combinata
Input in cacheInputOutput
Composizione relativa, non quota stimata della fattura
Confronto prezziFonte verificata ↗
UtilizzoUfficialeMercato DITRisparmioBase di fatturazione
Token di input$0.15$0.09~40%Per 1 M di token
Token di output$0.5$0.3~40%Per 1 M di token
Input in cache$0.03$0.018~40%Per 1 M di token in cache

Z.ai lists a temporary 50% promotional rate through September 9, 2026; comparisons on this page use the reviewed standard list price.

Prestazioni

Latenza, throughput, attività e successo delle richieste usano aggregati runtime DIT rispettosi della privacy solo al raggiungimento della soglia.

Benchmark

Risultati di valutazione verificati con note di configurazione e link alla fonte per ogni punteggio.

Distribuzione benchmark
Punteggi verificati esatti delle valutazioni pubblicate.
Scala 0–100 quando la fonte pubblica un indice o una percentuale
Profilo capacità
Forma tra le dimensioni benchmark verificate
Terminal Bench 2.184.3DeepSWE v1.163.4Toolathlon Verified78.4OfficeQA Pro62.4
Solo forma del profilo; le categorie non sono mediate
Valutazioni verificate4 risultati
BenchmarkCategoriaPunteggioConfigurazioneFonte
Terminal Bench 2.1
Programmazione
84.3Official evaluation reported by Z.ai.Fonte ↗
DeepSWE v1.1
Valutazione
63.4Official coding-agent evaluation reported by Z.ai.Fonte ↗
Toolathlon Verified
Valutazione
78.4Official tool-use evaluation reported by Z.ai.Fonte ↗
OfficeQA Pro
Valutazione
62.4Official multimodal professional-work evaluation reported by Z.ai.Fonte ↗

Avvio rapido

Richiesta pronta da copiare per l’endpoint DIT compatibile usando l’identificatore verificato del modello.

cURLCompatibile con openai
curl https://api.dit.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{"role":"user","content":"Explain dynamic model routing."}]
  }'

Fonti

La provenienza per campo rende prezzi, limiti, capacità e benchmark verificabili separatamente.

Fonti verificate3 riferimenti · verificato il 1 set 2026
FonteTipoCopreControllato
Z.ai GLM-5.3-Flash announcement
Ufficiale
Profilo tecnico, Rilascio, Modalità, Capacità, Benchmark1 set 2026
Z.ai GLM-5.3-Flash model card
Hugging Face
Contesto, Output massimo, Intensità di ragionamento, Endpoint1 set 2026
Z.ai model pricing
Ufficiale
Prezzi1 set 2026

Le fonti ufficiali hanno priorità. I metadati di terze parti sono conservati solo quando sono mostrati campo e data di verifica.

Modelli simili a GLM 5.3 Flash

Modelli verificati ordinati per capacità condivise, compatibilità del protocollo e somiglianza del contesto.

Domande frequenti

Le risposte usano gli stessi dati e campi prezzo verificati mostrati nelle tabelle sopra.

Che cos’è GLM 5.3 Flash?+

Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.

Quanto costa GLM 5.3 Flash?+

La tariffa ufficiale verificata è $0,15 per 1 M di token di input e $0,5 per 1 M di token di output. Il prezzo DIT è mostrato solo quando esiste una route DIT attiva.

Qual è la lunghezza del contesto di GLM 5.3 Flash?+

GLM 5.3 Flash supporta una finestra di contesto verificata di 1.048.576 token e fino a 163.840 token di output.

Quali capacità supporta GLM 5.3 Flash?+

Le capacità verificate includono Reasoning, Tool calling, Visual understanding, Long context, Agentic workflows. Consulta la documentazione ufficiale collegata per i limiti specifici degli endpoint.

Quali input e output supporta GLM 5.3 Flash?+

Modalità di input verificate: Text, Image, Video, File. Modalità di output verificate: Text.

Quali endpoint API e livelli di ragionamento supporta GLM 5.3 Flash?+

GLM 5.3 Flash è documentato per Chat Completions. L’intensità di ragionamento può essere impostata su low, high, max, con max come valore predefinito documentato.

GLM 5.3 Flash è disponibile su DIT?+

GLM 5.3 Flash dispone attualmente di 1 route attiva. DIT seleziona l’offerta idonea per prezzo e stato, con failover automatico quando è disponibile un’altra route.

Quando è stato rilasciato GLM 5.3 Flash?+

GLM 5.3 Flash è stato rilasciato il 30 ago 2026.