Modelos/Z.ai/GLM 5.3 Flash
Z.ai

GLM 5.3 Flash

z-ai/glm-5.3-flash
Disponível na DIT
Obter chave API

Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.

ModalidadesText + Image + Video + File Text
Entrada / saída DIT$0,09 / $0,3por 1 mi de tokens
Contexto1.05Mjanela de contexto revisada
Saída máxima163.8Ktokens por resposta
Lançamento30 de ago. de 2026Compatível com openai
Capacidades
Reasoning
Tool calling
Visual understanding
Long context
Agentic workflows

Visão geral

Casos de uso recomendados e perfil técnico preciso, gerados a partir do mesmo registro revisado usado em toda esta página.

Fast agentic coding

Frequent implementation, terminal, debugging, and repository tasks that benefit from fast feedback and efficient inference.

Uso recomendado
Visual document work

Understand screenshots, charts, PDFs, presentations, spreadsheets, and rendered documents as part of multi-step workflows.

Uso recomendado
Everyday automation

Use tools, inspect results, and iterate through research, file processing, content production, and business operations.

Uso recomendado
Perfil técnicoMetadados do modelo revisados
ID do modeloglm-5.3-flashProvedorZ.ai
ProtocoloCompatível com OPENAIDisponibilidade DIT
1 rota ativa
EntradaText, Image, Video, FileSaídaText
Janela de contexto1.048.576 tokensSaída máxima163.840 tokens
Lançamento30 de ago. de 2026Limite de conhecimentoNão publicado
Controles de raciocínio
Identificadores oficiais e esforço de raciocínio selecionável
Aliases
Nenhum alias publicado
Esforço de raciocínio
low
high
max
Padrão: max
Suporte oficial a ferramentas
Ferramentas próprias documentadas para este modelo
Function calling
Vision
Structured outputs
3 ferramentas documentadas
Endpoints de API compatíveisSuperfície oficial da API do modelo
EndpointCaminhoStatus
Chat Completions/v1/chat/completions
Compatível
Não compatívelLimitações explícitas na documentação oficial do modelo
Audio input
Audio output
Image output
Video output

Provedores

Compare o roteamento do mercado DIT com a referência oficial por preço, velocidade e disponibilidade. As identidades dos fornecedores permanecem privadas.

Cobertura do mercado1 rota ativa
Estratégia de seleçãoPreço + integridade + failover automático
Janela de execução30 dias
ProvedorEntrada /MSaída /MLeitura de cache /MLatênciaThroughputDisponibilidade
Mercado DIT
40% menos
Oferta agregada · 1 rota ativa
$0.15$0.09$0.5$0.3$0.03$0.018Aguardando dadosAguardando dados< 50 solicitações
Oficial da Z.ai
Referência
Upstream direto · preço de lista revisado
$0.15$0.5$0.03Não publicadoNão publicadoNão publicadoSem fonte de status

Preços em USD por 1 mi de tokens. Desempenho e disponibilidade DIT aparecem após 50 solicitações elegíveis; identidades de fornecedores e tráfego de clientes permanecem privados.

Preços

Compare diretamente as tarifas DIT com os preços oficiais revisados para manter a economia visível e verificável.

Comparação de preços atual
Tarifa efetiva DIT comparada ao preço oficial revisado.
Efetivo
USD / 1 mi de tokens
Até 40% menos
Comparação direta · preços padrão revisados por 1 mi de tokens
Composição do preço
Composição da tarifa efetiva DIT
$0,408tarifa combinada
Entrada em cacheEntradaSaída
Composição relativa, não participação estimada na fatura
Comparação de preçosFonte revisada ↗
UsoOficialMercado DITEconomiaBase de cobrança
Tokens de entrada$0.15$0.09~40%Por 1 mi de tokens
Tokens de saída$0.5$0.3~40%Por 1 mi de tokens
Entrada em cache$0.03$0.018~40%Por 1 mi de tokens em cache

Z.ai lists a temporary 50% promotional rate through September 9, 2026; comparisons on this page use the reviewed standard list price.

Desempenho

Latência, throughput, atividade e sucesso das solicitações usam agregados DIT com privacidade apenas quando o limite é atingido.

Benchmarks

Resultados de avaliação revisados com notas de configuração e links de fonte junto a cada pontuação.

Distribuição de benchmarks
Pontuações revisadas exatas em avaliações publicadas.
Escala de 0 a 100 quando a fonte publica índice ou porcentagem
Perfil de capacidades
Forma entre dimensões de benchmark revisadas
Terminal Bench 2.184.3DeepSWE v1.163.4Toolathlon Verified78.4OfficeQA Pro62.4
Somente forma do perfil; categorias não são calculadas em média
Avaliações revisadas4 resultados
BenchmarkCategoriaPontuaçãoConfiguraçãoFonte
Terminal Bench 2.1
Programação
84.3Official evaluation reported by Z.ai.Fonte ↗
DeepSWE v1.1
Avaliação
63.4Official coding-agent evaluation reported by Z.ai.Fonte ↗
Toolathlon Verified
Avaliação
78.4Official tool-use evaluation reported by Z.ai.Fonte ↗
OfficeQA Pro
Avaliação
62.4Official multimodal professional-work evaluation reported by Z.ai.Fonte ↗

Início rápido

Solicitação pronta para copiar para o endpoint DIT compatível usando o identificador revisado do modelo.

cURLCompatível com openai
curl https://api.dit.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{"role":"user","content":"Explain dynamic model routing."}]
  }'

Fontes

A procedência por campo permite revisar preços, limites, capacidades e benchmarks separadamente.

Fontes revisadas3 referências · revisado em 1 de set. de 2026
FonteTipoAbrangeVerificado
Z.ai GLM-5.3-Flash announcement
Oficial
Perfil técnico, Lançamento, Modalidades, Capacidades, Benchmarks1 de set. de 2026
Z.ai GLM-5.3-Flash model card
Hugging Face
Contexto, Saída máxima, Esforço de raciocínio, Endpoint1 de set. de 2026
Z.ai model pricing
Oficial
Preços1 de set. de 2026

Fontes oficiais têm prioridade. Metadados de terceiros são mantidos somente quando o campo e a data de revisão são exibidos.

Modelos semelhantes a GLM 5.3 Flash

Modelos revisados classificados por capacidades em comum, compatibilidade de protocolo e semelhança de contexto.

Perguntas frequentes

As respostas usam os mesmos fatos e campos de preço revisados apresentados nas tabelas acima.

O que é GLM 5.3 Flash?+

Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.

Quanto custa GLM 5.3 Flash?+

A tarifa oficial revisada é $0,15 por 1 mi de tokens de entrada e $0,5 por 1 mi de tokens de saída. O preço DIT só aparece quando existe uma rota DIT ativa.

Qual é o tamanho do contexto de GLM 5.3 Flash?+

GLM 5.3 Flash oferece uma janela de contexto revisada de 1.048.576 tokens e até 163.840 tokens de saída.

Quais capacidades GLM 5.3 Flash oferece?+

As capacidades revisadas incluem Reasoning, Tool calling, Visual understanding, Long context, Agentic workflows. Consulte a documentação oficial vinculada para limites específicos do endpoint.

Quais entradas e saídas GLM 5.3 Flash aceita?+

Modalidades de entrada revisadas: Text, Image, Video, File. Modalidades de saída revisadas: Text.

Quais endpoints de API e níveis de raciocínio GLM 5.3 Flash aceita?+

GLM 5.3 Flash está documentado para Chat Completions. O esforço de raciocínio pode ser definido como low, high, max, com max como padrão documentado.

GLM 5.3 Flash está disponível na DIT?+

GLM 5.3 Flash tem atualmente 1 rota ativa. A DIT seleciona oferta elegível por preço e integridade, com failover automático quando outra rota está disponível.

Quando GLM 5.3 Flash foi lançado?+

GLM 5.3 Flash foi lançado em 30 de ago. de 2026.