GLM 5.3 Flash
Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.
Resumen
Casos de uso recomendados y perfil técnico preciso, generados desde el mismo registro de modelo revisado que se usa en toda la página.
Frequent implementation, terminal, debugging, and repository tasks that benefit from fast feedback and efficient inference.
Understand screenshots, charts, PDFs, presentations, spreadsheets, and rendered documents as part of multi-step workflows.
Use tools, inspect results, and iterate through research, file processing, content production, and business operations.
| ID del modelo | glm-5.3-flash | Proveedor | Z.ai |
| Protocolo | Compatible con OPENAI | Disponibilidad en DIT | 1 ruta activa |
| Entrada | Text, Image, Video, File | Salida | Text |
| Ventana de contexto | 1.048.576 tokens | Salida máxima | 163.840 tokens |
| Lanzamiento | 30 ago 2026 | Corte de conocimiento | No publicado |
| Endpoint | Ruta | Estado |
|---|---|---|
| Chat Completions | /v1/chat/completions | Compatible |
Proveedores
Compara el enrutamiento del mercado DIT con la referencia oficial por precio, velocidad y disponibilidad. La identidad de los proveedores permanece privada.
| Proveedor | Entrada /M | Salida /M | Lectura de caché /M | Latencia | Rendimiento | Disponibilidad |
|---|---|---|---|---|---|---|
Mercado DIT 40% menos Oferta agregada · 1 ruta activa | —Datos pendientes | —Datos pendientes | —< 50 solicitudes | |||
Oficial de Z.ai Referencia Proveedor directo · precio de lista revisado | $0.15 | $0.5 | $0.03 | —No publicado | —No publicado | No publicadoSin fuente de estado |
Precios en USD por 1 M de tokens. El rendimiento y la disponibilidad de DIT aparecen tras 50 solicitudes aptas; la identidad de proveedores y el tráfico de clientes siguen siendo privados.
Precios
Compara directamente las tarifas del mercado DIT con los precios oficiales revisados para que el ahorro sea visible y verificable.
| Uso | Oficial | Mercado DIT | Ahorro | Base de facturación |
|---|---|---|---|---|
| Tokens de entrada | $0.15 | $0.09 | ~40% | Por 1 M de tokens |
| Tokens de salida | $0.5 | $0.3 | ~40% | Por 1 M de tokens |
| Entrada en caché | $0.03 | $0.018 | ~40% | Por 1 M de tokens en caché |
Z.ai lists a temporary 50% promotional rate through September 9, 2026; comparisons on this page use the reviewed standard list price.
Rendimiento
La latencia, el rendimiento, la actividad y el éxito de las solicitudes usan agregados de ejecución de DIT con privacidad solo al alcanzar el umbral.
Métricas de ejecución DIT pendientes
Pruebas
Resultados de evaluación revisados con notas de configuración y enlaces de fuente junto a cada puntuación.
| Prueba | Categoría | Puntuación | Configuración | Fuente |
|---|---|---|---|---|
| Terminal Bench 2.1 | Programación | 84.3 | Official evaluation reported by Z.ai. | Fuente ↗ |
| DeepSWE v1.1 | Evaluación | 63.4 | Official coding-agent evaluation reported by Z.ai. | Fuente ↗ |
| Toolathlon Verified | Evaluación | 78.4 | Official tool-use evaluation reported by Z.ai. | Fuente ↗ |
| OfficeQA Pro | Evaluación | 62.4 | Official multimodal professional-work evaluation reported by Z.ai. | Fuente ↗ |
Inicio rápido
Solicitud lista para copiar al endpoint compatible de DIT con el identificador revisado del modelo.
curl https://api.dit.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [{"role":"user","content":"Explain dynamic model routing."}]
}'Fuentes
La procedencia por campo permite revisar por separado precios, límites, capacidades y pruebas.
| Fuente | Tipo | Cubre | Comprobado |
|---|---|---|---|
| Z.ai GLM-5.3-Flash announcement ↗ | Oficial | Perfil técnico, Lanzamiento, Modalidades, Capacidades, Pruebas | 1 sept 2026 |
| Z.ai GLM-5.3-Flash model card ↗ | Hugging Face | Contexto, Salida máxima, Esfuerzo de razonamiento, Endpoint | 1 sept 2026 |
| Z.ai model pricing ↗ | Oficial | Precios | 1 sept 2026 |
Las fuentes oficiales tienen prioridad. Los metadatos de terceros solo se conservan cuando se muestran el campo y la fecha de revisión.
Modelos similares a GLM 5.3 Flash
Modelos revisados ordenados por capacidades compartidas, compatibilidad de protocolo y similitud de contexto.
Preguntas frecuentes
Las respuestas usan los mismos datos y campos de precios revisados que las tablas anteriores.
¿Qué es GLM 5.3 Flash?+
Z.ai's efficient native multimodal model for fast coding, visual understanding, tool use, automation, and long-horizon professional workflows.
¿Cuánto cuesta GLM 5.3 Flash?+
La tarifa oficial revisada es $0,15 por 1 M de tokens de entrada y $0,5 por 1 M de tokens de salida. El precio DIT solo aparece cuando existe una ruta DIT activa.
¿Cuál es la longitud de contexto de GLM 5.3 Flash?+
GLM 5.3 Flash admite una ventana de contexto revisada de 1.048.576 tokens y hasta 163.840 tokens de salida.
¿Qué capacidades admite GLM 5.3 Flash?+
Las capacidades revisadas incluyen Reasoning, Tool calling, Visual understanding, Long context, Agentic workflows. Consulta la documentación oficial enlazada para ver límites específicos de cada endpoint.
¿Qué entradas y salidas admite GLM 5.3 Flash?+
Modalidades de entrada revisadas: Text, Image, Video, File. Modalidades de salida revisadas: Text.
¿Qué endpoints de API y niveles de razonamiento admite GLM 5.3 Flash?+
GLM 5.3 Flash está documentado para Chat Completions. El esfuerzo de razonamiento puede configurarse en low, high, max, con max como valor predeterminado documentado.
¿Está GLM 5.3 Flash disponible en DIT?+
GLM 5.3 Flash tiene actualmente 1 ruta activa. DIT selecciona la oferta apta por precio y estado, con conmutación automática si hay otra ruta disponible.
¿Cuándo se lanzó GLM 5.3 Flash?+
GLM 5.3 Flash se lanzó el 30 ago 2026.