GLM-5.3-Flash: cuánto cuesta usarlo
El precio de GLM-5.3-Flash publicado por Z.ai, cuánto cuestan con él una respuesta de soporte, el resumen de un documento y una tarea de agente, y qué posición ocupa entre 37 modelos.
Dólares estadounidenses por millón de tokens, tarifa estándar, tramo de contexto más corto.
- 1,000 respuestas de soporte
- $0.65
- Entrada en caché
- $0.03
- Ventana de contexto
- 1.000.000 tokens
- Lanzamiento
- 26 ago 2026
- Pesos
- Abrir
Según las páginas de Z.ai, 22 de septiembre de 2026.
En la API de Z.ai, GLM-5.3-Flash cuesta $0.15 por millón de tokens de entrada, $0.50 por millón de tokens de salida y $0.03 por millón de tokens de entrada en caché. A esos precios, 1,000 respuestas de soporte cuestan $0.65, lo que lo sitúa en el puesto el puesto el 2º más barato entre 33 modelos con precio publicado de nuestra lista.
Cuánto cuesta una tarea
Tres tareas, 1,000 ejecuciones de cada una al precio de lista indicado arriba, y la posición que ocupa GLM-5.3-Flash en cada caso entre los 33 modelos con precio de lista.
| Tarea | 1,000 ejecuciones | Entre 33 |
|---|---|---|
| Respuesta de soporte3,000 de entrada, 400 de salida. | $0.65 | el 2º más barato |
| Resumen de un documento25,000 de entrada, 1,000 de salida. | $4.25 | el 2º más barato |
| Tarea de agente80,000 de entrada (70,000 en caché), 3,000 de salida. | $5.10 | el más barato |
Las cantidades de tokens las hemos elegido nosotros para representar tareas reales; los precios son los de Z.ai. Las tres tareas usan menos de 200,000 tokens por solicitud, por debajo de todos los umbrales de recargo por contexto largo de la lista.
GLM-5.3-Flash en tareas reales de pequeñas empresas
Qué midió el benchmark de AIGROW al asignar a GLM-5.3-Flash 20 tareas de oficina, evaluadas cada una como aprobada o fallida mediante comprobaciones predefinidas.
- Tasa de éxito
- Superó 90% de 20 ejecuciones (intervalo del 95%: 70 a 97%), puesto 4º de 36 modelos.
- Coste por 1.000 tareas superadas
- $0.831, incluidas las ejecuciones fallidas.
- Tiempo de respuesta
- Mediana de 15 s; 31 s en el percentil 90.
- Mejor y peor resultado
- Programación de citas (100% de tareas superadas) y Descripciones de productos (0%).
La letra pequeña
Lo que no incluye la tarifa base indicada arriba, según las páginas del desarrollador: recargos, descuentos, promociones y precios de caché.
320B parámetros en total, 18B activos. El almacenamiento de entradas en caché es «Gratis por tiempo limitado». Z.ai también vende GLM-5.3-FlashX ($0.37 / $1.25), no incluido. Pesos abiertos en Hugging Face (zai-org/GLM-5.3-Flash).
GLM-5.3-Flash frente a los modelos con los que se compara
Cada comparativa muestra ambos precios de lista y calcula el coste de las mismas tres tareas con cada modelo.
- frente a Qwen3.8 Flash
- Dos nuevos modelos económicos chinos con precios que apenas difieren en unos céntimos.
Otros modelos de Z.ai
| Modelo | Entrada | Salida | Contexto | 1,000 respuestas |
|---|---|---|---|---|
| GLM-5.3Z.ai · pesos abiertos | $1.40 | $4.40 | 1M | $5.96 |
De dónde sale el precio
Consultado el 22 de septiembre de 2026. Cada precio corresponde a la tarifa estándar del tramo de contexto más corto, sin descuentos por lotes ni por prioridad; los recargos por contexto largo, las tarifas por lotes y las promociones figuran en los detalles de cada modelo. No se ha tomado ningún precio de un revendedor.
Paga una cuarta parte del precio de catálogo
El crédito de API de AIGROW se consume según los precios de lista de los desarrolladores: con $25 obtienes $100 de uso. La página del crédito indica qué modelos cubre; pregunta por cualquier otro antes de comprar.
Precios comprobados el 22 de septiembre de 2026