GLM-5.3-Flash frente a Qwen3.8 Flash
Dos nuevos modelos económicos chinos con precios que apenas difieren en unos céntimos. Los precios de catálogo de ambos, tomados de las páginas de sus fabricantes, y cuánto cuestan tres tareas cotidianas con cada uno.
Dólares estadounidenses, tarifa estándar, tramo de contexto más corto. Coste por tarea superada según la prueba de AIGROW para pequeñas empresas.
- GLM-5.3-Flash
- $0.831
- Tareas superadas
- 18 de 20
- Qwen3.8 Flash
- $1.09
- Tareas superadas
- 19 de 20
Prueba de AIGROW para pequeñas empresas, incluidos los intentos fallidos.
En el benchmark de AIGROW para pequeñas empresas, el coste por cada 1.000 respuestas que superan las pruebas es de $0.831 con GLM-5.3-Flash y de $1.09 con Qwen3.8 Flash. Superaron 18 y 19 de 20 tareas. Por millón de tokens, GLM-5.3-Flash cuesta $0.15 de entrada y $0.50 de salida y Qwen3.8 Flash cuesta $0.15 de entrada y $0.47 de salida.
Comparación directa
La tarifa publicada por cada fabricante para su nivel estándar. La entrada en caché es lo que cuesta reutilizar el inicio de una consulta una vez que el proveedor lo ha almacenado.
| Dato | GLM-5.3-Flash | Qwen3.8 Flash |
|---|---|---|
| Fabricante | Z.ai | Alibaba (Qwen) |
| Gama | Pequeños y rápidos | Pequeños y rápidos |
| Entrada, por millón de tokens | $0.15 | $0.15 |
| Salida, por millón de tokens | $0.50 | $0.47 |
| Entrada en caché | $0.03 | No publicado |
| Ventana de contexto | 1M | 1M |
| Lanzamiento | 26 ago 2026 | No publicado |
| Pesos | Abrir | Cerrados |
Cuánto cuesta una tarea con cada uno
1,000 ejecuciones de cada tarea a los dos precios de catálogo. La diferencia varía según la tarea porque cada modelo cobra de forma distinta por la entrada, la salida y el contexto en caché.
| Tarea | GLM-5.3-Flash | Qwen3.8 Flash | Más barato |
|---|---|---|---|
| Respuesta de soporte3,000 de entrada, 400 de salida. | $0.65 | $0.64 | Qwen3.8 Flash, un 2% menos |
| Resumen de un documento25,000 de entrada, 1,000 de salida. | $4.25 | $4.22 | Empate |
| Tarea de agente80,000 de entrada (70,000 en caché), 3,000 de salida. | $5.10 | $13.41 | GLM-5.3-Flash, un 62% menos |
Las cantidades de tokens las hemos elegido nosotros para representar tareas reales; los precios son los de los desarrolladores. Si un modelo no tiene un precio de caché publicado, el contexto repetido de la tarea del agente se cobra a la tarifa completa de entrada.
La letra pequeña
Lo que no incluye cada tarifa base, según las páginas de los desarrolladores: recargos, descuentos, promociones y precios de caché.
- GLM-5.3-Flash
- 320B parámetros en total, 18B activos. El almacenamiento de entradas en caché es «Gratis por tiempo limitado». Z.ai también vende GLM-5.3-FlashX ($0.37 / $1.25), no incluido. Pesos abiertos en Hugging Face (zai-org/GLM-5.3-Flash). Página de precios de Z.ai
- Qwen3.8 Flash
- Despliegue internacional, con un único nivel de hasta 1M tokens de entrada. Descuentos de caché como los de Qwen3.8 Max. Contexto tomado del nivel de precios más alto (1M). Página de precios de Alibaba (Qwen)
Otras comparativas
Todas las comparativas directas de la lista en las que aparece GLM-5.3-Flash o Qwen3.8 Flash.
Paga una cuarta parte del precio de catálogo
El crédito de API de AIGROW se consume según los precios de lista de los desarrolladores: con $25 obtienes $100 de uso. La página del crédito indica qué modelos cubre; pregunta por cualquier otro antes de comprar.
Precios comprobados el 22 de septiembre de 2026