GLM-5.3-Flash: quanto custa utilizar
O preço anunciado pela Z.ai para GLM-5.3-Flash, quanto custam uma resposta de suporte, um resumo de documento e uma tarefa de agente, e a sua posição entre 37 modelos.
Dólares americanos por milhão de tokens, tarifa padrão, faixa de contexto mais curta.
- 1,000 respostas de suporte
- $0.65
- Entrada em cache
- $0.03
- Janela de contexto
- 1.000.000 tokens
- Lançamento
- 26 de ago. de 2026
- Pesos
- Abrir
Segundo as páginas da Z.ai, 22 de setembro de 2026.
Na API da Z.ai, GLM-5.3-Flash custa $0.15 por milhão de tokens de entrada, $0.50 por milhão de tokens de saída e $0.03 por milhão de tokens de entrada em cache. A esses preços, 1,000 respostas de suporte custam $0.65, o 2º mais barato entre 33 modelos com preço publicado na nossa lista.
O custo de uma tarefa
Três tarefas, 1,000 execuções de cada uma, ao preço de tabela acima, e a posição de GLM-5.3-Flash entre os 33 modelos com preço de tabela em cada tarefa.
| Tarefa | 1,000 execuções | Entre 33 |
|---|---|---|
| Resposta de suporte3,000 de entrada, 400 de saída. | $0.65 | 2º mais barato |
| Resumo de documento25,000 de entrada, 1,000 de saída. | $4.25 | 2º mais barato |
| Tarefa de agente80,000 de entrada (70,000 em cache), 3,000 de saída. | $5.10 | mais barato |
As quantidades de tokens foram definidas por nós para representar trabalho real; os preços são da Z.ai. As três tarefas usam menos de 200,000 tokens por pedido, abaixo do limite de todas as sobretaxas por contexto longo da lista.
GLM-5.3-Flash em tarefas reais de pequenas empresas
O que o benchmark da AIGROW mediu ao atribuir a GLM-5.3-Flash 20 tarefas de escritório, cada uma avaliada como aprovada ou reprovada por critérios fixos.
- Taxa de sucesso
- 90% de 20 execuções passaram (intervalo de 95%: 70 a 97%), 4º entre 36 modelos.
- Custo por 1.000 aprovações
- $0.831, incluindo as execuções que falharam.
- Tempo de resposta
- Mediana de 15 s, 31 s no percentil 90.
- Melhor e pior desempenho
- Agendamento de compromissos (100% passaram) e Descrições de produtos (0%).
Os detalhes
O que a tarifa-base acima não inclui, conforme as páginas do fornecedor: sobretaxas, descontos, promoções e preços de cache.
320B parâmetros no total, dos quais 18B ativos. O armazenamento de entradas em cache é «Gratuito por tempo limitado». A Z.ai também vende GLM-5.3-FlashX ($0.37 / $1.25), não incluído. Pesos abertos no Hugging Face (zai-org/GLM-5.3-Flash).
GLM-5.3-Flash frente aos modelos com que é comparado
Cada comparação mostra os dois preços de tabela lado a lado e calcula o custo das mesmas três tarefas em cada modelo.
- vs Qwen3.8 Flash
- Dois novos modelos chineses económicos com preços que diferem apenas alguns cêntimos.
Outros modelos da Z.ai
| Modelo | Entrada | Saída | Contexto | 1,000 respostas |
|---|---|---|---|---|
| GLM-5.3Z.ai · pesos abertos | $1.40 | $4.40 | 1M | $5.96 |
Origem do preço
Consultado em 22 de setembro de 2026. Cada preço corresponde à tarifa padrão para a faixa de contexto mais curta, sem desconto por processamento em lote ou prioridade; as sobretaxas por contexto longo, as tarifas por lote e as promoções constam das condições de cada modelo. Nenhum preço foi obtido junto de revendedores.
Pague um quarto do preço de tabela
O crédito de API da AIGROW é cobrado com base nos preços de tabela dos fornecedores, e $25 dão direito a $100 de utilização. A página do crédito indica os modelos incluídos; consulte-nos sobre qualquer outro antes de comprar.
Preços verificados em 22 de setembro de 2026