Preços da API de GLM: 2 modelos, por token e por tarefa
O preço de tabela de cada modelo da Z.ai incluído na nossa lista, retirado da página de preços da própria Z.ai, ao lado do custo de uma resposta aprovada no benchmark da AIGROW para pequenas empresas e do custo de três tarefas do dia a dia em cada modelo.
Dólares americanos por milhão de tokens, à tarifa padrão. Sem preços de revendedores.
- GLM-5.3
- $1.40 / $4.40
- GLM-5.3-Flash
- $0.15 / $0.50
Preço de tabela de entrada / saída por milhão de tokens.
Os preços dos 2 modelos da Z.ai na nossa lista vão de GLM-5.3-Flash, a $0.15 de entrada e $0.50 de saída por milhão de tokens, até GLM-5.3, a $1.40 de entrada e $4.40 de saída. No benchmark da AIGROW para pequenas empresas, GLM-5.3-Flash igualou o melhor resultado, com 18 de 20 tarefas aprovadas, ao custo mais baixo: $0.831 por mil aprovações.
Por token e por execução bem-sucedida
O preço de tabela por milhão de tokens, quantas das 20 tarefas administrativas do benchmark cada modelo concluiu com sucesso e o custo de 1.000 respostas aprovadas, incluindo as execuções falhadas.
| Modelo | Entrada | Saída | Entrada em cache | Contexto | Tarefas concluídas com sucesso | 1.000 execuções bem-sucedidas |
|---|---|---|---|---|---|---|
| GLM-5.3Modelos de topo | $1.40 | $4.40 | $0.26 | 1M | 18 de 20 | $7.02 |
| GLM-5.3-FlashPequenos e rápidos | $0.15 | $0.50 | $0.03 | 1M | 18 de 20 | $0.831 |
O custo de três tarefas do dia a dia
1,000 execuções de cada tarefa ao preço de tabela. As contagens de tokens são nossas; os preços são da Z.ai.
| Modelo | 1,000 × resposta de suporte | 1,000 × resumo de documento | 1,000 × tarefa de agente |
|---|---|---|---|
| GLM-5.3 | $5.96 | $39.40 | $45.40 |
| GLM-5.3-Flash | $0.65 | $4.25 | $5.10 |
- Resposta de suporte
- Um prompt de 3.000 tokens (o pedido de suporte, a conversa até ao momento e um excerto das políticas) e uma resposta de 400 tokens.
- Resumo de documento
- Um documento de 40 páginas com cerca de 25.000 tokens de entrada e um resumo de 1.000 tokens de saída.
- Tarefa de agente
- Dez passos que leem, no total, 80.000 tokens, dos quais 70.000 são contexto repetido de um passo para o seguinte e servido a partir da cache, e geram 3.000 tokens.
Os detalhes
O que as páginas de preços da Z.ai acrescentam às tarifas principais.
- GLM-5.3
- O armazenamento de entradas em cache é «Gratuito por tempo limitado». Saída máxima de 128K. Pesos abertos no Hugging Face (zai-org/GLM-5.3).
- GLM-5.3-Flash
- 320B parâmetros no total, dos quais 18B ativos. O armazenamento de entradas em cache é «Gratuito por tempo limitado». A Z.ai também vende GLM-5.3-FlashX ($0.37 / $1.25), não incluído. Pesos abertos no Hugging Face (zai-org/GLM-5.3-Flash).
Lado a lado
Comparações entre um modelo da GLM e outro modelo, com os preços de ambos e o custo das três tarefas em cada um.
Origem dos preços
Consultado em 22 de setembro de 2026. Cada preço corresponde à tarifa padrão para a faixa de contexto mais curta, sem desconto por processamento em lote ou prioridade; as sobretaxas por contexto longo, as tarifas por lote e as promoções constam das condições de cada modelo. Nenhum preço foi obtido junto de revendedores.
Pague um quarto do preço de tabela
O consumo do crédito de API da AIGROW é calculado com base nos preços de tabela dos fabricantes, como os apresentados acima, e $25 dão direito a $100 de utilização. A página do crédito indica os modelos abrangidos.
Preços verificados em 22 de setembro de 2026