GLM-5.3-Flash vs. Qwen3.8 Flash
Dois novos modelos chineses económicos com preços que diferem apenas alguns cêntimos. Compare os preços de tabela publicados pelos respetivos fabricantes e o custo de três tarefas do dia a dia em cada modelo.
Dólares americanos, tarifa padrão, faixa de contexto mais curta. Custo por execução bem-sucedida com base no benchmark da AIGROW para pequenas empresas.
- GLM-5.3-Flash
- $0.831
- Tarefas concluídas com sucesso
- 18 de 20
- Qwen3.8 Flash
- $1.09
- Tarefas concluídas com sucesso
- 19 de 20
Benchmark da AIGROW para pequenas empresas, incluindo as execuções falhadas.
No benchmark da AIGROW para pequenas empresas, GLM-5.3-Flash custa $0.831 por 1,000 respostas aprovadas; Qwen3.8 Flash custa $1.09. Passaram, respetivamente, 18 e 19 de 20 tarefas. Por milhão de tokens, GLM-5.3-Flash custa $0.15 de entrada e $0.50 de saída; Qwen3.8 Flash custa $0.15 de entrada e $0.47 de saída.
Lado a lado
A tarifa publicada por cada fabricante para o seu nível padrão. A entrada em cache é o custo de um prefixo de prompt repetido depois de o fornecedor o guardar.
| Facto | GLM-5.3-Flash | Qwen3.8 Flash |
|---|---|---|
| Fabricante | Z.ai | Alibaba (Qwen) |
| Categoria | Pequenos e rápidos | Pequenos e rápidos |
| Entrada, por M de tokens | $0.15 | $0.15 |
| Saída, por M de tokens | $0.50 | $0.47 |
| Entrada em cache | $0.03 | Não publicado |
| Janela de contexto | 1M | 1M |
| Lançamento | 26 de ago. de 2026 | Não publicado |
| Pesos | Abrir | Fechados |
O custo de uma tarefa em cada modelo
1,000 execuções de cada tarefa aos dois preços de tabela. A diferença varia entre tarefas porque os modelos cobram de forma diferente pela entrada, pela saída e pelo contexto em cache.
| Tarefa | GLM-5.3-Flash | Qwen3.8 Flash | Mais barato |
|---|---|---|---|
| Resposta de suporte3,000 de entrada, 400 de saída. | $0.65 | $0.64 | Qwen3.8 Flash, 2% menos |
| Resumo de documento25,000 de entrada, 1,000 de saída. | $4.25 | $4.22 | Empate |
| Tarefa de agente80,000 de entrada (70,000 em cache), 3,000 de saída. | $5.10 | $13.41 | GLM-5.3-Flash, 62% menos |
As quantidades de tokens foram definidas por nós para representar trabalho real; os preços são dos fornecedores. Quando um modelo não tem preço de cache publicado, o contexto repetido na tarefa do agente é cobrado à tarifa integral de entrada.
Os detalhes
O que cada tarifa-base não inclui, segundo as páginas dos próprios fornecedores: sobretaxas, descontos, promoções e preços de cache.
- GLM-5.3-Flash
- 320B parâmetros no total, dos quais 18B ativos. O armazenamento de entradas em cache é «Gratuito por tempo limitado». A Z.ai também vende GLM-5.3-FlashX ($0.37 / $1.25), não incluído. Pesos abertos no Hugging Face (zai-org/GLM-5.3-Flash). Página de preços da Z.ai
- Qwen3.8 Flash
- Implementação internacional, com um único nível até 1M tokens de entrada. Descontos de cache iguais aos do Qwen3.8 Max. Contexto obtido do nível de preços mais alto (1M). Página de preços da Alibaba (Qwen)
Outras comparações
Todas as comparações diretas da lista que incluem GLM-5.3-Flash ou Qwen3.8 Flash.
Pague um quarto do preço de tabela
O crédito de API da AIGROW é cobrado com base nos preços de tabela dos fornecedores, e $25 dão direito a $100 de utilização. A página do crédito indica os modelos incluídos; consulte-nos sobre qualquer outro antes de comprar.
Preços verificados em 22 de setembro de 2026