Qwen3.8 Flash: quanto custa utilizar
O preço anunciado pela Alibaba (Qwen) para Qwen3.8 Flash, quanto custam uma resposta de suporte, um resumo de documento e uma tarefa de agente, e a sua posição entre 37 modelos.
Dólares americanos por milhão de tokens, tarifa padrão, faixa de contexto mais curta.
- 1,000 respostas de suporte
- $0.64
- Entrada em cache
- Não publicado
- Janela de contexto
- 1.000.000 tokens
- Lançamento
- Não publicado
- Pesos
- Fechados
Segundo as páginas da Alibaba (Qwen), 22 de setembro de 2026.
Na API da Alibaba (Qwen), Qwen3.8 Flash custa $0.15 por milhão de tokens de entrada e $0.47 por milhão de tokens de saída. A esses preços, 1,000 respostas de suporte custam $0.64, o mais barato entre 33 modelos com preço publicado na nossa lista.
O custo de uma tarefa
Três tarefas, 1,000 execuções de cada uma, ao preço de tabela acima, e a posição de Qwen3.8 Flash entre os 33 modelos com preço de tabela em cada tarefa.
| Tarefa | 1,000 execuções | Entre 33 |
|---|---|---|
| Resposta de suporte3,000 de entrada, 400 de saída. | $0.64 | mais barato |
| Resumo de documento25,000 de entrada, 1,000 de saída. | $4.22 | mais barato |
| Tarefa de agente80,000 de entrada (70,000 em cache), 3,000 de saída. | $13.41 | 8º mais barato |
As quantidades de tokens foram definidas por nós para representar trabalho real; os preços são da Alibaba (Qwen). As três tarefas usam menos de 200,000 tokens por pedido, abaixo do limite de todas as sobretaxas por contexto longo da lista. A Alibaba (Qwen) não publica um preço de cache para este modelo, por isso o contexto repetido na tarefa do agente é cobrado à tarifa integral de entrada.
Qwen3.8 Flash em tarefas reais de pequenas empresas
O que o benchmark da AIGROW mediu ao atribuir a Qwen3.8 Flash 20 tarefas de escritório, cada uma avaliada como aprovada ou reprovada por critérios fixos.
- Taxa de sucesso
- 95% de 20 execuções passaram (intervalo de 95%: 76 a 99%), 1º entre 36 modelos.
- Custo por 1.000 aprovações
- $1.09, incluindo as execuções que falharam.
- Tempo de resposta
- Mediana de 29 s, 44 s no percentil 90.
- Melhor e pior desempenho
- Agendamento de compromissos (100% passaram) e Orçamentos (50%).
Os detalhes
O que a tarifa-base acima não inclui, conforme as páginas do fornecedor: sobretaxas, descontos, promoções e preços de cache.
Implementação internacional, com um único nível até 1M tokens de entrada. Descontos de cache iguais aos do Qwen3.8 Max. Contexto obtido do nível de preços mais alto (1M).
Qwen3.8 Flash frente aos modelos com que é comparado
Cada comparação mostra os dois preços de tabela lado a lado e calcula o custo das mesmas três tarefas em cada modelo.
- vs DeepSeek V4.1 Flash
- APIs chinesas económicas, com o preço de tabela da Qwen a cerca de metade da tarifa da DeepSeek nos horários de pico.
- vs GLM-5.3-Flash
- Dois novos modelos chineses económicos com preços que diferem apenas alguns cêntimos.
Outros modelos da Alibaba (Qwen)
| Modelo | Entrada | Saída | Contexto | 1,000 respostas |
|---|---|---|---|---|
| Qwen3.7 PlusAlibaba (Qwen) | $0.40 | $1.60 | 1M | $1.84 |
| Qwen3.8 27BAlibaba (Qwen) · pesos abertos | $0.50 | $3.00 | 1M | $2.70 |
| Qwen3.8 MaxAlibaba (Qwen) | $2.00 | $6.00 | 1M | $8.40 |
Origem do preço
- Alibaba (Qwen)
- alibabacloud.com/help/en/model-studio/model-pricing
Consultado em 22 de setembro de 2026. Cada preço corresponde à tarifa padrão para a faixa de contexto mais curta, sem desconto por processamento em lote ou prioridade; as sobretaxas por contexto longo, as tarifas por lote e as promoções constam das condições de cada modelo. Nenhum preço foi obtido junto de revendedores.
Pague um quarto do preço de tabela
O crédito de API da AIGROW é cobrado com base nos preços de tabela dos fornecedores, e $25 dão direito a $100 de utilização. A página do crédito indica os modelos incluídos; consulte-nos sobre qualquer outro antes de comprar.
Preços verificados em 22 de setembro de 2026