O custo de operar um agente de IA
Um agente não faz uma única chamada. Executa vários passos, e o contexto que lê aumenta a cada um deles. Defina a estrutura da sua carga de trabalho, escolha um modelo e a calculadora estima o custo da execução completa com os preços publicados pelo fornecedor, passo a passo.
Gratuito e sem registo. Os cálculos são feitos no seu navegador, por isso nada do que escrever é enviado para qualquer lugar.
$2 de entrada e $10 de saída por milhão de tokens, segundo o preço publicado por Anthropic, consultado em 22 Setembro 2026.
Uma chamada ao modelo por passo: pesquisar, ler, decidir ou escrever. Limite de 40.
As instruções, as ferramentas disponibilizadas e o próprio pedido. Aproximadamente 750 palavras por 1,000 tokens.
O que o passo devolve: a página lida, as linhas obtidas ou o resultado da ferramenta utilizada.
Apenas a resposta. O raciocínio aparece no campo seguinte, porque é cobrado à mesma tarifa.
Cobrados à tarifa de saída. Deixe em branco para usar 400, um valor presumido; defina 0 para um modelo que não raciocina antes de responder.
Deixe em branco para usar 70%, um valor presumido. O primeiro passo lê o contexto sem cache, por isso nada vem da cache.
Deixe em branco para usar 5%, um valor presumido.
Quantas vezes todo o fluxo de trabalho é executado: por pedido de suporte, por lead ou por documento.
- Leitura ao longo de 10 passos
- 107,500 tokens
- Desse total, obtido da cache (70%)
- 72,450 tokens
- Tokens escritos: resposta e raciocínio
- 9,000 tokens
- Uma execução, com 5% dos passos repetidos
- $0.1833
- 1,000 execuções por mês
- $183
Preço de tabela publicado por Anthropic, consultado em 22 Setembro 2026. Acessos à cache a $0.20 por milhão. O alojamento, as ferramentas usadas pelo agente, os embeddings e os registos não estão incluídos.
$183. Custo mensal de 1,000 execuções de um agente com 10 passos no Claude Sonnet 5.
| Passo | Leituras | Da cache | Escritas | Custo |
|---|---|---|---|---|
| 1 | 4,000 | 0 | 900 | $0.0170 |
| 2 | 5,500 | 3,850 | 900 | $0.0131 |
| 3 | 7,000 | 4,900 | 900 | $0.0142 |
| 4 | 8,500 | 5,950 | 900 | $0.0153 |
| 5 | 10,000 | 7,000 | 900 | $0.0164 |
| 6 | 11,500 | 8,050 | 900 | $0.0175 |
| 7 | 13,000 | 9,100 | 900 | $0.0186 |
| 8 | 14,500 | 10,150 | 900 | $0.0197 |
| 9 | 16,000 | 11,200 | 900 | $0.0208 |
| 10 | 17,500 | 12,250 | 900 | $0.0219 |
Dez passos, um contexto que começa com 4,000 tokens e cresce, 70% de cada leitura obtida da cache e 5% dos passos repetidos: no Claude Sonnet 5, essa execução lê 107,500 tokens e custa $0.1833. Assim, 1,000 execuções por mês custam $183. O preço publicado para processamento em lote reduz esse valor a metade.
Como se chega a este valor
Todos os valores usados pela calculadora estão nesta página, para que você possa conferir o resultado à mão.
- Os preços
- Os preços de entrada, saída e leituras da cache são os publicados por cada fornecedor. Vêm de data/models/2026-09/models.json, que regista a página de preços e a data da consulta (22 September 2026). Os mesmos valores estão nas nossas páginas dos modelos. Nenhum preço aqui vem de um revendedor.
- Os passos
- O primeiro passo lê o contexto inicial. Cada passo seguinte lê o que o anterior leu, mais os tokens que esse passo acrescentou. Por isso, a entrada faturada numa execução é a soma de todos os passos, não o custo de um único prompt. A tabela detalha cada passo.
- A cache
- A parte que você definir é cobrada ao preço de leitura da cache publicado pelo fornecedor. O primeiro passo lê o contexto sem cache, por isso nada nele é obtido da cache. Se o fornecedor não publicar esse preço, os tokens em cache são cobrados ao preço integral de entrada, e o resultado indica isso.
- Raciocínio e novas tentativas
- Os tokens de raciocínio são cobrados ao preço de saída, por isso são somados à resposta em cada passo. A taxa de novas tentativas representa a parte dos passos que falham e são repetidos: multiplica o custo da execução por um mais essa taxa. Ambos os valores predefinidos são estimativas.
- O preço para processamento em lote
- Quando o fornecedor publica um desconto para processamento em lote nas suas notas de preços, a calculadora disponibiliza-o e mostra a percentagem: metade do preço na Anthropic, OpenAI e Google, um quinto de desconto no Grok 4.3 e nenhum desconto quando o fornecedor não oferece essa modalidade.
- O que fica de fora
- Alojamento, ferramentas chamadas pelo agente, embeddings, registos e sobretaxas por contexto longo, aplicadas em alguns modelos quando um único pedido ultrapassa 200,000 ou 272,000 tokens. Se cada passo ficar abaixo desse limite, aplica-se o preço base.
Perguntas frequentes sobre este valor
Calcule o custo de execução para o seu fluxo de trabalho
A auditoria mede os passos, o contexto e o volume reais antes de qualquer desenvolvimento. Assim, o valor usado no planeamento baseia-se em medições, não em estimativas.