Respostas rápidas

AIGrow oferece monitorização da visibilidade em IA, um assistente para empresas, publicação de artigos no blog e serviços de automação com escopo definido. Comece pela análise gratuita para avaliar o resultado antes de pagar.

Faça a análise gratuita

A análise é gratuita e os planos de monitorização começam em $29 por mês. A auditoria de operações custa $290, a auditoria de visibilidade custa $490 e os projetos personalizados recebem um preço por escrito antes do início do trabalho.

Ver os planos

Faça a análise gratuita. Ela lê o seu site, pergunta a vários assistentes de IA o que os seus clientes perguntam e indica-lhe uma coisa. Não é necessário criar uma conta e a análise dirá se não precisa de nós.

Comece agora

Sim. Use o formulário de contacto para questões sobre o produto, faturação, suporte ou projetos. Descreva o objetivo e o sistema envolvido para que a primeira resposta possa ser específica.

Contactar a AIGrow
Calculadora de custos de agentes

O custo de operar um agente de IA

Um agente não faz uma única chamada. Executa vários passos, e o contexto que lê aumenta a cada um deles. Defina a estrutura da sua carga de trabalho, escolha um modelo e a calculadora estima o custo da execução completa com os preços publicados pelo fornecedor, passo a passo.

Gratuito e sem registo. Os cálculos são feitos no seu navegador, por isso nada do que escrever é enviado para qualquer lugar.

$2 de entrada e $10 de saída por milhão de tokens, segundo o preço publicado por Anthropic, consultado em 22 Setembro 2026.

Uma chamada ao modelo por passo: pesquisar, ler, decidir ou escrever. Limite de 40.

As instruções, as ferramentas disponibilizadas e o próprio pedido. Aproximadamente 750 palavras por 1,000 tokens.

O que o passo devolve: a página lida, as linhas obtidas ou o resultado da ferramenta utilizada.

Apenas a resposta. O raciocínio aparece no campo seguinte, porque é cobrado à mesma tarifa.

Cobrados à tarifa de saída. Deixe em branco para usar 400, um valor presumido; defina 0 para um modelo que não raciocina antes de responder.

Deixe em branco para usar 70%, um valor presumido. O primeiro passo lê o contexto sem cache, por isso nada vem da cache.

Deixe em branco para usar 5%, um valor presumido.

Quantas vezes todo o fluxo de trabalho é executado: por pedido de suporte, por lead ou por documento.

A tarifa

Anthropic publica uma tarifa em lote com 50% de desconto para tarefas que não precisam de resposta imediata e cujos resultados chegam, normalmente, no prazo de um dia.

O cálculo mensal
$183Custo mensal de 1,000 execuções de um agente com 10 passos no Claude Sonnet 5
Leitura ao longo de 10 passos
107,500 tokens
Desse total, obtido da cache (70%)
72,450 tokens
Tokens escritos: resposta e raciocínio
9,000 tokens
Uma execução, com 5% dos passos repetidos
$0.1833
1,000 execuções por mês
$183

Preço de tabela publicado por Anthropic, consultado em 22 Setembro 2026. Acessos à cache a $0.20 por milhão. O alojamento, as ferramentas usadas pelo agente, os embeddings e os registos não estão incluídos.

$183. Custo mensal de 1,000 execuções de um agente com 10 passos no Claude Sonnet 5.

Passo a passo
PassoLeiturasDa cacheEscritasCusto
14,0000900$0.0170
25,5003,850900$0.0131
37,0004,900900$0.0142
48,5005,950900$0.0153
510,0007,000900$0.0164
611,5008,050900$0.0175
713,0009,100900$0.0186
814,50010,150900$0.0197
916,00011,200900$0.0208
1017,50012,250900$0.0219

Dez passos, um contexto que começa com 4,000 tokens e cresce, 70% de cada leitura obtida da cache e 5% dos passos repetidos: no Claude Sonnet 5, essa execução lê 107,500 tokens e custa $0.1833. Assim, 1,000 execuções por mês custam $183. O preço publicado para processamento em lote reduz esse valor a metade.

Como se chega a este valor

Todos os valores usados pela calculadora estão nesta página, para que você possa conferir o resultado à mão.

Os preços
Os preços de entrada, saída e leituras da cache são os publicados por cada fornecedor. Vêm de data/models/2026-09/models.json, que regista a página de preços e a data da consulta (22 September 2026). Os mesmos valores estão nas nossas páginas dos modelos. Nenhum preço aqui vem de um revendedor.
Os passos
O primeiro passo lê o contexto inicial. Cada passo seguinte lê o que o anterior leu, mais os tokens que esse passo acrescentou. Por isso, a entrada faturada numa execução é a soma de todos os passos, não o custo de um único prompt. A tabela detalha cada passo.
A cache
A parte que você definir é cobrada ao preço de leitura da cache publicado pelo fornecedor. O primeiro passo lê o contexto sem cache, por isso nada nele é obtido da cache. Se o fornecedor não publicar esse preço, os tokens em cache são cobrados ao preço integral de entrada, e o resultado indica isso.
Raciocínio e novas tentativas
Os tokens de raciocínio são cobrados ao preço de saída, por isso são somados à resposta em cada passo. A taxa de novas tentativas representa a parte dos passos que falham e são repetidos: multiplica o custo da execução por um mais essa taxa. Ambos os valores predefinidos são estimativas.
O preço para processamento em lote
Quando o fornecedor publica um desconto para processamento em lote nas suas notas de preços, a calculadora disponibiliza-o e mostra a percentagem: metade do preço na Anthropic, OpenAI e Google, um quinto de desconto no Grok 4.3 e nenhum desconto quando o fornecedor não oferece essa modalidade.
O que fica de fora
Alojamento, ferramentas chamadas pelo agente, embeddings, registos e sobretaxas por contexto longo, aplicadas em alguns modelos quando um único pedido ultrapassa 200,000 ou 272,000 tokens. Se cada passo ficar abaixo desse limite, aplica-se o preço base.

Depende do número de passos, do contexto e do modelo. Uma execução de dez passos que lê 107,500 tokens e escreve 9,000 custa $0.1833 no Claude Sonnet 5, ou $183 por 1,000 execuções mensais. A mesma carga de trabalho num modelo pequeno custa uma fração desse valor.

Porque cada passo lê tudo o que veio antes. Dez passos que começam com 4,000 tokens e acrescentam 1,500 por passo leem 107,500 tokens no total, não 40,000. A cache evita que todas essas leituras sejam cobradas sempre ao preço integral de entrada.

São cobrados ao preço de saída, o mais elevado de um modelo. Se um modelo usar 400 tokens para raciocinar antes de escrever 500, esse passo é cobrado como 900 tokens de saída.

É uma fila mais barata para tarefas que não precisam de resposta imediata, geralmente concluídas no prazo de um dia. Anthropic, OpenAI e Google publicam um desconto de 50%; a xAI publica 20% de desconto no Grok 4.3 e nenhum no Grok 4.7. A calculadora usa apenas os preços publicados pelos fornecedores.

Calcule o custo de execução para o seu fluxo de trabalho

A auditoria mede os passos, o contexto e o volume reais antes de qualquer desenvolvimento. Assim, o valor usado no planeamento baseia-se em medições, não em estimativas.