Cuánto cuesta ejecutar un agente de IA
Un agente no hace una sola llamada. Ejecuta varios pasos y el contexto que lee crece en cada uno. Define tu carga de trabajo, elige un modelo y la calculadora estima el coste de toda la ejecución, paso a paso, según las tarifas publicadas por el proveedor.
Gratis y sin registrarte. Los cálculos se hacen en tu navegador, así que nada de lo que escribes se envía a ningún sitio.
$2 de entrada y $10 de salida por millón de tokens, según el precio publicado por Anthropic, consultado el 22 Septiembre 2026.
Una llamada al modelo por cada paso: buscar, leer, decidir o escribir. Máximo de 40.
Las instrucciones, las herramientas disponibles y la propia solicitud. Aproximadamente 750 palabras por cada 1,000 tokens.
Lo que devuelve cada paso: la página que ha leído, las filas que ha recuperado o el resultado de la herramienta que ha utilizado.
Solo la respuesta. El razonamiento se indica en el siguiente campo porque se factura a la misma tarifa.
Se facturan a la tarifa de salida. Déjalo en blanco para usar 400, un valor estimado; pon 0 si el modelo no razona antes de responder.
Déjalo en blanco para usar 70%, un valor estimado. La primera lectura se hace sin caché, así que nada de ella procede de la caché.
Déjalo en blanco para usar 5%, un valor estimado.
Cuántas veces se ejecuta el flujo completo: por ticket, por lead o por documento.
- Lectura a lo largo de 10 pasos
- 107,500 tokens
- De ellos, servidos desde la caché (70%)
- 72,450 tokens
- Escritura: respuesta y razonamiento
- 9,000 tokens
- Una ejecución, con 5% de pasos repetidos
- $0.1833
- 1,000 ejecuciones al mes
- $183
Precio de lista publicado por Anthropic, consultado el 22 Septiembre 2026. Aciertos de caché a $0.20 por millón. No incluye el alojamiento, las herramientas que utiliza el agente, los embeddings ni los registros.
$183. Coste mensual de 1,000 ejecuciones de un agente de 10 pasos con Claude Sonnet 5.
| Paso | Lee | Desde la caché | Escribe | Coste |
|---|---|---|---|---|
| 1 | 4,000 | 0 | 900 | $0.0170 |
| 2 | 5,500 | 3,850 | 900 | $0.0131 |
| 3 | 7,000 | 4,900 | 900 | $0.0142 |
| 4 | 8,500 | 5,950 | 900 | $0.0153 |
| 5 | 10,000 | 7,000 | 900 | $0.0164 |
| 6 | 11,500 | 8,050 | 900 | $0.0175 |
| 7 | 13,000 | 9,100 | 900 | $0.0186 |
| 8 | 14,500 | 10,150 | 900 | $0.0197 |
| 9 | 16,000 | 11,200 | 900 | $0.0208 |
| 10 | 17,500 | 12,250 | 900 | $0.0219 |
Diez pasos, un contexto que empieza en 4,000 tokens, un 70% de cada lectura servido desde la caché y un 5% de pasos repetidos: en Claude Sonnet 5, esa ejecución lee 107,500 tokens y cuesta $0.1833. Por tanto, 1,000 ejecuciones al mes cuestan $183. Su tarifa publicada por lotes reduce ese importe a la mitad.
Cómo se calcula el resultado
Todas las cifras que utiliza la calculadora están en esta página, para que puedas comprobar el resultado a mano.
- Los precios
- Las tarifas de entrada, salida y aciertos de caché publicadas por cada proveedor proceden de data/models/2026-09/models.json, donde constan la página de precios y la fecha de consulta (22 de septiembre de 2026). Encontrarás las mismas cifras en nuestras páginas de modelos. Ningún precio procede de un revendedor.
- Los pasos
- El primer paso lee el contexto inicial. Cada paso posterior lee lo que leyó el anterior más los tokens que este añadió. Por eso, los tokens de entrada facturados en una ejecución son la suma de todos los pasos, no los de una sola consulta. La tabla muestra el desglose de cada paso.
- La caché
- La proporción que indiques se factura a la tarifa de aciertos de caché del proveedor. El primer paso lee el contexto por primera vez, así que no tiene nada en caché. Si un proveedor no publica una tarifa de caché, esos tokens se facturan a la tarifa completa de entrada y el resultado lo indica.
- Razonamiento y reintentos
- Los tokens de razonamiento se facturan a la tarifa de salida, por lo que se suman a los de la respuesta en cada paso. La tasa de reintentos es la proporción de pasos que fallan y vuelven a ejecutarse: multiplica el coste de la ejecución por uno más esa tasa. Ambos valores predeterminados son supuestos.
- La tarifa por lotes
- Cuando el proveedor publica un descuento por lotes en sus notas de precios, la calculadora permite aplicarlo e indica cuánto se descuenta: la mitad en Anthropic, OpenAI y Google; una quinta parte en Grok 4.3; y nada si el proveedor no ofrece esa opción.
- Qué queda fuera
- El alojamiento, las herramientas que utiliza el agente, los embeddings, los registros y los recargos por contextos largos que algunos modelos aplican por encima de 200,000 o 272,000 tokens en una sola solicitud. Si cada paso se mantiene por debajo de ese umbral, se aplica la tarifa base.
Preguntas frecuentes sobre esta cifra
Calcula el coste de ejecución con tu propio flujo de trabajo
La auditoría mide los pasos, el contexto y el volumen reales antes de construir nada. Así podrás planificar con una cifra medida, no supuesta.