Le coût d’exécution d’un agent IA
Un agent ne se limite pas à un seul appel. Il exécute plusieurs étapes, et le contexte qu’il lit s’allonge à chacune d’elles. Définissez votre charge de travail, choisissez un modèle et le calculateur chiffre l’exécution complète aux tarifs publiés par son fournisseur, étape par étape.
Gratuit et sans inscription. Les calculs se font dans votre navigateur : rien de ce que vous saisissez n’est envoyé ailleurs.
$2 en entrée et $10 en sortie par million de tokens, selon les tarifs publiés par Anthropic, consultés le 22 Septembre 2026.
Un appel au modèle par étape : recherche, lecture, décision ou rédaction. Plafonné à 40.
Les instructions, les outils mis à disposition et la requête elle-même. Environ 750 mots pour 1,000 tokens.
Ce que l’étape récupère : la page lue, les lignes extraites ou le résultat de l’outil appelé.
La réponse uniquement. Les tokens de raisonnement figurent dans le champ suivant, car ils sont facturés au même tarif.
Facturés au tarif de sortie. Laissez ce champ vide pour utiliser 400, une hypothèse ; indiquez 0 pour un modèle sans raisonnement préalable.
Laissez ce champ vide pour utiliser 70%, une hypothèse. La première étape lit les données sans cache : rien n’est donc mis en cache.
Laissez ce champ vide pour utiliser 5%, une hypothèse.
Fréquence d’exécution du processus complet : par ticket, par prospect ou par document.
- Tokens lus sur 10 étapes
- 107,500 tokens
- Dont servis depuis le cache (70%)
- 72,450 tokens
- Tokens produits : réponse et raisonnement
- 9,000 tokens
- Une exécution, 5% des étapes relancées
- $0.1833
- 1,000 exécutions par mois
- $183
Prix public publié par Anthropic, consulté le 22 Septembre 2026. Les accès au cache sont facturés $0.20 par million. L’hébergement, les outils appelés par l’agent, les embeddings et la journalisation ne sont pas inclus.
$183. Coût mensuel de 1,000 exécutions d’un agent à 10 étapes sur Claude Sonnet 5.
| Étape | Tokens lus | Depuis le cache | Tokens produits | Coût |
|---|---|---|---|---|
| 1 | 4,000 | 0 | 900 | $0.0170 |
| 2 | 5,500 | 3,850 | 900 | $0.0131 |
| 3 | 7,000 | 4,900 | 900 | $0.0142 |
| 4 | 8,500 | 5,950 | 900 | $0.0153 |
| 5 | 10,000 | 7,000 | 900 | $0.0164 |
| 6 | 11,500 | 8,050 | 900 | $0.0175 |
| 7 | 13,000 | 9,100 | 900 | $0.0186 |
| 8 | 14,500 | 10,150 | 900 | $0.0197 |
| 9 | 16,000 | 11,200 | 900 | $0.0208 |
| 10 | 17,500 | 12,250 | 900 | $0.0219 |
Dix étapes, un contexte qui démarre à 4,000 tokens, 70% de chaque lecture servis depuis le cache et 5% des étapes relancées : sur Claude Sonnet 5, cette exécution lit 107,500 tokens et coûte $0.1833. À raison de 1,000 exécutions par mois, cela représente $183. Le tarif publié pour le traitement par lots réduit ce montant de moitié.
Comment ce chiffre est calculé
Toutes les hypothèses chiffrées du calculateur figurent sur cette page. Vous pouvez donc vérifier le résultat à la main.
- Les tarifs
- Les tarifs des tokens en entrée, en sortie et servis depuis le cache sont ceux publiés par chaque fournisseur. Ils proviennent de data/models/2026-09/models.json, qui indique la page tarifaire et la date de consultation (22 septembre 2026). Vous retrouverez les mêmes chiffres sur nos pages consacrées aux modèles. Aucun tarif présenté ici ne vient d’un revendeur.
- Les étapes
- La première étape lit le contexte initial. Chaque étape suivante relit ce que la précédente a lu, plus les tokens qu’elle a ajoutés. Les tokens d’entrée facturés pour une exécution correspondent donc à la somme de toutes les étapes, pas à une seule requête. Le tableau détaille chaque étape.
- Le cache
- La part que vous définissez est facturée au tarif des tokens servis depuis le cache par le fournisseur. La première étape lit un contexte encore absent du cache : aucun de ses tokens n’est donc servi depuis celui-ci. Si le fournisseur ne publie pas de tarif pour le cache, ces tokens sont facturés au tarif plein des tokens d’entrée, et le résultat le précise.
- Tokens de raisonnement et nouvelles tentatives
- Les tokens de raisonnement sont facturés au tarif des tokens de sortie : ils s’ajoutent donc à la réponse à chaque étape. Le taux de nouvelle tentative représente la part des étapes qui échouent et sont relancées. Il multiplie le coût de l’exécution par un plus ce taux. Les deux valeurs par défaut sont des hypothèses.
- Le tarif du traitement par lots
- Quand un fournisseur publie une remise pour le traitement par lots dans ses notes tarifaires, le calculateur la propose et en indique le montant : moitié prix chez Anthropic, OpenAI et Google, un cinquième de réduction pour Grok 4.3, et aucune remise lorsque le fournisseur ne propose pas cette option.
- Ce qui n’est pas pris en compte
- L’hébergement, les outils appelés par l’agent, les embeddings, la journalisation et les suppléments liés aux contextes longs, appliqués sur certains modèles au-delà de 200,000 ou 272,000 tokens dans une même requête. Tant que chaque étape reste sous ce seuil, le tarif de base s’applique.
Questions fréquentes sur ce chiffre
Faites chiffrer une exécution sur votre propre processus
L’audit mesure le nombre réel d’étapes, la taille réelle du contexte et le volume réel avant tout développement. Vous planifiez ainsi sur la base de chiffres mesurés, et non d’hypothèses.