Toolantern
Accueil › Calculateur de coût API IA
Tarifs vérifiés le 6 octobre 2026

Calculateur de coût des API d'IA

Décrivez votre usage une seule fois et voyez ce qu'il coûte chaque mois sur les principaux modèles, sortie vocale comprise si votre application parle. Tout le calcul se fait dans votre navigateur.

Trafic
Une requête = un appel au modèle.
Tokens par requête
Prompt + historique + contexte récupéré.
La réponse du modèle (raisonnement compris).
Sortie vocale (facultatif)
0 = pas de synthèse vocale. Environ 900 caractères ≈ 1 minute.
—requêtes par mois
—
—
Coût mensuel par modèle, du moins cher au plus cher
ModèleLLM / moisVoix / moisTotal / moisPour 1 000 requêtes

À quoi sert ce calculateur

Les grilles tarifaires des fournisseurs d'IA indiquent un prix par million de tokens, ce qui se traduit mal en budget. Ce calculateur part de ce que vous connaissez vraiment de votre produit (le nombre d'appels, la taille de chaque prompt, la longueur de chaque réponse) et le convertit en facture mensuelle pour douze modèles actuels d'Anthropic, OpenAI, Google et DeepSeek. Si votre application lit ses réponses à voix haute, ajoutez le nombre de caractères prononcés et choisissez un fournisseur de voix : ce coût s'ajoute à chaque ligne, pour comparer des solutions complètes et pas seulement le modèle de langage.

Comment le calcul fonctionne

Les modèles facturent séparément les tokens d'entrée (tout ce que vous envoyez) et les tokens de sortie (tout ce que le modèle écrit). La sortie coûte généralement quatre à six fois plus cher. Pour chaque modèle, le calculateur applique :

Exemple chiffré

Un chatbot de service client traite 2 000 conversations par jour. Chaque appel envoie environ 1 500 tokens d'entrée (instructions système, extraits du centre d'aide et message du client) et reçoit environ 400 tokens de sortie.

Cela fait 60 800 requêtes par mois, soit 91,2 millions de tokens d'entrée et 24,3 millions de tokens de sortie. Avec Claude Sonnet 5.5 (2 $ en entrée / 10 $ en sortie), la facture est de 91,2 × 2 + 24,32 × 10 = 425,60 $ par mois. Avec GPT-5.6 Luna (0,20 $ / 1,20 $), le même trafic coûte 47,42 $. Si vous lisez 200 caractères de chaque réponse avec Amazon Polly Neural, comptez en plus 12,16 millions de caractères × 16 $ = 194,56 $.

Dans un produit vocal, la ligne « voix » peut donc rivaliser avec celle du modèle de langage. C'est pourquoi il vaut la peine de modéliser les deux ensemble avant de choisir une solution.

Obtenir des chiffres réalistes

Le plus simple pour estimer vos tokens est de coller un prompt représentatif dans notre estimateur de tokens. Gardez en tête que les applications de chat renvoient tout l'historique à chaque tour : les tokens d'entrée augmentent au fil de la conversation. Les modèles de raisonnement facturent aussi leur « réflexion » cachée comme des tokens de sortie. Pour la voix seule, notre calculateur de coût de synthèse vocale compare les fournisseurs en minutes d'audio.

Limites

Les résultats reposent sur les tarifs publics standard, en dollars américains, tels que facturés par les fournisseurs. Ils n'incluent ni les remises de mise en cache (souvent -90 % sur l'entrée répétée), ni le traitement par lots (en général -50 %), ni les offres gratuites, les contrats de volume, la TVA ou les suppléments de résidence des données. Les lignes DeepSeek utilisent le tarif des heures de pointe. Gemini 3.8 Flash bénéficie d'un prix promotionnel jusqu'à fin 2026. Considérez le résultat comme une estimation et vérifiez sur la page de chaque fournisseur avant de vous engager.

Sources

Tarifs publics issus des pages officielles d'Anthropic, d'OpenAI, de Google, de DeepSeek, d'Amazon Polly et d'ElevenLabs, vérifiés le 6 octobre 2026.

Estimation indicative. Les résultats reposent sur les tarifs publics indiqués et peuvent différer de votre facture réelle. Conditions

Questions fréquentes

Cette estimation du coût des API d'IA est-elle fiable ?

Le calcul est exact pour les tarifs affichés. L'incertitude vient de vos données : le nombre réel de tokens varie d'une requête à l'autre, donc utilisez une moyenne tirée de vos journaux si vous en avez. Les tarifs ont été vérifiés sur la page officielle de chaque fournisseur à la date indiquée en haut de page.

Pourquoi la sortie coûte-t-elle plus cher que l'entrée ?

Chaque token de sortie est généré un par un et demande un passage complet dans le modèle, alors que les tokens d'entrée sont traités en parallèle. Les fournisseurs facturent donc la sortie environ quatre à six fois plus cher.

Le calculateur tient-il compte de la mise en cache ou du traitement par lots ?

Non. Il utilise les tarifs standard pour comparer les modèles à conditions égales. Si vous renvoyez un long prompt système identique, la mise en cache peut réduire fortement le coût d'entrée : considérez donc la part « entrée » comme un maximum.

Les prix sont-ils en euros ?

Non. Les fournisseurs d'API facturent en dollars américains, et le calculateur affiche donc des montants en dollars. Le montant en euros dépend du taux de change appliqué par votre banque, et la TVA peut s'ajouter selon votre situation.

Quel modèle est le moins cher pour un chatbot ?

Pour le seul coût, les modèles d'entrée de gamme comme GPT-5.6 Luna, DeepSeek V4.1 Flash et Gemini 3.5 Flash-Lite sont généralement les moins chers. Testez la qualité sur un échantillon de vraies conversations avant de changer de modèle.

Mes données sont-elles envoyées quelque part ?

Non. Le calculateur est un simple script qui s'exécute dans votre navigateur. Rien de ce que vous saisissez n'est envoyé ni enregistré.

Autres outils gratuits