À quoi sert ce calculateur
Les grilles tarifaires des fournisseurs d'IA indiquent un prix par million de tokens, ce qui se traduit mal en budget. Ce calculateur part de ce que vous connaissez vraiment de votre produit (le nombre d'appels, la taille de chaque prompt, la longueur de chaque réponse) et le convertit en facture mensuelle pour douze modèles actuels d'Anthropic, OpenAI, Google et DeepSeek. Si votre application lit ses réponses à voix haute, ajoutez le nombre de caractères prononcés et choisissez un fournisseur de voix : ce coût s'ajoute à chaque ligne, pour comparer des solutions complètes et pas seulement le modèle de langage.
Comment le calcul fonctionne
Les modèles facturent séparément les tokens d'entrée (tout ce que vous envoyez) et les tokens de sortie (tout ce que le modèle écrit). La sortie coûte généralement quatre à six fois plus cher. Pour chaque modèle, le calculateur applique :
- Requêtes mensuelles = requêtes par jour × 30,4 (durée moyenne d'un mois).
- Coût LLM = requêtes mensuelles × (tokens d'entrée × prix d'entrée + tokens de sortie × prix de sortie) ÷ 1 000 000.
- Coût de la voix = requêtes mensuelles × caractères lus × prix par million de caractères ÷ 1 000 000. Les offres facturées à la minute ou au token audio sont converties sur la base d'environ 900 caractères par minute.
Exemple chiffré
Un chatbot de service client traite 2 000 conversations par jour. Chaque appel envoie environ 1 500 tokens d'entrée (instructions système, extraits du centre d'aide et message du client) et reçoit environ 400 tokens de sortie.
Cela fait 60 800 requêtes par mois, soit 91,2 millions de tokens d'entrée et 24,3 millions de tokens de sortie. Avec Claude Sonnet 5.5 (2 $ en entrée / 10 $ en sortie), la facture est de 91,2 × 2 + 24,32 × 10 = 425,60 $ par mois. Avec GPT-5.6 Luna (0,20 $ / 1,20 $), le même trafic coûte 47,42 $. Si vous lisez 200 caractères de chaque réponse avec Amazon Polly Neural, comptez en plus 12,16 millions de caractères × 16 $ = 194,56 $.
Dans un produit vocal, la ligne « voix » peut donc rivaliser avec celle du modèle de langage. C'est pourquoi il vaut la peine de modéliser les deux ensemble avant de choisir une solution.
Obtenir des chiffres réalistes
Le plus simple pour estimer vos tokens est de coller un prompt représentatif dans notre estimateur de tokens. Gardez en tête que les applications de chat renvoient tout l'historique à chaque tour : les tokens d'entrée augmentent au fil de la conversation. Les modèles de raisonnement facturent aussi leur « réflexion » cachée comme des tokens de sortie. Pour la voix seule, notre calculateur de coût de synthèse vocale compare les fournisseurs en minutes d'audio.
Limites
Les résultats reposent sur les tarifs publics standard, en dollars américains, tels que facturés par les fournisseurs. Ils n'incluent ni les remises de mise en cache (souvent -90 % sur l'entrée répétée), ni le traitement par lots (en général -50 %), ni les offres gratuites, les contrats de volume, la TVA ou les suppléments de résidence des données. Les lignes DeepSeek utilisent le tarif des heures de pointe. Gemini 3.8 Flash bénéficie d'un prix promotionnel jusqu'à fin 2026. Considérez le résultat comme une estimation et vérifiez sur la page de chaque fournisseur avant de vous engager.
Sources
Tarifs publics issus des pages officielles d'Anthropic, d'OpenAI, de Google, de DeepSeek, d'Amazon Polly et d'ElevenLabs, vérifiés le 6 octobre 2026.