Toolantern
Accueil › Estimateur de tokens LLM
Tarifs vérifiés le 6 octobre 2026

Estimateur de tokens LLM

Collez un prompt, un document ou une conversation pour savoir à peu près combien de tokens il représente et ce qu'il coûte par appel et par mois sur douze modèles. Votre texte ne quitte jamais cette page.

Combien de fois ce texte est envoyé ou généré.
Utilisé seulement si le texte est une entrée.
0tokens estimés
0mots
0caractères
Coût de ce texte par modèle, du moins cher au plus cher
ModèlePar appelPar moisPrix par million (entrée / sortie)

Le nombre de tokens est une estimation (voir « Comment fonctionne l'estimation » plus bas). Le décompte réel d'un fournisseur peut varier de 10 à 20 %, davantage pour du code ou une langue autre que l'anglais.

Qu'est-ce qu'un token ?

Les modèles de langage ne lisent ni lettres ni mots, mais des tokens : des morceaux de texte découpés par un « tokeniseur ». Un token correspond souvent à un mot courant, à un fragment de mot plus long, à un signe de ponctuation ou à une suite d'espaces. Tous les fournisseurs facturent au token, et chaque modèle a une limite de contexte exprimée en tokens. Savoir à peu près combien de tokens contient un prompt est donc la première étape pour estimer un coût ou vérifier qu'un document tient dans la fenêtre de contexte.

Comment fonctionne l'estimation

Chaque fournisseur utilise son propre tokeniseur, et plusieurs ne le publient pas. Plutôt que de charger des mégaoctets de fichiers dans votre navigateur, l'outil combine deux règles empiriques reconnues :

Ces règles sont calibrées sur l'anglais. Le français, avec ses mots plus longs et ses accents, produit en général 10 à 30 % de tokens en plus pour un même contenu : gardez une marge, surtout pour un budget. Les caractères chinois, japonais et coréens sont comptés à part, à environ un token chacun. Les bornes basse et haute de la fourchette correspondent à chacune des deux règles prises seule.

Exemple chiffré

Un prompt système de 300 mots et environ 1 800 caractères est estimé à (1 800 ÷ 4 + 300 × 4 ÷ 3) ÷ 2 = (450 + 400) ÷ 2 = 425 tokens. Envoyé 10 000 fois par mois avec une réponse de 300 tokens, cela fait 4,25 millions de tokens d'entrée et 3 millions de tokens de sortie. Avec Claude Haiku 4.5 (1 $ / 5 $), le coût est de 4,25 + 15 = 19,25 $ par mois. Avec GPT-5.6 Sol (5 $ / 30 $), il atteint 21,25 + 90 = 111,25 $.

L'exemple montre aussi que la longueur des réponses pèse souvent plus lourd que celle du prompt : raccourcir les réponses est l'une des optimisations les plus rentables. Pour modéliser une application complète (trafic, historique, voix), utilisez le calculateur de coût des API d'IA.

Limites

Il s'agit d'un estimateur, pas d'un tokeniseur. Le code, le JSON, les URL, les nombres et les mises en forme inhabituelles se découpent moins efficacement que de la prose : attendez-vous à des chiffres réels plus élevés. Les familles de modèles peuvent donner des résultats sensiblement différents pour un même texte. Pour une valeur exacte, utilisez le point d'accès de comptage de tokens ou le champ « usage » renvoyé par votre fournisseur. Les applications de chat ajoutent aussi des tokens de mise en forme invisibles, et les images, l'audio et les définitions d'outils sont facturés à part.

Estimation indicative. Les résultats reposent sur les tarifs publics indiqués et peuvent différer de votre facture réelle. Conditions

Questions fréquentes

Combien de tokens pour 1 000 mots en français ?

Pour de la prose française courante, comptez environ 1 500 à 1 800 tokens, soit un peu plus qu'en anglais (1 300 à 1 400). Les tokeniseurs sont surtout entraînés sur l'anglais et découpent davantage les mots français.

Pourquoi mon fournisseur annonce-t-il un autre nombre de tokens ?

Chaque famille de modèles a son propre tokeniseur, alors que cet outil utilise une approximation rapide. Prévoyez un écart de 10 à 20 % sur de la prose, davantage sur du code ou des données.

Mon texte est-il envoyé quelque part ?

Non. Le comptage se fait en JavaScript sur cette page. Le texte n'est jamais envoyé, enregistré ni stocké, ce qui permet d'y coller des prompts confidentiels.

Les espaces et la ponctuation comptent-ils ?

Oui. La ponctuation forme souvent un token à part, et les espaces sont généralement rattachés au token suivant. De longues séries d'espaces ou de sauts de ligne peuvent ajouter des tokens.

Les tokens de sortie se comptent-ils comme ceux d'entrée ?

Ils se comptent de la même façon mais sont facturés plus cher, généralement quatre à six fois le prix d'entrée. Les modèles de raisonnement facturent aussi leur réflexion interne comme des tokens de sortie.

Comment faire tenir un long document dans la fenêtre de contexte ?

Estimez ses tokens ici et comparez avec la limite du modèle, en gardant de la place pour les instructions et la réponse. S'il ne tient pas, découpez-le ou ne transmettez que les passages utiles.

Autres outils gratuits