¿Qué es un token?
Los modelos de lenguaje no leen letras ni palabras, sino tokens: fragmentos de texto que produce un «tokenizador». Un token suele ser una palabra común, parte de una palabra larga, un signo de puntuación o una serie de espacios. Todos los proveedores cobran por token y cada modelo tiene un límite de contexto medido en tokens, así que saber aproximadamente cuántos tokens ocupa un prompt es el primer paso para estimar el coste o comprobar si un documento cabe.
Cómo funciona la estimación
Cada proveedor usa su propio tokenizador y varios no lo publican. En lugar de cargar megas de archivos en tu navegador, la herramienta combina dos reglas prácticas muy extendidas:
- Unos 4 caracteres por token: caracteres ÷ 4.
- Unos ¾ de palabra por token: palabras × 4 ÷ 3.
Estas reglas están calibradas para el inglés. El español suele generar entre un 10 y un 30 % más de tokens para el mismo contenido, así que deja margen al presupuestar. Los caracteres chinos, japoneses y coreanos se cuentan aparte, a razón de un token cada uno aproximadamente. Los extremos del rango corresponden a cada regla por separado.
Ejemplo práctico
Un prompt de sistema de 300 palabras y unos 1.800 caracteres se estima en (1.800 ÷ 4 + 300 × 4 ÷ 3) ÷ 2 = (450 + 400) ÷ 2 = 425 tokens. Enviado 10.000 veces al mes con una respuesta de 300 tokens, suma 4,25 millones de tokens de entrada y 3 millones de salida. Con Claude Haiku 4.5 (1 $ / 5 $) cuesta 4,25 + 15 = 19,25 $ al mes. Con GPT-5.6 Sol (5 $ / 30 $) son 21,25 + 90 = 111,25 $.
El ejemplo muestra que la longitud de las respuestas suele pesar más que la del prompt: acortarlas es una de las optimizaciones más baratas. Para calcular una aplicación completa (tráfico, historial y voz) usa la calculadora de coste de API de IA.
Limitaciones
Es un estimador, no un tokenizador. El código, el JSON, las URL, los números y los formatos poco habituales se dividen peor que la prosa, así que el recuento real suele ser mayor. Distintas familias de modelos pueden dar cifras bastante diferentes para el mismo texto. Para un valor exacto, usa el endpoint de conteo de tokens o el campo «usage» que devuelve tu proveedor. Las aplicaciones de chat añaden además tokens de formato ocultos, y las imágenes, el audio y las definiciones de herramientas se cobran aparte.