Qué hace esta calculadora
Las páginas de precios de IA indican un precio por millón de tokens, algo difícil de traducir a un presupuesto. Esta calculadora parte de lo que sí sabes de tu producto (cuántas llamadas haces, cuánto ocupa cada prompt y cuánto se extiende cada respuesta) y lo convierte en una factura mensual para doce modelos actuales de Anthropic, OpenAI, Google y DeepSeek. Si tu aplicación lee las respuestas en voz alta, añade los caracteres leídos y elige un proveedor de voz: ese coste se suma a cada fila, para comparar soluciones completas y no solo el modelo de lenguaje.
Cómo se calcula
Los modelos cobran por separado los tokens de entrada (todo lo que envías) y los de salida (todo lo que escribe el modelo). La salida suele costar entre cuatro y seis veces más. Para cada modelo, la calculadora aplica:
- Peticiones al mes = peticiones al día × 30,4 (duración media de un mes).
- Coste del LLM = peticiones al mes × (tokens de entrada × precio de entrada + tokens de salida × precio de salida) ÷ 1.000.000.
- Coste de voz = peticiones al mes × caracteres leídos × precio por millón de caracteres ÷ 1.000.000. Los servicios que cobran por minuto o por token de audio se convierten a razón de unos 900 caracteres por minuto.
Ejemplo práctico
Un chatbot de atención al cliente gestiona 2.000 conversaciones al día. Cada llamada envía unos 1.500 tokens de entrada (instrucciones del sistema, fragmentos del centro de ayuda y el mensaje del cliente) y recibe unos 400 tokens de salida.
Son 60.800 peticiones al mes: 91,2 millones de tokens de entrada y 24,3 millones de salida. Con Claude Sonnet 5.5 (2 $ de entrada / 10 $ de salida) la factura es 91,2 × 2 + 24,32 × 10 = 425,60 $ al mes. Con GPT-5.6 Luna (0,20 $ / 1,20 $) el mismo tráfico cuesta 47,42 $. Si además lees en voz alta 200 caracteres de cada respuesta con Amazon Polly Neural, suma 12,16 millones de caracteres × 16 $ = 194,56 $.
En un producto de voz, la línea de voz puede competir con la del modelo de lenguaje. Por eso conviene calcular las dos juntas antes de elegir proveedor.
Cómo obtener cifras realistas
La forma más rápida de estimar tus tokens es pegar un prompt representativo en nuestro contador de tokens. Recuerda que las aplicaciones de chat reenvían todo el historial en cada turno, así que los tokens de entrada crecen a lo largo de la conversación. Los modelos de razonamiento también cobran su «pensamiento» oculto como tokens de salida. Para la voz por separado, nuestra calculadora de coste de texto a voz compara proveedores en minutos de audio.
Limitaciones
Los resultados usan los precios de lista estándar, en dólares estadounidenses, tal como los facturan los proveedores. No incluyen descuentos por caché (a menudo un 90 % menos en la entrada repetida), por procesamiento por lotes (normalmente un 50 %), planes gratuitos, contratos por volumen, IVA ni recargos por residencia de datos. Las filas de DeepSeek usan la tarifa de horas punta. Gemini 3.8 Flash tiene un precio promocional hasta finales de 2026. Toma el resultado como una estimación y compruébalo en la página de cada proveedor antes de comprometerte.
Fuentes
Precios de lista de las páginas oficiales de Anthropic, OpenAI, Google, DeepSeek, Amazon Polly y ElevenLabs, revisados el 6 de octubre de 2026.