Calculadora de coste de LLMs y APIs de IA
Calcula cuánto te cuesta cada petición a una API de IA y tu gasto mensual estimado.
Coste por petición
$0,0440
$0,0200
Entrada
$0,0240
Salida
Coste estimado al mes (1000 peticiones)
$44,00
Precios por millón de tokens en USD, verificados en las páginas oficiales (agosto 2026). Los precios de DeepSeek son de referencia y pueden variar. Usa «Introducir precio manualmente» si tu proveedor ha cambiado tarifas.
Otras calculadoras
Preguntas frecuentes
¿Cómo se calcula el coste de una API de IA?
Las APIs de IA cobran por tokens: cada modelo tiene un precio por millón de tokens de entrada (input) y otro de salida (output). El coste de una petición es: (tokens de entrada × precio entrada) + (tokens de salida × precio salida), dividido entre un millón.
¿Qué es el prompt caching?
Es una función que reutiliza los tokens de entrada ya procesados en peticiones anteriores, con un descuento importante (hasta un 90% en algunos proveedores). Si tu aplicación envía siempre el mismo sistema prompt, activar el caché reduce mucho la factura.
¿Cuántos tokens tiene un texto normal?
Como referencia, 1.000 tokens equivalen aproximadamente a 750 palabras en inglés o unas 600 en español. Una página de texto suele rondar los 500-1.000 tokens.
¿Cuál es la API de IA más barata?
Entre las principales, DeepSeek V3 (0,27 $/1M de entrada) y GPT-5.6 Luna (0,20 $/1M) están entre las más económicas. Los modelos pequeños tipo Haiku o Flash ofrecen el mejor equilibrio coste/velocidad para tareas simples.
Cómo calcular el coste de una API de IA
El cálculo es directo: multiplica tus tokens de entrada por el precio de entrada del modelo, tus tokens de salida por el precio de salida, y divide entre un millón. Por ejemplo, con GPT-5.6 Terra (2 $/1M entrada, 12 $/1M salida), una petición de 10.000 tokens de entrada y 2.000 de salida cuesta 0,02 + 0,024 = 0,044 $. Con 1.000 peticiones al mes, 44 $.
Consejos para reducir tu factura de IA
Usa prompt caching para los tokens repetidos, elige el modelo más pequeño que resuelva tu tarea, limita la longitud de salida (max_tokens) y mide tus tokens reales con la API antes de dimensionar. Para tareas batch, casi todos los proveedores ofrecen descuentos del 50%.
