Calculatop

Calculadora de coste de LLMs y APIs de IA

Calcula cuánto te cuesta cada petición a una API de IA y tu gasto mensual estimado.

Precios actualizados: 24 de agosto de 2026

Coste por petición

$0,0440

$0,0200

Entrada

$0,0240

Salida

Coste estimado al mes (1000 peticiones)

$44,00

Precios por millón de tokens en USD, verificados en las páginas oficiales (agosto 2026). Los precios de DeepSeek son de referencia y pueden variar. Usa «Introducir precio manualmente» si tu proveedor ha cambiado tarifas.

Otras calculadoras

Preguntas frecuentes

¿Cómo se calcula el coste de una API de IA?

Las APIs de IA cobran por tokens: cada modelo tiene un precio por millón de tokens de entrada (input) y otro de salida (output). El coste de una petición es: (tokens de entrada × precio entrada) + (tokens de salida × precio salida), dividido entre un millón.

¿Qué es el prompt caching?

Es una función que reutiliza los tokens de entrada ya procesados en peticiones anteriores, con un descuento importante (hasta un 90% en algunos proveedores). Si tu aplicación envía siempre el mismo sistema prompt, activar el caché reduce mucho la factura.

¿Cuántos tokens tiene un texto normal?

Como referencia, 1.000 tokens equivalen aproximadamente a 750 palabras en inglés o unas 600 en español. Una página de texto suele rondar los 500-1.000 tokens.

¿Cuál es la API de IA más barata?

Entre las principales, DeepSeek V3 (0,27 $/1M de entrada) y GPT-5.6 Luna (0,20 $/1M) están entre las más económicas. Los modelos pequeños tipo Haiku o Flash ofrecen el mejor equilibrio coste/velocidad para tareas simples.

Cómo calcular el coste de una API de IA

El cálculo es directo: multiplica tus tokens de entrada por el precio de entrada del modelo, tus tokens de salida por el precio de salida, y divide entre un millón. Por ejemplo, con GPT-5.6 Terra (2 $/1M entrada, 12 $/1M salida), una petición de 10.000 tokens de entrada y 2.000 de salida cuesta 0,02 + 0,024 = 0,044 $. Con 1.000 peticiones al mes, 44 $.

Consejos para reducir tu factura de IA

Usa prompt caching para los tokens repetidos, elige el modelo más pequeño que resuelva tu tarea, limita la longitud de salida (max_tokens) y mide tus tokens reales con la API antes de dimensionar. Para tareas batch, casi todos los proveedores ofrecen descuentos del 50%.