“¿Cuánto más pagaría al mes si cambio este prompt a GPT-5.5?” “¿Cuánto ahorraría con un modelo más barato?” — al desarrollar con LLM, quiere una comparación de costos en las mismas condiciones como base para elegir modelo. La Calculadora de costos de API de LLM solo necesita que pegue un prompt e indique los tokens de salida esperados, y compara de un vistazo el costo por solicitud de los principales modelos de Claude, GPT y Gemini — todo en su navegador.

Calculadora de costos de API de LLM ― costos por modelo listados de menor a mayor

Estructura básica del precio de las API de LLM

El precio de las API de los principales proveedores comparte prácticamente esta estructura:

  • La entrada (prompt) y la salida (texto generado) tienen tarifas distintas — la salida suele costar de 3 a 5 veces más
  • La unidad de facturación son dólares por millón de tokens ($/1M tokens)
  • La tarifa cambia en órdenes de magnitud según el nivel del modelo (10 a 100 veces entre modelos insignia y ligeros)

Es decir, estimar el costo requiere calcular “tokens de entrada × tarifa de entrada + tokens de salida × tarifa de salida” para cada modelo. Hacerlo a mano consultando tablas de precios es tedioso, así que esta herramienta lo calcula todo de una vez.

Cómo usarla

  1. Abra la Calculadora de costos de API de LLM y pegue su prompt (system prompt + entrada de usuario representativa) en el área de texto.
  2. Indique los tokens de salida esperados (300–800 para una respuesta de chat, 200–500 para un resumen, como referencia).
  3. La tabla de costos por modelo se muestra ordenada de menor a mayor costo total, con el desglose de costo de entrada/salida y la tarifa de entrada/salida ($/1M) de cada modelo.

Los tokens de entrada se calculan automáticamente a partir del prompt. Los modelos GPT se cuentan con precisión (tokenizadores o200k_base / cl100k_base); Claude y Gemini usan estimaciones basadas en la composición de caracteres (la misma lógica de estimación que el contador de tokens).

Los datos de precios se actualizan automáticamente

Los cambios de precio de los modelos son frecuentes. La tabla de tarifas de esta herramienta se obtiene automáticamente en el momento de construir el sitio desde un catálogo de precios público y se incrusta como datos estáticos.

  • En tiempo de ejecución (cuando visita la página) no ocurre ninguna comunicación externa — el cálculo se ejecuta enteramente en su navegador
  • El prompt que pega tampoco se envía a un servidor
  • La fecha de obtención de cada tarifa se muestra en la herramienta

Límites de la estimación: qué no incluye

Las cifras de esta herramienta son una aproximación por solicitud. La factura real se ve afectada por:

  • Descuentos de caché de prompt — el mecanismo que reduce sustancialmente la tarifa de entrada al reutilizar el mismo prefijo no está incluido en el cálculo
  • Descuentos de API por lotes — los descuentos del procesamiento asíncrono por lotes (a menudo 50% en muchos proveedores) tampoco están incluidos
  • Overhead de la API de chat — los tokens adicionales que consumen la estructura de mensajes y las definiciones de herramientas no se incluyen en la entrada
  • Los tokens de Claude / Gemini son aproximados — puede haber un margen de error de ±10–20%

Si necesita cifras exactas, como para planificar un presupuesto mensual, consulte la página oficial de precios y el panel de facturación de cada proveedor. Para comparaciones relativas entre modelos y para captar el orden de magnitud, la estimación de esta herramienta es suficiente.

Preguntas frecuentes

¿Qué tan precisos son los costos mostrados?

Los modelos GPT se cuentan con tokenizadores exactos, así que son precisos siempre que la tabla de tarifas esté actualizada. Los tokens de Claude y Gemini son estimaciones basadas en el tipo de carácter, con un margen de error de ±10–20%. Para comparaciones entre modelos y presupuestos aproximados, es precisión suficiente.

¿De cuándo son los datos de precios?

Son valores obtenidos automáticamente de un catálogo de precios público en el momento de construir el sitio, y la fecha de obtención se muestra en la herramienta. Justo después de un cambio de precio de un proveedor puede haber un desfase hasta que se refleje, así que verifique también las páginas oficiales de precios antes de decisiones contractuales.

¿Se consideran los descuentos de caché de prompt o de lotes?

No. Lo mostrado es una estimación con tarifas estándar sin descuentos. Si usa caché de prompt o API por lotes, el costo real puede ser considerablemente menor que el mostrado.

¿Se envía a algún sitio el prompt que pego?

No. Tanto el cálculo de tokens como el de costos se ejecutan enteramente en su navegador — es seguro estimar con prompts que no pueden salir de su organización.