Saltar al contenido
AI suite

Calculadora de coste de API LLM

Pega un prompt y la longitud de salida esperada para estimar el coste de la API en modelos de Claude, GPT y Gemini, lado a lado. Los precios se actualizan desde un catálogo público cada vez que se reconstruye el sitio.

Todo se ejecuta localmente en tu navegador: tu texto nunca se envía a ningún servidor, solo la lista de precios se obtiene de antemano al compilar.

Guía: Cómo usarlo y características

  • Pega un prompt o documento en el área de texto y el recuento de tokens de entrada de cada modelo se actualiza automáticamente.
  • Los "tokens de salida esperados" son un único valor aplicado a todos los modelos.
  • La tabla se ordena automáticamente por coste total, del más barato al más caro, y marca el modelo más barato con una etiqueta.

FAQ: Preguntas frecuentes

  • ¿Qué tan actualizados están los datos de precios?

    Se actualizan automáticamente desde un catálogo público de precios (OpenRouter) cada vez que se reconstruye este sitio. La página muestra la fecha de obtención para que sepas exactamente su antigüedad. Si una actualización falla, se conserva el precio confirmado anteriormente.
  • ¿Coincide exactamente con el precio oficial de la API?

    No, trátalo como referencia. Depende de un agregador externo (OpenRouter) que puede diferir del anuncio oficial del proveedor en el momento o en detalles (descuentos por lote, caché de prompts, recargos por contexto largo, etc.). Consulta siempre la página oficial de precios antes de decidir.
  • ¿Por qué no se calculan los tokens de salida a partir de texto real?

    La salida aún no se ha generado, así que no hay nada que tokenizar. En su lugar, introduces un número de "tokens de salida esperados" que se aplica por igual a todos los modelos comparados.
  • ¿Se envía mi prompt a algún servidor?

    No. El análisis y el cálculo de coste ocurren enteramente en tu navegador. La única solicitud de red es la de la lista de precios, que ocurre una vez durante la compilación del sitio.

Casos de uso: Casos de uso habituales

  • Comparar el coste antes de elegir un modelo

    Compara cuánto cuesta el mismo prompt en modelos de Claude, GPT y Gemini y elige el que se ajuste a tu presupuesto.

  • Estimar el coste de un system prompt

    Obtén una estimación mensual aproximada del coste de un system prompt largo o del contexto que inserta un pipeline RAG.

  • Entender la diferencia de coste entre modelos grandes y ligeros

    Observa la diferencia real en dólares entre un modelo de gama alta y uno ligero para el mismo volumen de entrada/salida.

Notas: Notas y limitaciones

  • No lo uses para facturación

    Los precios mostrados son valores de referencia de un agregador externo y pueden diferir de tu factura real. Consulta siempre la página oficial de precios antes de una estimación formal.

  • El recuento de tokens de salida es un valor hipotético

    El coste de salida se calcula a partir del número de "tokens de salida esperados" que introduces, aplicado por igual a todos los modelos, no a partir de una respuesta real generada.

  • No incluye descuentos de caché ni recargos por contexto largo

    No se aplican precios condicionales como descuentos de caché de prompts, descuentos por lote o recargos por superar cierto umbral de contexto.

Caracteres: 0 Palabras: 0 Líneas: 0

Se aplica por igual a todos los modelos, ya que no hay texto generado que tokenizar por modelo.

Coste por modelo

Modelo Tokens de entrada Tokens de salida $ / 1M ent. · sal. Coste estimado
Claude Opus 4.8 0 0 $5 · $25 $0.00
Claude Sonnet 4.5 0 0 $3 · $15 $0.00
Claude Haiku 4.5 0 0 $1 · $5 $0.00
GPT-5.5 0 0 $5 · $30 $0.00
GPT-5 0 0 $1.25 · $10 $0.00
GPT-4.1 0 0 $2 · $8 $0.00
GPT-4o 0 0 $2.5 · $10 $0.00
GPT-4 Turbo 0 0 $10 · $30 $0.00
GPT-3.5 Turbo 0 0 $0.5 · $1.5 $0.00
Gemini 3 Pro 0 0 $2 · $12 $0.00
Gemini 2.5 Flash 0 0 $0.3 · $2.5 $0.00

Datos de precios actualizados el: 2026-08-19 · Fuente: catálogo público de modelos de OpenRouter (precio de referencia, no el precio oficial del proveedor).

Los costes son estimaciones para comparación aproximada, no para facturación. Los recuentos de tokens de Claude y Gemini son heurísticos (±10–20%) y no incluyen la sobrecarga de la API de chat. Consulta siempre la página de precios oficial antes de decidir.

Artículos para esta herramienta

Artículos recientes

Caso de uso
2026-08-07

Opciones de curl: qué hacen realmente -X, -H y -d

Referencia de las opciones de curl que aparecen en el trabajo diario con APIs: por qué -d ya implica POST, en qué se diferencia de --data-raw, la @ inicial que lee un archivo sin avisar, comillas simples frente a dobles, y por qué -k y -L merecen más cuidado del habitual.

Introducción
2026-08-06

Convertir entre JSON Schema y Zod: cómo se corresponden required y .optional()

Por dentro de un conversor bidireccional que transforma JSON Schema en un esquema de Zod y el código Zod de vuelta a JSON Schema. Incluye los valores por defecto invertidos entre required y .optional(), la tabla de correspondencia de restricciones y cómo se analiza Zod sin ejecutar código.

Caso de uso
2026-08-06

Orden de evaluación en SQL: por qué WHERE no ve el alias del SELECT

El orden en que escribe las cláusulas de SQL no es el orden en que se ejecutan. Referencia del orden lógico (FROM → WHERE → GROUP BY → HAVING → SELECT → ORDER BY → LIMIT), por qué fallan los alias en WHERE, cuándo usar WHERE y cuándo HAVING, ONLY_FULL_GROUP_BY y la trampa de LEFT JOIN con WHERE.

Caso de uso
2026-08-06

Formato unified diff: cómo leer las cabeceras @@ de git diff

Cómo leer el formato unified diff que genera git: qué significan los cuatro números de @@ -12,7 +12,9 @@, por qué un cambio de un solo carácter aparece como línea completa reemplazada, las trampas de los espacios y los finales de línea, \ No newline at end of file, los diffs combinados @@@ en los merges y la detección de renombrados.

Caso de uso
2026-08-06

Conversión UTC⇄JST: tabla del desfase de 9 horas y errores de zona horaria

Convierta entre UTC y la hora de Japón (JST) con una tabla de referencia, y vea por qué la diferencia con España cambia entre 7 y 8 horas según el horario de verano. Incluye el significado de Z y +09:00 en ISO 8601, cuándo JavaScript desplaza las fechas, el comportamiento de MySQL/PostgreSQL y por qué el cron de GitHub Actions siempre corre en UTC.

Caso de uso
2026-08-04

Referencia de CREATE TABLE: tipos y restricciones en MySQL, PostgreSQL y SQLite

Referencia de CREATE TABLE (DDL) con tablas comparativas entre bases de datos: tipos de datos, autoincremento (AUTO_INCREMENT / IDENTITY / rowid), comportamiento de ON DELETE en claves foráneas y la restricción CHECK que MySQL ignora en silencio.

Anuncio

Anuncio