Herramientas para desarrolladores

Calculadora de costes de LLM: Claude, GPT, Gemini

🔒 Funciona en tu navegador

Calcula y compara los costes de API de LLM para Claude, GPT-4o, Gemini, Llama y más. Introduce el número de tokens de entrada y salida para ver el precio exacto. Todo se calcula enteramente en tu navegador.

Cómo usar esta herramienta

  1. Selecciona tu modelo y el nivel de precios en el menú desplegable.
  2. Introduce tus estimaciones de tokens de entrada y salida.
  3. Consulta el desglose de costes calculado para tu llamada a la API.
Input cost
$0.03
Output cost
$0.02
Total cost
$0.04

Model comparison (same token counts, sorted by cost)

ModelProviderInput costOutput costTotal
GPT-4o miniOpenAI$0.0015$0.0012$0.0027
Gemini 2.5 FlashGoogle$0.0015$0.0012$0.0027
Llama 3.3 70B (Groq)Groq$0.0059$0.0016$0.0075
Claude Haiku 4.5Anthropic$0.0080$0.0080$0.02
Gemini 2.5 ProGoogle$0.01$0.02$0.03
GPT-4oOpenAI$0.03$0.02$0.04
Claude Sonnet 4.6Anthropic$0.03$0.03$0.06
Claude Opus 4.8Anthropic$0.15$0.15$0.30

Pricing per 1M tokens as of June 2026. All calculations run in your browser — no API calls.

Acerca de Calculadora de coste de LLM

La calculadora de costes de LLM estima cuánto costará una llamada a la API de un gran modelo de lenguaje según el número de tokens de entrada y salida que use, y después ordena los principales modelos de más barato a más caro para esa misma carga de trabajo. Eliges un modelo, introduces el número de tokens de entrada (el prompt y el contexto que envías) y de salida (el texto que el modelo genera), y calcula el coste de entrada, el de salida y el total. Como los proveedores tarifan estas dos direcciones por separado, desglosarlas deja claro dónde se va realmente tu gasto.

El cálculo es directo: el coste de entrada es igual a los tokens de entrada divididos entre un millón, multiplicados por el precio de entrada por millón de ese modelo, y el coste de salida se calcula igual con el precio de salida. Los totales pequeños se muestran con decimales adicionales para que las fracciones de céntimo sigan siendo visibles. La herramienta incorpora los precios publicados actuales de ocho modelos: Claude Opus 4.8 a 15 $ de entrada y 75 $ de salida por millón de tokens, Claude Sonnet 4.6 a 3 $ y 15 $, Claude Haiku 4.5 a 0,80 $ y 4 $, GPT-4o a 2,50 $ y 10 $, GPT-4o mini a 0,15 $ y 0,60 $, Gemini 2.5 Pro a 1,25 $ y 10 $, Gemini 2.5 Flash a 0,15 $ y 0,60 $, y Llama 3.3 70B en Groq a 0,59 $ y 0,79 $.

Junto al desglose del modelo que has elegido, la herramienta construye una tabla comparativa que pasa exactamente los mismos recuentos de tokens por los ocho modelos y los ordena por coste total, de modo que ves al instante cuánto ahorrarías cambiando de nivel o de proveedor para una carga de trabajo dada. Esta es la parte más útil en la práctica: convierte un precio abstracto por millón en una cifra concreta por llamada y muestra, por ejemplo, hasta qué punto las cargas con mucha salida favorecen un precio de salida más barato. Todo se calcula localmente, así que tus recuentos de tokens y los prompts que representan nunca se envían a ninguna parte.

Ten en cuenta dos cosas. Los precios son tarifas publicadas a mediados de 2026, guardadas en la herramienta y no obtenidas en directo, así que verifica la tarifa actual en la página de precios del proveedor antes de fiarte de una cifra para presupuestar. Y la estimación depende únicamente de los recuentos de tokens; no tiene en cuenta los descuentos por caché de prompts, los precios de la API por lotes, los recargos por ajuste fino ni los créditos de capa gratuita, todos los cuales pueden subir o bajar tu factura real. Para estimar una cifra mensual, multiplica el total por llamada por el volumen de peticiones que esperas.

Preguntas frecuentes

¿Cómo calcula el coste la calculadora?
Aplica las tarifas publicadas por millón de tokens de cada modelo a tus recuentos de tokens. El coste de entrada es el número de tokens de entrada dividido entre un millón, multiplicado por el precio de entrada por millón; el coste de salida usa la misma fórmula con el precio de salida. El total suma ambos. Como cada proveedor tarifa entrada y salida por separado, la herramienta muestra cada parte para que veas qué lado de la llamada impulsa tu gasto.
¿Por qué los tokens de entrada y de salida tienen precios distintos?
Generar texto nuevo es más caro computacionalmente para un modelo que leer texto existente, así que los proveedores casi siempre cobran más por token de salida que por token de entrada, a menudo varias veces más. Esto significa que las cargas que producen respuestas largas cuestan desproporcionadamente más que las que tienen prompts largos pero respuestas cortas. Separar ambos en la calculadora te ayuda a ver ese efecto y a elegir un modelo cuya forma de precio encaje con tu patrón de uso.
¿Qué modelos y precios se incluyen?
Ocho modelos con sus tarifas publicadas por millón de tokens: Claude Opus 4.8 (15 $ entrada / 75 $ salida), Claude Sonnet 4.6 (3 $ / 15 $), Claude Haiku 4.5 (0,80 $ / 4 $), GPT-4o (2,50 $ / 10 $), GPT-4o mini (0,15 $ / 0,60 $), Gemini 2.5 Pro (1,25 $ / 10 $), Gemini 2.5 Flash (0,15 $ / 0,60 $) y Llama 3.3 70B en Groq (0,59 $ / 0,79 $). La tabla comparativa pasa tus recuentos de tokens por todos ellos a la vez.
¿Cómo de actuales son los precios?
Las tarifas reflejan precios publicados a mediados de 2026 y están guardadas en la herramienta en lugar de obtenerse en directo de las APIs de los proveedores. Eso mantiene la calculadora rápida y totalmente del lado del cliente, pero el precio de los LLM cambia con frecuencia por la competencia, así que usa el resultado como una estimación aproximada y confirma la tarifa actual exacta en la página oficial de precios del proveedor antes de fijarla en un presupuesto.
¿Puedo comparar el coste entre todos los modelos a la vez?
Sí. La herramienta toma los recuentos de tokens de entrada y salida que introduces y los pasa por todos los modelos incluidos, y después muestra una tabla ordenada de más barato a más caro por total. Así es fácil ver cuánto costaría una carga de trabajo dada en cada opción y detectar dónde cambiar a un nivel o proveedor más barato te ahorraría más para tu mezcla concreta de entrada y salida.
¿La estimación incluye descuentos como caché de prompts o precios por lotes?
No. El cálculo se basa únicamente en las tarifas estándar por token y en los recuentos que introduces. No tiene en cuenta los descuentos por caché de prompts, los precios de la API por lotes, los recargos por ajuste fino, los acuerdos por volumen ni los créditos de capa gratuita, cualquiera de los cuales puede cambiar tu factura real. Trata el número como una base limpia para una sola llamada a tarifa estándar y aplica después los descuentos específicos que tu cuenta tenga.
¿Cómo estimo mi factura mensual?
Estima los tokens de entrada y salida de una petición típica, obtén el total por llamada en la calculadora y multiplícalo por el número de peticiones que esperas al mes. Para tráfico mixto, haz el cálculo para cada tipo de petición principal y suma los resultados. Recuerda que esto da una estimación a tarifa estándar; la caché, los lotes o los descuentos por uso comprometido pueden reducir el total real.
¿Mis recuentos de tokens o mis prompts se envían a alguna parte?
No. Todos los cálculos se ejecutan enteramente en tu navegador, y solo introduces recuentos de tokens, nunca los prompts en sí. Nada de tu uso se transmite a un servidor, así que puedes modelar costes para aplicaciones confidenciales o sin lanzar con total libertad.
guide

LLM API Cost Calculator: How to Estimate Your Bill Before You Build

How LLM API pricing works (input vs output tokens), real cost examples for Claude, GPT-4o, and Gemini, and strategies to reduce your bill.

Más herramientas gratuitasVer las 492 →
Calculadora de costes de LLM: Claude, GPT, Gemini | brevio