Calculadora de costes de API de LLM

Elige un modelo, pon los tokens de entrada y de salida que mueves en un mes y esto calcula lo que cuesta ese mes en 5 sitios a la vez. Los tokens de salida se facturan a la tarifa de salida, no a la de entrada: en una carga conversacional esa diferencia vale varias veces la factura. Cada fila muestra los precios unitarios que ha usado, así que puedes comprobar la multiplicación en lugar de creértela.

Tu volumen mensual

3 de nuestros 10 modelos tienen un precio externo verificado con el que compararse. El resto están tarifados en la página de precios: preferimos dejar un modelo fuera de esta lista antes que compararlo con una cifra sin fuente.

Lo interpretamos como 10M tokens

Lo interpretamos como 2M tokens

Funcionan las abreviaturas: 10M, 250k, 1.5B. Si no conoces tus cifras, el registro de uso de la consola anota ambos recuentos por petición y todos los paneles de proveedor tienen un total mensual.

Lo que cuesta ese mes

USD / 1M tokens

Coste mensual del mismo volumen de tokens en deepseek/deepseek-v4-flash en Y-API, el proveedor del modelo y tres agregadores
Y-APIEstás aquíAl mes$0.105Precio unitario$0.0075 entrada · $0.015 salida por 1M
OpenRouterdeepseek/deepseek-v4-flash-0731Al mes$0.843versión con fecha fija, no el modelo que se actualizaPrecio unitario$0.06 entrada · $0.12 salida por 1M
DeepInfradeepseek-ai/DeepSeek-V4-FlashAl mes$1.264capa estándar; las capas priority y flex difierenPrecio unitario$0.09 entrada · $0.18 salida por 1M
Together AIDeepSeek V4 Flash 0731Al mes$1.963versión con fecha fija, no el modelo que se actualizaPrecio unitario$0.14 entrada · $0.28 salida por 1M
DeepSeekEl más carodeepseek-v4-flashAl mes$3.521,2tarifa valle; existe además una capa de acierto de caché más barataPrecio unitario$0.22 entrada · $0.66 salida por 1M

La más cara de las filas con precio cuesta $3.52: 33.5× esta factura.

Con precio en 4 de los 4 sitios que consultamos para este modelo. Las filas sin cifra dicen cuál de los dos motivos se aplica.

La tarifa de recarga 20:1 es por tiempo limitado. Con la tarifa normal de 1:10, el mismo mes cuesta $0.21 aquí. El crédito que ya tengas en la cuenta no se recalcula.

  • 1tarifa valle
  • 2existe además una capa de acierto de caché más barata
  • 3versión con fecha fija, no el modelo que se actualiza
  • 4capa estándar; las capas priority y flex difieren

Método

Cómo se calcula esta factura

Entrada y salida se tarifan por separado
Los tokens de salida cuestan entre dos y cuatro veces los de entrada en todos los proveedores de esta tabla. Una calculadora que facture todos los tokens a la tarifa de entrada subestima una carga conversacional por un margen amplio, así que aquí se piden ambos recuentos y se aplican ambas tarifas.
Nuestra cifra es dinero, no crédito
Nuestras tarifas están en crédito USD y hoy una recarga de $1 se convierte en $20 de crédito. Nuestra fila divide entre 20 para llegar a los dólares que salen de verdad de tu tarjeta, que es la única unidad en la que están las demás filas.
Su tramo publicado más barato
Cuando un proveedor publica varias tarifas, aquí se toma la más barata que se aplique a una llamada normal en tiempo real: valle antes que punta, estándar antes que prioritario, la región más barata, el tramo de longitud de entrada más corto, y después de cualquier descuento por tiempo limitado. La entrada en caché queda excluida en todas partes, también en la nuestra. Cada una de esas decisiones está marcada bajo la tabla y todas favorecen al otro proveedor.
Nada está estimado
Una fila o tiene un precio leído en la propia página de tarifas de ese proveedor, o lo dice. Sin medias, sin «aproximadamente», sin cifras de artículos de terceros: solo para un modelo de DeepSeek, tres artículos muy citados dan tres precios incompatibles entre sí.

Límites

Lo que esta cifra no incluye

Caché de prompts

Las API de los proveedores facturan la entrada en caché muy por debajo de su tarifa sin acierto de caché y nosotros no tenemos un tramo equivalente. Si repites miles de veces un prompt de sistema largo y estable, el proveedor puede salirte más barato que nosotros: esta calculadora no lo mostrará, porque tarifa cada token como fallo de caché en ambos lados.

Tokens de razonamiento

En los modelos de razonamiento, los tokens que se facturan pero nunca aparecen en la respuesta no están en tu recuento de salida. Un modelo que sondeamos facturó 21,8× su tope de salida. Si llamas a un modelo de razonamiento, trata la cifra de salida que introduzcas como un mínimo.

Todo lo que no son tokens

Ningún proveedor de esta tabla cobra cuota mensual, así que la factura son solo tokens. También significa que esta aritmética no dice nada sobre límites de tasa, latencia ni qué modelos tiene realmente un proveedor, y eso es lo que suele decidir la elección.

Preguntas frecuentes

Preguntas sobre este cálculo

¿Por qué tengo que introducir los tokens de entrada y de salida por separado?
Porque en todas partes se tarifan distinto, normalmente por un factor de dos a cuatro. Una única casilla de «tokens totales» obligaría a suponer tu proporción entrada-salida, y la factura estaría equivocada más o menos por ese factor para cualquiera cuya carga no coincida. El escenario por defecto que se muestra al cargar es 5:1, cerca de una carga típica de chat o RAG; tu propio registro te dirá tu proporción real.
¿Por qué la factura de Y-API es tan baja?
Casi todo es la tarifa de recarga. Lee nuestras tarifas de crédito como si fueran dólares y quedan más o menos encima de los precios de lista de los propios proveedores; la diferencia que ves es la tarifa 20:1 a la que un dólar se convierte en crédito. Esa tarifa es por tiempo limitado y vuelve a 1:10, lo que duplica nuestra cifra: la línea bajo la tabla muestra lo que costaría ese mes.
¿Por qué hay filas vacías?
Por dos motivos distintos, y la tabla nunca los fusiona. Uno dice que el proveedor no ofrece ese modelo en absoluto. El otro significa que no hemos verificado un precio en su propia página de tarifas: no que el modelo no esté disponible, ni que sea barato. Rellenar cualquiera de los dos desde una fuente secundaria haría que el total pareciera completo mientras lo vuelve incorrecto.
¿Qué actualidad tienen estos precios?
Cada cifra externa se leyó en la propia página de tarifas de ese proveedor; la más antigua de esas lecturas es del 2026-08-26, que es la fecha que aparece arriba. Nuestras propias tarifas vienen del catálogo en vivo al compilar, así que nunca son más viejas que el último despliegue. Los proveedores sí cambian precios sin avisar, así que para una decisión que importe, abre el enlace a la fuente y compruébalo.

Procedencia

De dónde salen los precios

Todas las cifras externas de esta calculadora vienen del mismo conjunto de datos que la comparación completa de mercado, que lista un enlace a la fuente por proveedor junto a la fecha en que se leyó.

Comprueba la aritmética con una petición real

La forma más rápida de verificar todo esto es una llamada. Inicia sesión, envía una petición y el registro de uso muestra los recuentos exactos de tokens y el descuento exacto, que es la misma multiplicación que esta página acaba de hacer.