Calculadora de costes de API de LLM
Elige un modelo, pon los tokens de entrada y de salida que mueves en un mes y esto calcula lo que cuesta ese mes en 5 sitios a la vez. Los tokens de salida se facturan a la tarifa de salida, no a la de entrada: en una carga conversacional esa diferencia vale varias veces la factura. Cada fila muestra los precios unitarios que ha usado, así que puedes comprobar la multiplicación en lugar de creértela.
Lo que cuesta ese mes
USD / 1M tokens
| Dónde lo llamas | Al mes | Precio unitario |
|---|---|---|
| Y-APIEstás aquí | Al mes$0.105 | Precio unitario$0.0075 entrada · $0.015 salida por 1M |
| OpenRouterdeepseek/deepseek-v4-flash-0731 | Al mes$0.843versión con fecha fija, no el modelo que se actualiza | Precio unitario$0.06 entrada · $0.12 salida por 1M |
| DeepInfradeepseek-ai/DeepSeek-V4-Flash | Al mes$1.264capa estándar; las capas priority y flex difieren | Precio unitario$0.09 entrada · $0.18 salida por 1M |
| Together AIDeepSeek V4 Flash 0731 | Al mes$1.963versión con fecha fija, no el modelo que se actualiza | Precio unitario$0.14 entrada · $0.28 salida por 1M |
| DeepSeekEl más carodeepseek-v4-flash | Al mes$3.521,2tarifa valle; existe además una capa de acierto de caché más barata | Precio unitario$0.22 entrada · $0.66 salida por 1M |
La más cara de las filas con precio cuesta $3.52: 33.5× esta factura.
Con precio en 4 de los 4 sitios que consultamos para este modelo. Las filas sin cifra dicen cuál de los dos motivos se aplica.
La tarifa de recarga 20:1 es por tiempo limitado. Con la tarifa normal de 1:10, el mismo mes cuesta $0.21 aquí. El crédito que ya tengas en la cuenta no se recalcula.
- 1tarifa valle
- 2existe además una capa de acierto de caché más barata
- 3versión con fecha fija, no el modelo que se actualiza
- 4capa estándar; las capas priority y flex difieren
Método
Cómo se calcula esta factura
- Entrada y salida se tarifan por separado
- Los tokens de salida cuestan entre dos y cuatro veces los de entrada en todos los proveedores de esta tabla. Una calculadora que facture todos los tokens a la tarifa de entrada subestima una carga conversacional por un margen amplio, así que aquí se piden ambos recuentos y se aplican ambas tarifas.
- Nuestra cifra es dinero, no crédito
- Nuestras tarifas están en crédito USD y hoy una recarga de $1 se convierte en $20 de crédito. Nuestra fila divide entre 20 para llegar a los dólares que salen de verdad de tu tarjeta, que es la única unidad en la que están las demás filas.
- Su tramo publicado más barato
- Cuando un proveedor publica varias tarifas, aquí se toma la más barata que se aplique a una llamada normal en tiempo real: valle antes que punta, estándar antes que prioritario, la región más barata, el tramo de longitud de entrada más corto, y después de cualquier descuento por tiempo limitado. La entrada en caché queda excluida en todas partes, también en la nuestra. Cada una de esas decisiones está marcada bajo la tabla y todas favorecen al otro proveedor.
- Nada está estimado
- Una fila o tiene un precio leído en la propia página de tarifas de ese proveedor, o lo dice. Sin medias, sin «aproximadamente», sin cifras de artículos de terceros: solo para un modelo de DeepSeek, tres artículos muy citados dan tres precios incompatibles entre sí.
Límites
Lo que esta cifra no incluye
Caché de prompts
Las API de los proveedores facturan la entrada en caché muy por debajo de su tarifa sin acierto de caché y nosotros no tenemos un tramo equivalente. Si repites miles de veces un prompt de sistema largo y estable, el proveedor puede salirte más barato que nosotros: esta calculadora no lo mostrará, porque tarifa cada token como fallo de caché en ambos lados.
Tokens de razonamiento
En los modelos de razonamiento, los tokens que se facturan pero nunca aparecen en la respuesta no están en tu recuento de salida. Un modelo que sondeamos facturó 21,8× su tope de salida. Si llamas a un modelo de razonamiento, trata la cifra de salida que introduzcas como un mínimo.
Todo lo que no son tokens
Ningún proveedor de esta tabla cobra cuota mensual, así que la factura son solo tokens. También significa que esta aritmética no dice nada sobre límites de tasa, latencia ni qué modelos tiene realmente un proveedor, y eso es lo que suele decidir la elección.
Preguntas frecuentes
Preguntas sobre este cálculo
- ¿Por qué tengo que introducir los tokens de entrada y de salida por separado?
- Porque en todas partes se tarifan distinto, normalmente por un factor de dos a cuatro. Una única casilla de «tokens totales» obligaría a suponer tu proporción entrada-salida, y la factura estaría equivocada más o menos por ese factor para cualquiera cuya carga no coincida. El escenario por defecto que se muestra al cargar es 5:1, cerca de una carga típica de chat o RAG; tu propio registro te dirá tu proporción real.
- ¿Por qué la factura de Y-API es tan baja?
- Casi todo es la tarifa de recarga. Lee nuestras tarifas de crédito como si fueran dólares y quedan más o menos encima de los precios de lista de los propios proveedores; la diferencia que ves es la tarifa 20:1 a la que un dólar se convierte en crédito. Esa tarifa es por tiempo limitado y vuelve a 1:10, lo que duplica nuestra cifra: la línea bajo la tabla muestra lo que costaría ese mes.
- ¿Por qué hay filas vacías?
- Por dos motivos distintos, y la tabla nunca los fusiona. Uno dice que el proveedor no ofrece ese modelo en absoluto. El otro significa que no hemos verificado un precio en su propia página de tarifas: no que el modelo no esté disponible, ni que sea barato. Rellenar cualquiera de los dos desde una fuente secundaria haría que el total pareciera completo mientras lo vuelve incorrecto.
- ¿Qué actualidad tienen estos precios?
- Cada cifra externa se leyó en la propia página de tarifas de ese proveedor; la más antigua de esas lecturas es del 2026-08-26, que es la fecha que aparece arriba. Nuestras propias tarifas vienen del catálogo en vivo al compilar, así que nunca son más viejas que el último despliegue. Los proveedores sí cambian precios sin avisar, así que para una decisión que importe, abre el enlace a la fuente y compruébalo.
Procedencia
De dónde salen los precios
Todas las cifras externas de esta calculadora vienen del mismo conjunto de datos que la comparación completa de mercado, que lista un enlace a la fuente por proveedor junto a la fecha en que se leyó.
Comprueba la aritmética con una petición real
La forma más rápida de verificar todo esto es una llamada. Inicia sesión, envía una petición y el registro de uso muestra los recuentos exactos de tokens y el descuento exacto, que es la misma multiplicación que esta página acaba de hacer.