Comparación de precios de API de LLM
El mismo modelo de pesos abiertos puede costarte cantidades muy distintas según dónde lo llames. Abajo hay 10 modelos con precio en cinco lugares a la vez, todo convertido a la misma unidad: dólares de EE. UU. por 1M de tokens, fallo de caché, capa estándar. Cada cifra viene de la propia página de precios del proveedor en la fecha indicada, y las filas en las que nosotros somos la opción cara se destacan más abajo.
Método
Cómo se juntaron estos números
- Una sola unidad para todos
- Nuestras tarifas se cotizan en crédito en dólares; una recarga de $1 ahora se convierte en $20 de crédito. Las cifras de nuestra columna son crédito dividido por 20: el efectivo que realmente sale de tu tarjeta. Las cifras de los demás ya están en efectivo.
- La capa publicada más barata, con fallo de caché
- Cuando un proveedor publica varias capas, la tabla toma la más barata que aplica a una llamada normal: la tarifa valle de DeepSeek en lugar de la punta, la capa estándar de DeepInfra en lugar de la flex. La entrada en caché queda excluida en todas partes, también en la nuestra.
- Sus ID de modelos, no los nuestros
- Los agregadores suelen listar una instantánea con fecha (`-0813`) en lugar del modelo que se actualiza, o lo renombran por número de parámetros. Esos casos quedan marcados en la tabla; una build con fecha no garantiza comportarse como la actual.
- Dos tipos distintos de celda vacía
- Una celda que dice «No está en el catálogo» significa que lo comprobamos y el proveedor no tiene ese modelo. Una celda vacía significa que no lo verificamos, no que no esté disponible. Las dos cosas nunca se mezclan.
| ID del modelo | Y-API | Precio oficial del proveedor | OpenRouter | Together AI | DeepInfra |
|---|---|---|---|---|---|
| xiaomi/mimo-v2.5por 1M de tokens | Y-API$0.007 Entrada$0.014 Salida | Xiaomi MiMo$0.142existe además una capa de acierto de caché más barata Entrada$0.28 Salidamimo-v2.5 | OpenRouter$0.1193versión con fecha fija, no el modelo que se actualiza Entrada$0.238 Salidaxiaomi/mimo-v2.5-20260422 | Together AINo está en el catálogo | DeepInfraNo está en el catálogo |
| deepseek/deepseek-v4-flashpor 1M de tokens | Y-API$0.0075 Entrada$0.015 Salida | DeepSeek$0.221,2tarifa valle; existe además una capa de acierto de caché más barata Entrada$0.66 Salidadeepseek-v4-flash | OpenRouter$0.063versión con fecha fija, no el modelo que se actualiza Entrada$0.12 Salidadeepseek/deepseek-v4-flash-0731 | Together AI$0.143versión con fecha fija, no el modelo que se actualiza Entrada$0.28 SalidaDeepSeek V4 Flash 0731 | DeepInfra$0.095capa estándar; las capas priority y flex difieren Entrada$0.18 Salidadeepseek-ai/DeepSeek-V4-Flash |
| minimax/minimax-m2.7por 1M de tokens | Y-API$0.015 Entrada$0.06 Salida | MiniMax$0.302existe además una capa de acierto de caché más barata Entrada$1.20 SalidaMiniMax-M2.7 | Together AI$0.30 Entrada$1.20 SalidaMiniMax M2.7 | DeepInfraNo está en el catálogo | |
| minimax/minimax-m2.5por 1M de tokens | Y-API$0.015 Entrada$0.06 Salida | MiniMax$0.302existe además una capa de acierto de caché más barata Entrada$1.20 SalidaMiniMax-M2.5 | Together AINo está en el catálogo | DeepInfraNo está en el catálogo | |
| qwen/qwen3.7-pluspor 1M de tokens | Y-API$0.0175 Entrada$0.065 Salida | Alibaba Cloud Model StudioPrecio no publicado | Together AI$0.32 Entrada$1.28 SalidaQwen3.7-Plus | DeepInfraNo está en el catálogo | |
| deepseek/deepseek-v4-propor 1M de tokens | Y-API$0.025 Entrada$0.05 Salida | DeepSeek$0.661,2tarifa valle; existe además una capa de acierto de caché más barata Entrada$1.98 Salidadeepseek-v4-pro | OpenRouter$1.1223versión con fecha fija, no el modelo que se actualiza Entrada$3.366 Salidadeepseek/deepseek-v4-pro-0813 | Together AI$1.74 Entrada$3.48 SalidaDeepSeek V4 Pro | DeepInfra$1.305capa estándar; las capas priority y flex difieren Entrada$2.60 Salidadeepseek-ai/DeepSeek-V4-Pro |
| minimax/minimax-m2.7-highspeedpor 1M de tokens | Y-API$0.03 Entrada$0.12 Salida | MiniMax$0.60 Entrada$2.40 SalidaMiniMax-M2.7-highspeed | Together AINo está en el catálogo | DeepInfraNo está en el catálogo | |
| minimax/minimax-m2.5-highspeedpor 1M de tokens | Y-API$0.03 Entrada$0.12 Salida | MiniMax$0.60 Entrada$2.40 SalidaMiniMax-M2.5-highspeed | Together AINo está en el catálogo | DeepInfraNo está en el catálogo | |
| qwen/qwen3.7-maxpor 1M de tokens | Y-API$0.075 Entrada$0.225 Salida | Alibaba Cloud Model StudioPrecio no publicado | Together AI$1.25 Entrada$3.75 SalidaQwen3.7-Max | DeepInfra$2.505capa estándar; las capas priority y flex difieren Entrada$7.50 SalidaQwen/Qwen3.7-Max | |
| qwen/qwen3.8-maxpor 1M de tokens | Y-API$0.10 Entrada$0.30 Salida | Alibaba Cloud Model StudioPrecio no publicado | OpenRouter$2.00 Entrada$6.00 Salida | Together AI$2.504listado bajo otro nombre Entrada$6.25 SalidaQwen3.8-2.4T-A95B | DeepInfra$1.655capa estándar; las capas priority y flex difieren Entrada$4.951 SalidaQwen/Qwen3.8-Max |
- 1tarifa valle
- 2existe además una capa de acierto de caché más barata
- 3versión con fecha fija, no el modelo que se actualiza
- 4listado bajo otro nombre
- 5capa estándar; las capas priority y flex difieren
Dónde somos más baratos
La diferencia viene de la tasa de recarga, no de tarifas rebajadas
Lee nuestras tarifas en crédito como si fueran dólares y quedan casi encima de los precios de lista de los propios proveedores: idénticas para los cuatro modelos de MiniMax y para xiaomi/mimo-v2.5, un poco por encima de lo oficial para xiaomi/mimo-v2.5-pro, y por debajo para las dos builds de DeepSeek. Prácticamente toda la diferencia es la tasa de recarga de 20:1. Por eso también es honesto decir que el múltiplo es temporal: a 1:10 se reduce a la mitad.
Frente a los precios oficiales de los proveedores, efectivo contra efectivo, los modelos que podemos comparar quedan entre 20× y 29.3× más baratos en entrada.
Dónde costamos más
Tres casos en los que no deberías usar nosotros
Cargas de trabajo que aciertan en la caché de prompts constantemente
DeepSeek factura la entrada en caché a $0.022 por 1M en tarifa valle y Xiaomi a $0.0028, por debajo de nuestra tarifa en efectivo para los mismos modelos. Nosotros no tenemos ninguna capa de acierto de caché. Si repites una y otra vez un system prompt largo y estable, llamar directamente al proveedor puede costar menos que llamarnos.
Modelos fuera de nuestro catálogo
Nuestro catálogo es de 21 ID de modelos. GPT, Claude y Gemini no están en él, ni tampoco la mayor parte de la larga cola que lleva un agregador. Ninguna comparación de precios sirve si el modelo que necesitas no está en la lista.
Cuando necesitas un precio que no pueda cambiar
El múltiplo de esta tabla se apoya en una tasa de recarga por tiempo limitado de 20:1. El crédito que ya está en tu cuenta no se reevalúa, pero las recargas nuevas después de que acabe la promoción se convierten a 1:10, lo que reduce a la mitad cada ventaja mostrada aquí. Los precios de lista de los proveedores tampoco son contractuales, pero se mueven despacio y a la vista de todos.
Ausencias
Lo que falta en esta tabla, y por qué
- No están todos los modelos
- 11 de nuestros 21 modelos no aparecen. Dos modelos Qwen no tienen precio externo verificado de ningún tipo, dos builds de DeepSeek no aparecen en ninguna página de precios que hayamos podido consultar, y un modelo no declara su proveedor.
- Alibaba no publica precio de Qwen
- Sus páginas públicas de modelos listan solo capacidades; la facturación por token queda detrás de una consola específica por región. Por eso la columna oficial está vacía en todas las filas de Qwen: una celda vacía es más responsable que un número copiado de un blog. Nuestras tarifas están en una página pública y en un endpoint legible por máquina.
- No se usó ninguna cifra de terceros
- Solo en un modelo de DeepSeek, tres publicaciones muy citadas manejan tres precios mutuamente incompatibles. Aquí solo cuenta como fuente la propia página de precios del proveedor.
- Los agregadores discrepan hasta 2×
- Qwen3.7-Max cuesta $1.25 por 1M de entrada en Together AI y $2.50 en DeepInfra: mismo modelo, misma unidad, mismo día. Trata cualquier cifra suelta de un agregador como un punto de datos, no como el precio de mercado.
Preguntas frecuentes
Preguntas que plantea esta tabla
- ¿Cuál es la forma más barata de llamar a DeepSeek V4 Pro?
- Verificado el 2026-08-26, por 1M de tokens de entrada: Y-API $0.025 en efectivo, la API del propio DeepSeek $0.66 en tarifa valle y $1.32 en tarifa punta, DeepInfra $1.30, OpenRouter $1.122 para la build con fecha 0813, Together AI $1.74. El único caso que se invierte es el de un prompt cacheado constantemente: DeepSeek cobra $0.022 por 1M por la entrada en caché, un poco por debajo de nuestra tarifa.
- ¿Por qué los precios de Y-API se cotizan en crédito y no en dólares?
- El crédito es la unidad de medición dentro del servicio: una recarga convierte dólares en crédito a la tasa vigente y cada modelo descuenta crédito por token. Cotizar en crédito mantiene estable la cifra por modelo cuando cambia la tasa de recarga. Para obtener el precio en efectivo, divide la tarifa en crédito por la tasa vigente: 20 hoy, 10 cuando acabe la promoción. Ambas cifras están publicadas, y el precio en efectivo está en el endpoint de precios legible por máquina.
- ¿Hay algún agregador más barato que el propio proveedor del modelo?
- Sí, y esta tabla tiene un ejemplo. OpenRouter lista la build con fecha xiaomi/mimo-v2.5-20260422 a $0.119 por 1M de entrada, por debajo de los $0.14 del propio Xiaomi. Los agregadores a veces listan solo una instantánea con fecha, que no seguirá al modelo que se actualiza: más barato, pero no es lo mismo.
- ¿Cuánto de la diferencia es descuento real y cuánto es la promoción de recarga?
- Casi toda es la promoción. Comparadas como si el crédito fueran dólares, nuestras tarifas igualan los precios de lista de los proveedores para los cuatro modelos de MiniMax y para xiaomi/mimo-v2.5, quedan un 3 % por encima de lo oficial para xiaomi/mimo-v2.5-pro y por debajo para las dos builds de DeepSeek. Los grandes múltiplos de la tabla vienen de la tasa de recarga de 20:1, que es por tiempo limitado y volverá a 1:10.
- ¿Cada cuánto se actualiza esta tabla?
- Cada cifra lleva la fecha en que se verificó, mostrada en la parte superior de la página. Los proveedores cambian precios sin aviso, así que trata lo que tenga más de unas semanas como un punto de partida y sigue el enlace de la fuente antes de comprometer gasto. Nuestras tarifas se sincronizan del catálogo en vivo en tiempo de compilación, así que nunca están más desactualizadas que el último despliegue.
Procedencia
Fuentes
Un enlace por proveedor, cada uno apuntando a la página de donde se leyeron las cifras. Las tarifas del propio Y-API vienen de sus páginas de modelos y de precios, y de https://y-api.bestvirtualgoods.com/pricing.json.
Contrasta un modelo con tu propia factura
Elige el modelo que más llamas, búscalo en la tabla y multiplícalo por el número de tokens del mes pasado. Si la cuenta sale, inicia sesión y apunta una llamada aquí: el registro de peticiones mostrará el descuento real.