Y-API frente a Together AI
Together AI es otra pasarela que revende los modelos de los mismos proveedores, así que esto no son dos laboratorios compitiendo: es una sola pregunta. Para los 2 modelos que ambos vendemos, ¿sale más barato pasar por Y-API? Las dos columnas de abajo son efectivo por millón de tokens de entrada, y la de Together AI es la capa más baja que encontramos en su propia lista de precios, lo que convierte cada múltiplo en un suelo y no en un titular.
| Dimensión | Y-API | Together AI |
|---|---|---|
| Protocolo de la API | Y-APIOpenAI Chat Completions. Apunta base_url a https://api.y-api.bestvirtualgoods.com/v1, cambia la clave y deja el resto del código igual. | Together AIUn endpoint compatible con OpenAI propio, en otra base_url y con otros nombres de modelo: mira la fila de cada modelo más abajo. |
| Modelos con una sola clave | Y-API10 IDs de modelo de 6 proveedores, un saldo, una clave. | Together AISu propio catálogo publicado. De los 10 modelos con los que lo comparamos, 2 tienen precio allí. |
| qwen/qwen3.8-max — entrada / millón de tokens | Y-API$0.10 en efectivo | Together AI$2.50 como Qwen3.8-2.4T-A95B: 25× nuestro precio (listado bajo otro nombre) |
| deepseek/deepseek-v4-flash — entrada / millón de tokens | Y-API$0.0075 en efectivo | Together AI$0.14 como DeepSeek V4 Flash 0731: 18.7× nuestro precio (versión con fecha fija, no el modelo que se actualiza) |
| En qué se convierte una recarga | Y-APIPor tiempo limitado: 1 dólar se convierte en $20 de crédito en la cuenta, y luego el crédito se descuenta a la tarifa de cada modelo. Después vuelve a 1:10. | Together AIPagas el precio de lista en efectivo. No hay multiplicador de crédito ni nada que caduque. |
| Precio en aciertos de caché | Y-APISin descuento por caché. Un prompt repetido se factura igual que uno nuevo. | Together AINo publica tarifa de entrada en caché para las filas de arriba, así que ambas columnas suponen que cada petición falla la caché. Si Together AI descuenta los aciertos fuera de la lista, la diferencia se estrecha. |
| Modelos a los que no pone precio | Y-APILos 10 se llaman con la misma clave. | Together AIUn modelo que buscamos y no encontramos (xiaomi/mimo-v2.5); 7 modelos que todavía no hemos contrastado con su catálogo. |
Frente a nosotros
Dónde Together AI sale más barato
Una comparación que solo va en un sentido es un anuncio. Todo lo de abajo sale de la misma lista de precios que las cifras de arriba.
No tenemos ningún descuento por caché
Cada petición se factura a la tarifa completa, aunque el prompt sea idéntico al anterior. Los prompts de sistema largos y fijos y el contexto documental repetido son justo donde eso duele.
Algunas filas no son la misma versión en los dos lados
Comparamos qwen/qwen3.8-max con su Qwen3.8-2.4T-A95B y deepseek/deepseek-v4-flash con su DeepSeek V4 Flash 0731. Esa equivalencia la establecemos nosotros por proveedor, número de parámetros y fecha de lanzamiento; no es lo que ellos afirman. Los precios son comparables; el comportamiento puede no serlo. Fija el ID del modelo y pruébalo si eso te importa.
Casi toda la diferencia es la tasa de recarga, no el precio del modelo
Nuestras tarifas de catálogo, leídas como crédito, quedan cerca de lo que Together AI cobra en efectivo. Casi toda la diferencia de arriba viene de que 1 dólar se convierte en $20 de crédito. A 1:10, la misma comparación pasa a ser 12.5× en qwen/qwen3.8-max y 9.33× en deepseek/deepseek-v4-flash.
Together AI vende muchos más modelos que nosotros
Su catálogo abarca proveedores y modelos de pesos abiertos que nosotros no llevamos, y puede desviar el tráfico cuando un proveedor se cae. Nuestros 10 son una lista corta deliberada; si el modelo que necesitas no está en ella, lo que cobremos por los demás te da igual.
Adecuación
A cuál llamar
Llámalo por Y-API si
- Tu entrada es sobre todo nueva, donde la diferencia es de 25× en qwen/qwen3.8-max y 18.7× en deepseek/deepseek-v4-flash con la tasa de recarga actual.
- Quieres un saldo y una clave para 10 modelos de 6 proveedores en lugar de una cuenta por proveedor.
Vete a Together AI si
- Necesitas un modelo fuera de nuestros 10, o quieres conmutación automática entre proveedores cuando uno se cae.
- Quieres un precio que no dependa de una promoción. El nuestro es 1 dólar → $20 de crédito hoy y 1:10 después; el suyo es efectivo a precio de lista en cualquier caso.
- Quieres que la relación de facturación, el SLA y el soporte sean con Together AI y no con un revendedor.
Preguntas frecuentes
Preguntas que surgen antes de cambiarse
- ¿Es Y-API más barato que Together AI?
- Con entrada nueva, sí: qwen/qwen3.8-max sale a $0.10 frente a sus $2.50 y deepseek/deepseek-v4-flash sale a $0.0075 frente a sus $0.14. Dos cosas lo acotan. Su columna es siempre la capa más barata que publican, así que cada múltiplo es un suelo y no un máximo; y la diferencia depende de la tasa de recarga 1:20 por tiempo limitado, que se reduce más o menos a la mitad cuando vuelva a 1:10.
- ¿Por qué es más barato? ¿Compráis por debajo de su precio?
- No, y aquí la respuesta honesta importa. Nuestras tarifas de catálogo, leídas como crédito, quedan cerca de los precios de lista en efectivo de Together AI. Casi toda la diferencia es la conversión de la recarga: 1 dólar compra $20 de crédito mientras dura la promoción. Trátalo como una tarifa promocional con vuelta anunciada a 1:10, no como un descuento estructural.
- ¿A qué modelos nuestros les pone precio Together AI?
- Les pone precio a 2 de nuestros 10, con el nombre que lleva cada uno allí: qwen/qwen3.8-max (Qwen3.8-2.4T-A95B allí) y deepseek/deepseek-v4-flash (DeepSeek V4 Flash 0731 allí). Esas son las únicas filas de la tabla de arriba: una fila con precio publicado en un solo lado no es una comparación.
- ¿Y los modelos a los que no pone precio?
- Un modelo que buscamos y no encontramos (xiaomi/mimo-v2.5); 7 modelos que todavía no hemos contrastado con su catálogo. Mantenemos «no lo hemos mirado» y «no lo venden» separados a propósito: son afirmaciones distintas, y solo la primera habla de nosotros.
- ¿El modelo de su lado es literalmente la misma versión?
- No para qwen/qwen3.8-max (Qwen3.8-2.4T-A95B allí) y deepseek/deepseek-v4-flash (DeepSeek V4 Flash 0731 allí): es una instantánea con fecha o una versión con otro nombre, emparejada por proveedor, número de parámetros y fecha de lanzamiento. Compara los precios; no des por hecho el mismo comportamiento.
- ¿Cuánto código tengo que cambiar?
- base_url, la clave y el nombre del modelo. Los dos lados hablan OpenAI Chat Completions, así que el resto del cuerpo de la petición no cambia: los nuestros llevan prefijo, por ejemplo qwen/qwen3.8-max.
Procedencia
Fuentes
Cada cifra de Together AI en esta página se leyó de la página de abajo el 2026-08-26, en la capa más baja que publica. Nuestras propias cifras están en nuestras páginas de precios y de términos.
Apunta una sola llamada hacia aquí
Cambia base_url, la clave y el nombre del modelo en una llamada que ya hagas. El registro de peticiones te dirá lo que cuesta antes de mover nada más.