Y-API contra Together AI
A Together AI é outro gateway que revende os modelos dos mesmos fornecedores, portanto isto não são dois laboratórios a competir: é uma única pergunta. Para os 2 modelos que ambos vendemos, passar pela Y-API custa menos? As duas colunas abaixo são dinheiro por milhão de tokens de entrada, e a coluna da Together AI é a faixa mais baixa que encontrámos na lista de preços dela, o que faz de cada múltiplo um piso e não uma manchete.
| Dimensão | Y-API | Together AI |
|---|---|---|
| Protocolo da API | Y-APIOpenAI Chat Completions. Aponte a base_url para https://api.y-api.bestvirtualgoods.com/v1, troque a chave e deixe o resto do código como está. | Together AIUm endpoint compatível com OpenAI próprio, noutra base_url e com outros nomes de modelo — veja a linha de cada modelo abaixo. |
| Modelos com uma só chave | Y-API10 IDs de modelo de 6 fornecedores, um saldo, uma chave. | Together AIO catálogo publicado dela. Dos 10 modelos que comparamos com ela, 2 têm preço lá. |
| qwen/qwen3.8-max — entrada / milhão de tokens | Y-API$0.10 à vista | Together AI$2.50 como Qwen3.8-2.4T-A95B: 25× o nosso preço (listado sob outro nome) |
| deepseek/deepseek-v4-flash — entrada / milhão de tokens | Y-API$0.0075 à vista | Together AI$0.14 como DeepSeek V4 Flash 0731: 18.7× o nosso preço (build com data fixa, não o modelo que rola atualização) |
| No que se converte uma recarga | Y-APIPor tempo limitado: 1 dólar torna-se $20 de crédito na conta, e depois o crédito é descontado à tarifa de cada modelo. Depois volta a 1:10. | Together AIPaga o preço de tabela em dinheiro. Não há multiplicador de crédito nem nada que expire. |
| Preço em acertos de cache | Y-APISem desconto de cache. Um prompt repetido é cobrado igual a um novo. | Together AINão publica tarifa de entrada em cache para as linhas acima, por isso ambas as colunas assumem que todo pedido falha a cache. Se a Together AI descontar acertos fora da tabela, a diferença estreita-se. |
| Modelos a que não põe preço | Y-APITodos os 10 são chamados com a mesma chave. | Together AIUm modelo que procurámos e não encontrámos (xiaomi/mimo-v2.5); 7 modelos que ainda não conferimos contra o catálogo dela. |
Contra nós
Onde a Together AI custa menos
Uma comparação que só corre num sentido é um anúncio. Tudo o que está abaixo vem da mesma lista de preços dos números acima.
Não temos desconto de cache nenhum
Cada pedido é cobrado à tarifa cheia, mesmo que o prompt seja idêntico ao anterior. Prompts de sistema longos e fixos e contexto documental repetido são exactamente onde isso dói.
Algumas linhas não são o mesmo build dos dois lados
Comparamos qwen/qwen3.8-max com o Qwen3.8-2.4T-A95B dela e deepseek/deepseek-v4-flash com o DeepSeek V4 Flash 0731 dela. Essa correspondência é o nosso juízo, feito por fornecedor, número de parâmetros e data de lançamento; não é o que eles afirmam. Os preços são comparáveis; o comportamento pode não ser. Fixe o ID do modelo e teste, se isso lhe importa.
Quase toda a diferença é a taxa de recarga, não o preço do modelo
As nossas tarifas de catálogo, lidas como crédito, ficam perto do que a Together AI cobra em dinheiro. Quase toda a diferença acima vem de 1 dólar se converter em $20 de crédito. A 1:10, a mesma comparação passa a 12.5× em qwen/qwen3.8-max e 9.33× em deepseek/deepseek-v4-flash.
A Together AI vende muito mais modelos do que nós
O catálogo dela cobre fornecedores e modelos de pesos abertos que nós não temos, e consegue desviar quando um provedor cai. Os nossos 10 são uma lista curta deliberada; se o modelo de que precisa não estiver nela, o nosso preço para os outros é irrelevante para você.
Qual escolher
Por qual lado chamar
Chame pela Y-API se
- A sua entrada é sobretudo nova, onde a diferença é de 25× em qwen/qwen3.8-max e 18.7× em deepseek/deepseek-v4-flash à taxa de recarga actual.
- Quer um saldo e uma chave para 10 modelos de 6 fornecedores em vez de uma conta por fornecedor.
Vá para a Together AI se
- Precisa de um modelo fora dos nossos 10, ou quer troca automática entre provedores quando um cai.
- Quer um preço que não dependa de promoção. O nosso é 1 dólar → $20 de crédito hoje e 1:10 depois; o deles é dinheiro a preço de tabela nos dois casos.
- Quer que a relação de cobrança, o SLA e o suporte sejam com a Together AI e não com um revendedor.
FAQ
Perguntas de quem está pensando em trocar
- A Y-API é mais barata que a Together AI?
- Em entrada nova, sim: qwen/qwen3.8-max sai a $0.10 contra os $2.50 deles e deepseek/deepseek-v4-flash sai a $0.0075 contra os $0.14 deles. Duas coisas limitam isso. A coluna deles é sempre a faixa mais barata que publicam, por isso cada múltiplo é um piso e não um pico; e a diferença depende da taxa de recarga 1:20 por tempo limitado, que a reduz para cerca de metade quando voltar a 1:10.
- Por que é mais barato — vocês compram abaixo do preço deles?
- Não, e aqui a resposta honesta importa. As nossas tarifas de catálogo, lidas como crédito, ficam perto dos preços de tabela em dinheiro da Together AI. Quase toda a diferença é a conversão da recarga: 1 dólar compra $20 de crédito enquanto a promoção durar. Trate-a como tarifa promocional com volta anunciada a 1:10, não como desconto estrutural.
- A quais dos nossos modelos a Together AI põe preço?
- Ela põe preço em 2 dos nossos 10, com o nome que cada um leva lá: qwen/qwen3.8-max (Qwen3.8-2.4T-A95B lá) e deepseek/deepseek-v4-flash (DeepSeek V4 Flash 0731 lá). Essas são as únicas linhas da tabela acima — uma linha com preço publicado de um só lado não é comparação.
- E os modelos a que ela não põe preço?
- Um modelo que procurámos e não encontrámos (xiaomi/mimo-v2.5); 7 modelos que ainda não conferimos contra o catálogo dela. Mantemos «não fomos ver» e «eles não vendem» separados de propósito: são afirmações diferentes, e só a primeira fala de nós.
- O modelo do lado deles é literalmente o mesmo build?
- Não para qwen/qwen3.8-max (Qwen3.8-2.4T-A95B lá) e deepseek/deepseek-v4-flash (DeepSeek V4 Flash 0731 lá) — é um snapshot com data ou um build com outro nome, emparelhado por fornecedor, número de parâmetros e data de lançamento. Compare os preços; não assuma o mesmo comportamento.
- Quanto do meu código tem de mudar?
- base_url, a chave e o nome do modelo. Os dois lados falam OpenAI Chat Completions, por isso o resto do corpo do pedido não muda — os nossos levam prefixo, por exemplo qwen/qwen3.8-max.
Procedência
Fontes
Cada número da Together AI nesta página foi lido da página abaixo em 2026-08-26, na faixa mais baixa que publica. Os nossos números estão nas nossas páginas de preços e de termos.
Aponte uma chamada para cá
Mude base_url, a chave e o nome do modelo numa chamada que você já faz. O log de pedidos vai dizer quanto custa antes de mover mais nada.