Y-API contra Together AI

A Together AI é outro gateway que revende os modelos dos mesmos fornecedores, portanto isto não são dois laboratórios a competir: é uma única pergunta. Para os 2 modelos que ambos vendemos, passar pela Y-API custa menos? As duas colunas abaixo são dinheiro por milhão de tokens de entrada, e a coluna da Together AI é a faixa mais baixa que encontrámos na lista de preços dela, o que faz de cada múltiplo um piso e não uma manchete.

Y-API e Together AI comparadas em preço à vista, catálogo e estrutura de faixas
Protocolo da APIY-APIOpenAI Chat Completions. Aponte a base_url para https://api.y-api.bestvirtualgoods.com/v1, troque a chave e deixe o resto do código como está.Together AIUm endpoint compatível com OpenAI próprio, noutra base_url e com outros nomes de modelo — veja a linha de cada modelo abaixo.
Modelos com uma só chaveY-API10 IDs de modelo de 6 fornecedores, um saldo, uma chave.Together AIO catálogo publicado dela. Dos 10 modelos que comparamos com ela, 2 têm preço lá.
qwen/qwen3.8-max — entrada / milhão de tokensY-API$0.10 à vistaTogether AI$2.50 como Qwen3.8-2.4T-A95B: 25× o nosso preço (listado sob outro nome)
deepseek/deepseek-v4-flash — entrada / milhão de tokensY-API$0.0075 à vistaTogether AI$0.14 como DeepSeek V4 Flash 0731: 18.7× o nosso preço (build com data fixa, não o modelo que rola atualização)
No que se converte uma recargaY-APIPor tempo limitado: 1 dólar torna-se $20 de crédito na conta, e depois o crédito é descontado à tarifa de cada modelo. Depois volta a 1:10.Together AIPaga o preço de tabela em dinheiro. Não há multiplicador de crédito nem nada que expire.
Preço em acertos de cacheY-APISem desconto de cache. Um prompt repetido é cobrado igual a um novo.Together AINão publica tarifa de entrada em cache para as linhas acima, por isso ambas as colunas assumem que todo pedido falha a cache. Se a Together AI descontar acertos fora da tabela, a diferença estreita-se.
Modelos a que não põe preçoY-APITodos os 10 são chamados com a mesma chave.Together AIUm modelo que procurámos e não encontrámos (xiaomi/mimo-v2.5); 7 modelos que ainda não conferimos contra o catálogo dela.

Contra nós

Onde a Together AI custa menos

Uma comparação que só corre num sentido é um anúncio. Tudo o que está abaixo vem da mesma lista de preços dos números acima.

Não temos desconto de cache nenhum

Cada pedido é cobrado à tarifa cheia, mesmo que o prompt seja idêntico ao anterior. Prompts de sistema longos e fixos e contexto documental repetido são exactamente onde isso dói.

Algumas linhas não são o mesmo build dos dois lados

Comparamos qwen/qwen3.8-max com o Qwen3.8-2.4T-A95B dela e deepseek/deepseek-v4-flash com o DeepSeek V4 Flash 0731 dela. Essa correspondência é o nosso juízo, feito por fornecedor, número de parâmetros e data de lançamento; não é o que eles afirmam. Os preços são comparáveis; o comportamento pode não ser. Fixe o ID do modelo e teste, se isso lhe importa.

Quase toda a diferença é a taxa de recarga, não o preço do modelo

As nossas tarifas de catálogo, lidas como crédito, ficam perto do que a Together AI cobra em dinheiro. Quase toda a diferença acima vem de 1 dólar se converter em $20 de crédito. A 1:10, a mesma comparação passa a 12.5× em qwen/qwen3.8-max e 9.33× em deepseek/deepseek-v4-flash.

A Together AI vende muito mais modelos do que nós

O catálogo dela cobre fornecedores e modelos de pesos abertos que nós não temos, e consegue desviar quando um provedor cai. Os nossos 10 são uma lista curta deliberada; se o modelo de que precisa não estiver nela, o nosso preço para os outros é irrelevante para você.

Qual escolher

Por qual lado chamar

Chame pela Y-API se

  • A sua entrada é sobretudo nova, onde a diferença é de 25× em qwen/qwen3.8-max e 18.7× em deepseek/deepseek-v4-flash à taxa de recarga actual.
  • Quer um saldo e uma chave para 10 modelos de 6 fornecedores em vez de uma conta por fornecedor.

Vá para a Together AI se

  • Precisa de um modelo fora dos nossos 10, ou quer troca automática entre provedores quando um cai.
  • Quer um preço que não dependa de promoção. O nosso é 1 dólar → $20 de crédito hoje e 1:10 depois; o deles é dinheiro a preço de tabela nos dois casos.
  • Quer que a relação de cobrança, o SLA e o suporte sejam com a Together AI e não com um revendedor.

FAQ

Perguntas de quem está pensando em trocar

A Y-API é mais barata que a Together AI?
Em entrada nova, sim: qwen/qwen3.8-max sai a $0.10 contra os $2.50 deles e deepseek/deepseek-v4-flash sai a $0.0075 contra os $0.14 deles. Duas coisas limitam isso. A coluna deles é sempre a faixa mais barata que publicam, por isso cada múltiplo é um piso e não um pico; e a diferença depende da taxa de recarga 1:20 por tempo limitado, que a reduz para cerca de metade quando voltar a 1:10.
Por que é mais barato — vocês compram abaixo do preço deles?
Não, e aqui a resposta honesta importa. As nossas tarifas de catálogo, lidas como crédito, ficam perto dos preços de tabela em dinheiro da Together AI. Quase toda a diferença é a conversão da recarga: 1 dólar compra $20 de crédito enquanto a promoção durar. Trate-a como tarifa promocional com volta anunciada a 1:10, não como desconto estrutural.
A quais dos nossos modelos a Together AI põe preço?
Ela põe preço em 2 dos nossos 10, com o nome que cada um leva lá: qwen/qwen3.8-max (Qwen3.8-2.4T-A95B lá) e deepseek/deepseek-v4-flash (DeepSeek V4 Flash 0731 lá). Essas são as únicas linhas da tabela acima — uma linha com preço publicado de um só lado não é comparação.
E os modelos a que ela não põe preço?
Um modelo que procurámos e não encontrámos (xiaomi/mimo-v2.5); 7 modelos que ainda não conferimos contra o catálogo dela. Mantemos «não fomos ver» e «eles não vendem» separados de propósito: são afirmações diferentes, e só a primeira fala de nós.
O modelo do lado deles é literalmente o mesmo build?
Não para qwen/qwen3.8-max (Qwen3.8-2.4T-A95B lá) e deepseek/deepseek-v4-flash (DeepSeek V4 Flash 0731 lá) — é um snapshot com data ou um build com outro nome, emparelhado por fornecedor, número de parâmetros e data de lançamento. Compare os preços; não assuma o mesmo comportamento.
Quanto do meu código tem de mudar?
base_url, a chave e o nome do modelo. Os dois lados falam OpenAI Chat Completions, por isso o resto do corpo do pedido não muda — os nossos levam prefixo, por exemplo qwen/qwen3.8-max.

Procedência

Fontes

Cada número da Together AI nesta página foi lido da página abaixo em 2026-08-26, na faixa mais baixa que publica. Os nossos números estão nas nossas páginas de preços e de termos.

Aponte uma chamada para cá

Mude base_url, a chave e o nome do modelo numa chamada que você já faz. O log de pedidos vai dizer quanto custa antes de mover mais nada.