Y-API contra DeepInfra

A DeepInfra é outro gateway que revende os modelos dos mesmos fornecedores, portanto isto não são dois laboratórios a competir: é uma única pergunta. Para os 2 modelos que ambos vendemos, passar pela Y-API custa menos? As duas colunas abaixo são dinheiro por milhão de tokens de entrada, e a coluna da DeepInfra é a faixa mais baixa que encontrámos na lista de preços dela, o que faz de cada múltiplo um piso e não uma manchete.

Y-API e DeepInfra comparadas em preço à vista, catálogo e estrutura de faixas
Protocolo da APIY-APIOpenAI Chat Completions. Aponte a base_url para https://api.y-api.bestvirtualgoods.com/v1, troque a chave e deixe o resto do código como está.DeepInfraUm endpoint compatível com OpenAI próprio, noutra base_url e com outros nomes de modelo — veja a linha de cada modelo abaixo.
Modelos com uma só chaveY-API10 IDs de modelo de 6 fornecedores, um saldo, uma chave.DeepInfraO catálogo publicado dela. Dos 10 modelos que comparamos com ela, 2 têm preço lá.
qwen/qwen3.8-max — entrada / milhão de tokensY-API$0.10 à vistaDeepInfra$1.65 como Qwen/Qwen3.8-Max: 16.5× o nosso preço (faixa padrão; as faixas priority e flex diferem)
deepseek/deepseek-v4-flash — entrada / milhão de tokensY-API$0.0075 à vistaDeepInfra$0.09 como deepseek-ai/DeepSeek-V4-Flash: 12× o nosso preço (faixa padrão; as faixas priority e flex diferem)
No que se converte uma recargaY-APIPor tempo limitado: 1 dólar torna-se $20 de crédito na conta, e depois o crédito é descontado à tarifa de cada modelo. Depois volta a 1:10.DeepInfraPaga o preço de tabela em dinheiro. Não há multiplicador de crédito nem nada que expire.
Como a tarifa é estruturadaY-APIUma tarifa por modelo — a qualquer hora, em qualquer região, em qualquer pedido.DeepInfraOs números acima estão dentro de faixas: faixa padrão; as faixas priority e flex diferem. Citámos a mais barata delas.
Preço em acertos de cacheY-APISem desconto de cache. Um prompt repetido é cobrado igual a um novo.DeepInfraNão publica tarifa de entrada em cache para as linhas acima, por isso ambas as colunas assumem que todo pedido falha a cache. Se a DeepInfra descontar acertos fora da tabela, a diferença estreita-se.
Modelos a que não põe preçoY-APITodos os 10 são chamados com a mesma chave.DeepInfraUm modelo que procurámos e não encontrámos (xiaomi/mimo-v2.5); 7 modelos que ainda não conferimos contra o catálogo dela.

Contra nós

Onde a DeepInfra custa menos

Uma comparação que só corre num sentido é um anúncio. Tudo o que está abaixo vem da mesma lista de preços dos números acima.

Não temos desconto de cache nenhum

Cada pedido é cobrado à tarifa cheia, mesmo que o prompt seja idêntico ao anterior. Prompts de sistema longos e fixos e contexto documental repetido são exactamente onde isso dói.

Quase toda a diferença é a taxa de recarga, não o preço do modelo

As nossas tarifas de catálogo, lidas como crédito, ficam perto do que a DeepInfra cobra em dinheiro. Quase toda a diferença acima vem de 1 dólar se converter em $20 de crédito. A 1:10, a mesma comparação passa a 8.25× em qwen/qwen3.8-max e 6× em deepseek/deepseek-v4-flash.

A DeepInfra vende muito mais modelos do que nós

O catálogo dela cobre fornecedores e modelos de pesos abertos que nós não temos, e consegue desviar quando um provedor cai. Os nossos 10 são uma lista curta deliberada; se o modelo de que precisa não estiver nela, o nosso preço para os outros é irrelevante para você.

Qual escolher

Por qual lado chamar

Chame pela Y-API se

  • A sua entrada é sobretudo nova, onde a diferença é de 16.5× em qwen/qwen3.8-max e 12× em deepseek/deepseek-v4-flash à taxa de recarga actual.
  • Quer um saldo e uma chave para 10 modelos de 6 fornecedores em vez de uma conta por fornecedor.
  • Preferia não acompanhar em que faixa, região ou hora está a ser cobrado. Temos uma tarifa por modelo.

Vá para a DeepInfra se

  • Precisa de um modelo fora dos nossos 10, ou quer troca automática entre provedores quando um cai.
  • Quer um preço que não dependa de promoção. O nosso é 1 dólar → $20 de crédito hoje e 1:10 depois; o deles é dinheiro a preço de tabela nos dois casos.
  • Quer que a relação de cobrança, o SLA e o suporte sejam com a DeepInfra e não com um revendedor.

FAQ

Perguntas de quem está pensando em trocar

A Y-API é mais barata que a DeepInfra?
Em entrada nova, sim: qwen/qwen3.8-max sai a $0.10 contra os $1.65 deles e deepseek/deepseek-v4-flash sai a $0.0075 contra os $0.09 deles. Duas coisas limitam isso. A coluna deles é sempre a faixa mais barata que publicam, por isso cada múltiplo é um piso e não um pico; e a diferença depende da taxa de recarga 1:20 por tempo limitado, que a reduz para cerca de metade quando voltar a 1:10.
Por que é mais barato — vocês compram abaixo do preço deles?
Não, e aqui a resposta honesta importa. As nossas tarifas de catálogo, lidas como crédito, ficam perto dos preços de tabela em dinheiro da DeepInfra. Quase toda a diferença é a conversão da recarga: 1 dólar compra $20 de crédito enquanto a promoção durar. Trate-a como tarifa promocional com volta anunciada a 1:10, não como desconto estrutural.
A quais dos nossos modelos a DeepInfra põe preço?
Ela põe preço em 2 dos nossos 10, com o nome que cada um leva lá: qwen/qwen3.8-max (Qwen/Qwen3.8-Max lá) e deepseek/deepseek-v4-flash (deepseek-ai/DeepSeek-V4-Flash lá). Essas são as únicas linhas da tabela acima — uma linha com preço publicado de um só lado não é comparação.
E os modelos a que ela não põe preço?
Um modelo que procurámos e não encontrámos (xiaomi/mimo-v2.5); 7 modelos que ainda não conferimos contra o catálogo dela. Mantemos «não fomos ver» e «eles não vendem» separados de propósito: são afirmações diferentes, e só a primeira fala de nós.
Quanto do meu código tem de mudar?
base_url, a chave e o nome do modelo. Os dois lados falam OpenAI Chat Completions, por isso o resto do corpo do pedido não muda — os nossos levam prefixo, por exemplo qwen/qwen3.8-max.

Procedência

Fontes

Cada número da DeepInfra nesta página foi lido da página abaixo em 2026-08-26, na faixa mais baixa que publica. Os nossos números estão nas nossas páginas de preços e de termos.

Aponte uma chamada para cá

Mude base_url, a chave e o nome do modelo numa chamada que você já faz. O log de pedidos vai dizer quanto custa antes de mover mais nada.