Como escolher este modelo
Orientações de seleção da Y-API. As verificações sugeridas não são resultados de testes já realizados.
Por onde começar
Experimente em chat, classificação e passos leves de agente, em que o volume de requisições é alto e cada chamada isolada é simples o bastante para que um modelo maior fosse desperdício.
Cuidados na escolha
O preço de entrada baixo vale até um limite de tokens; acima dele a tarifa listada quase dobra, então requisições muito grandes não escalam de forma linear com o número de vitrine. Também não há ficha do publicador para inspecionar neste modelo de pesos fechados.
Especificações
São especificações da OpenRouter no nível do modelo, não um teste de compatibilidade da Y-API. Uma rota pode aceitar menos formatos, parâmetros ou tokens. Valide as funções necessárias com uma solicitação pequena: texto funcionando não comprova visão ou chamadas de ferramentas.
- Janela de contexto
- 1.050.000 tokens
- Entrada
- Arquivo · Imagem · Texto
- Saída
- Texto
- Registro na OpenRouter
- Parâmetros listados pela OpenRouter
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetoolsverbosity
Estime o custo
- Crédito estimado
- US$ 0,35
- Pagamento equivalente estimado
- US$ 0,035
Orçamento ilustrativo, não uso medido nem proposta comercial. Inclui entrada e saída, mas exclui cobranças separadas de mídia, descontos de cache e novas tentativas. Inclua tokens de raciocínio cobrados no orçamento de saída. A cobrança real segue o uso retornado pelo serviço.
Cada US$ 1 pago adiciona US$ 10 em crédito. Equivalente pago = crédito consumido ÷ 10; não é o preço oficial do desenvolvedor.
| Modelo | Crédito estimado | Pagamento equivalente estimado |
|---|---|---|
| GPT-6 Luna | US$ 0,35 | US$ 0,035 |
| GPT-5.6 Luna | US$ 0,95 | US$ 0,095 |
| Claude Haiku 5.5 | US$ 0,45 | US$ 0,045 |
Usar a API
Solicitações mínimas de texto com o ID exato da Y-API. Não demonstram suporte a imagens, áudio, vídeo, arquivos ou ferramentas. Reserve saída para raciocínio; conteúdo vazio com finish_reason=length pode indicar orçamento esgotado.
Uma tarefa para testar
Encaminhe cada requisição recebida para uma de três filas com base no texto e explique numa frase o que motivou a escolha.
Coloque uma chave do console na variável TOKEN e execute localmente ou no servidor. Não exponha a chave no navegador ou em repositórios públicos.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "openai/gpt-6-luna",
"messages": [
{
"role": "user",
"content": "Encaminhe cada requisição recebida para uma de três filas com base no texto e explique numa frase o que motivou a escolha."
}
],
"max_tokens": 4096
}
JSONComo avaliar o resultado
Meça a exatidão do roteamento numa amostra rotulada e acompanhe o custo por mil requisições, já que o preço em faixas faz a tarifa média depender do tamanho das suas requisições.
Antes de escolher
Qual é a relação entre o Luna e o GPT-6 Sol?
São entradas distintas de catálogo, com IDs e preços próprios; o Luna é o degrau mais barato e rápido. Trocar de um para o outro é uma mudança no campo do modelo, mas os resultados não são intercambiáveis, então refaça a avaliação.
Fontes e escopo
Os fatos técnicos vêm da página citada e, quando disponível, da ficha do desenvolvedor. A ficha descreve um checkpoint; não comprova os pesos servidos pelo gateway. Os preços vêm apenas do catálogo da Y-API. Não afirmamos ter medido latência, disponibilidade ou pontuações deste endpoint.