Como escolher este modelo
Orientações de seleção da Y-API. As verificações sugeridas não são resultados de testes já realizados.
Por onde começar
Use-o como o trabalhador por trás de um modelo maior: resumir o contexto recuperado, conduzir chamadas de ferramenta num subagente, ou absorver a maior parte das requisições que não exigem raciocínio profundo.
Cuidados na escolha
Um preço baixo por token não limita a conta quando tokens de raciocínio são cobrados como saída; um traço de raciocínio longo pode custar bem mais do que a entrada sugere. Verifique o uso real no registro de requisições em vez de estimar pela tarifa de vitrine.
Especificações
São especificações da OpenRouter no nível do modelo, não um teste de compatibilidade da Y-API. Uma rota pode aceitar menos formatos, parâmetros ou tokens. Valide as funções necessárias com uma solicitação pequena: texto funcionando não comprova visão ou chamadas de ferramentas.
- Janela de contexto
- 1.000.000 tokens
- Entrada
- Texto · Imagem · Arquivo
- Saída
- Texto
- Registro na OpenRouter
- Parâmetros listados pela OpenRouter
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstool_choicetoolsverbosity
Estime o custo
- Crédito estimado
- US$ 0,45
- Pagamento equivalente estimado
- US$ 0,045
Orçamento ilustrativo, não uso medido nem proposta comercial. Inclui entrada e saída, mas exclui cobranças separadas de mídia, descontos de cache e novas tentativas. Inclua tokens de raciocínio cobrados no orçamento de saída. A cobrança real segue o uso retornado pelo serviço.
Cada US$ 1 pago adiciona US$ 10 em crédito. Equivalente pago = crédito consumido ÷ 10; não é o preço oficial do desenvolvedor.
| Modelo | Crédito estimado | Pagamento equivalente estimado |
|---|---|---|
| Claude Haiku 5.5 | US$ 0,45 | US$ 0,045 |
| Claude Haiku 4.5 | US$ 3,75 | US$ 0,375 |
| GPT-6 Luna | US$ 0,35 | US$ 0,035 |
Usar a API
Solicitações mínimas de texto com o ID exato da Y-API. Não demonstram suporte a imagens, áudio, vídeo, arquivos ou ferramentas. Reserve saída para raciocínio; conteúdo vazio com finish_reason=length pode indicar orçamento esgotado.
Uma tarefa para testar
Resuma este relatório de incidente em cinco tópicos para o plantonista, mantendo exatos todos os horários e nomes de serviço afetados.
Coloque uma chave do console na variável TOKEN e execute localmente ou no servidor. Não exponha a chave no navegador ou em repositórios públicos.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "anthropic/claude-haiku-5.5",
"messages": [
{
"role": "user",
"content": "Resuma este relatório de incidente em cinco tópicos para o plantonista, mantendo exatos todos os horários e nomes de serviço afetados."
}
],
"max_tokens": 4096
}
JSONComo avaliar o resultado
Confira se nenhum horário ou nome de serviço foi alterado ou omitido e compare com o Haiku 4.5 nas mesmas entradas para ver qual preserva detalhes a um custo menor.
Antes de escolher
O Haiku 5.5 pode substituir um modelo maior em trabalho de agente?
Em passos bem especificados e de alto volume, muitas vezes sim. Para raciocínio de várias etapas que precisa permanecer coerente ao longo de uma sessão longa, compare-o com as entradas Opus e Sonnet nas suas próprias tarefas antes de trocar o tráfego.
Fontes e escopo
Os fatos técnicos vêm da página citada e, quando disponível, da ficha do desenvolvedor. A ficha descreve um checkpoint; não comprova os pesos servidos pelo gateway. Os preços vêm apenas do catálogo da Y-API. Não afirmamos ter medido latência, disponibilidade ou pontuações deste endpoint.