Como escolher este modelo
Orientações de seleção da Y-API. As verificações sugeridas não são resultados de testes já realizados.
Por onde começar
Use-o para classificação, extração e resumo em volume, ou como a primeira etapa barata de um pipeline em duas fases que só escala os casos difíceis para um modelo maior.
Cuidados na escolha
A janela de 200.000 tokens é um quinto da entrada Haiku mais nova, e com preço de entrada bem mais alto, então ele não é a opção de melhor custo-benefício nesta família. Sua lista de parâmetros documentada também é mais estreita que a dos modelos recentes.
Especificações
São especificações da OpenRouter no nível do modelo, não um teste de compatibilidade da Y-API. Uma rota pode aceitar menos formatos, parâmetros ou tokens. Valide as funções necessárias com uma solicitação pequena: texto funcionando não comprova visão ou chamadas de ferramentas.
- Janela de contexto
- 200.000 tokens
- Entrada
- Texto · Imagem · Arquivo
- Saída
- Texto
- Registro na OpenRouter
- Parâmetros listados pela OpenRouter
include_reasoningmax_completion_tokensmax_tokensreasoningresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Estime o custo
- Crédito estimado
- US$ 3,75
- Pagamento equivalente estimado
- US$ 0,375
Orçamento ilustrativo, não uso medido nem proposta comercial. Inclui entrada e saída, mas exclui cobranças separadas de mídia, descontos de cache e novas tentativas. Inclua tokens de raciocínio cobrados no orçamento de saída. A cobrança real segue o uso retornado pelo serviço.
Cada US$ 1 pago adiciona US$ 10 em crédito. Equivalente pago = crédito consumido ÷ 10; não é o preço oficial do desenvolvedor.
| Modelo | Crédito estimado | Pagamento equivalente estimado |
|---|---|---|
| Claude Haiku 4.5 | US$ 3,75 | US$ 0,375 |
| Claude Haiku 5.5 | US$ 0,45 | US$ 0,045 |
| Claude Sonnet 5 | US$ 7,00 | US$ 0,70 |
Usar a API
Solicitações mínimas de texto com o ID exato da Y-API. Não demonstram suporte a imagens, áudio, vídeo, arquivos ou ferramentas. Reserve saída para raciocínio; conteúdo vazio com finish_reason=length pode indicar orçamento esgotado.
Uma tarefa para testar
Classifique cada mensagem de suporte como cobrança, acesso ou indisponibilidade e devolva uma linha por mensagem com o rótulo e um motivo curto.
Coloque uma chave do console na variável TOKEN e execute localmente ou no servidor. Não exponha a chave no navegador ou em repositórios públicos.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "anthropic/claude-haiku-4.5",
"messages": [
{
"role": "user",
"content": "Classifique cada mensagem de suporte como cobrança, acesso ou indisponibilidade e devolva uma linha por mensagem com o rótulo e um motivo curto."
}
],
"max_tokens": 4096
}
JSONComo avaliar o resultado
Compare os rótulos com um conjunto conferido à mão e acompanhe a taxa de escalonamento caso encaminhe os casos de baixa confiança. Faça as duas medições também com o Haiku mais novo sobre as mesmas mensagens.
Antes de escolher
O Haiku 4.5 é mais barato que o Haiku 5.5?
Não — neste catálogo é o contrário. O Haiku 4.5 lista $1.00 por milhão de tokens de entrada contra $0.15 do Haiku 5.5, e ainda com janela menor. Confira a página de modelos para os números atuais antes de escolher.
Fontes e escopo
Os fatos técnicos vêm da página citada e, quando disponível, da ficha do desenvolvedor. A ficha descreve um checkpoint; não comprova os pesos servidos pelo gateway. Os preços vêm apenas do catálogo da Y-API. Não afirmamos ter medido latência, disponibilidade ou pontuações deste endpoint.