Como escolher este modelo
Orientações de seleção da Y-API. As verificações sugeridas não são resultados de testes já realizados.
Por onde começar
Avalie migrações por etapas: esquema, preenchimento, escrita dupla e limpeza. Peça preservar restrições e identificar os limites de reversão.
Cuidados na escolha
Contexto não é memória persistente. A aplicação preserva mensagens e resultados; enviar todo o histórico pode aumentar o custo sem melhorar decisões.
Especificações
São especificações da OpenRouter no nível do modelo, não um teste de compatibilidade da Y-API. Uma rota pode aceitar menos formatos, parâmetros ou tokens. Valide as funções necessárias com uma solicitação pequena: texto funcionando não comprova visão ou chamadas de ferramentas.
- Janela de contexto
- 1.048.576 tokens
- Entrada
- Texto
- Saída
- Texto
- Registro na OpenRouter
- Parâmetros listados pela OpenRouter
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_pparallel_tool_callspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Estime o custo
- Crédito estimado
- US$ 3,60
- Pagamento equivalente estimado
- US$ 0,36
Orçamento ilustrativo, não uso medido nem proposta comercial. Inclui entrada e saída, mas exclui cobranças separadas de mídia, descontos de cache e novas tentativas. Inclua tokens de raciocínio cobrados no orçamento de saída. A cobrança real segue o uso retornado pelo serviço.
Cada US$ 1 pago adiciona US$ 10 em crédito. Equivalente pago = crédito consumido ÷ 10; não é o preço oficial do desenvolvedor.
| Modelo | Crédito estimado | Pagamento equivalente estimado |
|---|---|---|
| GLM 5.2 | US$ 3,60 | US$ 0,36 |
| GLM 5.3 | US$ 3,90 | US$ 0,39 |
| Hy4 preview | US$ 2,50 | US$ 0,25 |
Usar a API
Solicitações mínimas de texto com o ID exato da Y-API. Não demonstram suporte a imagens, áudio, vídeo, arquivos ou ferramentas. Reserve saída para raciocínio; conteúdo vazio com finish_reason=length pode indicar orçamento esgotado.
Uma tarefa para testar
Planeje renomear uma coluna sem interrupção com versões antigas e novas da aplicação. Inclua ordem, compatibilidade e reversão.
Coloque uma chave do console na variável TOKEN e execute localmente ou no servidor. Não exponha a chave no navegador ou em repositórios públicos.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "z-ai/glm-5.2",
"messages": [
{
"role": "user",
"content": "Planeje renomear uma coluna sem interrupção com versões antigas e novas da aplicação. Inclua ordem, compatibilidade e reversão."
}
],
"max_tokens": 4096
}
JSONComo avaliar o resultado
Exija expansão antes de contração, compatibilidade entre versões e retorno possível antes de operações destrutivas.
Antes de escolher
Qual é a diferença para GLM 5.3?
A Z.ai informa que usam a mesma base e que 5.3 altera o pós-treinamento. Compare o comportamento: base compartilhada não implica resultados iguais.
Fontes e escopo
Os fatos técnicos vêm da página citada e, quando disponível, da ficha do desenvolvedor. A ficha descreve um checkpoint; não comprova os pesos servidos pelo gateway. Os preços vêm apenas do catálogo da Y-API. Não afirmamos ter medido latência, disponibilidade ou pontuações deste endpoint.