GLM 5.3 usa a base de GLM 5.2 com pós-treinamento revisado para código complexo e tarefas prolongadas. A OpenRouter documenta raciocínio sempre ativo, relevante ao planejar a saída.

Entrada · Crédito da conta
$1.40

por 1 milhão de tokens

Equivalente pago $0.14

Saída · Crédito da conta
$5.00

por 1 milhão de tokens

Equivalente pago $0.50

Janela de contexto
1.048.576

tokens · OpenRouter

Entrada → Saída
Texto→ Texto
Especificações
Fontes verificadas: Data do catálogo da Y-API:

Como escolher este modelo

Orientações de seleção da Y-API. As verificações sugeridas não são resultados de testes já realizados.

Por onde começar

Teste correções com implementação, testes e revisão final. Defina os critérios antes e confira se o modelo não enfraqueceu testes para passar.

Cuidados na escolha

Não pressuponha uma opção para desligar raciocínio. Reserve tokens para ele e para a resposta; investigue truncamento quando o conteúdo vier vazio.

Especificações

São especificações da OpenRouter no nível do modelo, não um teste de compatibilidade da Y-API. Uma rota pode aceitar menos formatos, parâmetros ou tokens. Valide as funções necessárias com uma solicitação pequena: texto funcionando não comprova visão ou chamadas de ferramentas.

Janela de contexto
1.048.576 tokens
Entrada
Texto
Saída
Texto
Registro na OpenRouter
Parâmetros listados pela OpenRouter
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_pparallel_tool_callspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Página e especificações na OpenRouter

Estime o custo

Crédito estimado
US$ 3,90
Pagamento equivalente estimado
US$ 0,39

Orçamento ilustrativo, não uso medido nem proposta comercial. Inclui entrada e saída, mas exclui cobranças separadas de mídia, descontos de cache e novas tentativas. Inclua tokens de raciocínio cobrados no orçamento de saída. A cobrança real segue o uso retornado pelo serviço.

Cada US$ 1 pago adiciona US$ 10 em crédito. Equivalente pago = crédito consumido ÷ 10; não é o preço oficial do desenvolvedor.

Mesmo orçamento de tokens, modelos diferentes
ModeloCrédito estimadoPagamento equivalente estimado
GLM 5.3US$ 3,90US$ 0,39
GLM 5.2US$ 3,60US$ 0,36
GLM 5.3 FlashUS$ 0,40US$ 0,04

Usar a API

Solicitações mínimas de texto com o ID exato da Y-API. Não demonstram suporte a imagens, áudio, vídeo, arquivos ou ferramentas. Reserve saída para raciocínio; conteúdo vazio com finish_reason=length pode indicar orçamento esgotado.

Uma tarefa para testar

Um webhook de pagamento chega repetido e fora de ordem. Proponha idempotência e testes que provem que a conta não recebe crédito duas vezes.

Coloque uma chave do console na variável TOKEN e execute localmente ou no servidor. Não exponha a chave no navegador ou em repositórios públicos.

cURL · GLM 5.3
curl --fail-with-body --silent --show-error --max-time 120 \
  'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
  -H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
  -H 'Content-Type: application/json' \
  --data-binary @- <<'JSON'
{
  "model": "z-ai/glm-5.3",
  "messages": [
    {
      "role": "user",
      "content": "Um webhook de pagamento chega repetido e fora de ordem. Proponha idempotência e testes que provem que a conta não recebe crédito duas vezes."
    }
  ],
  "max_tokens": 4096
}
JSON

Como avaliar o resultado

Exija unicidade persistente e transição atômica. Teste duplicatas simultâneas; um conjunto em memória não é suficiente.

Antes de escolher

É possível desligar o raciocínio?

A página revisada da OpenRouter diz que não. Intensidade não é desativação. Também é preciso verificar quais opções a Y-API encaminha.

Fontes e escopo

Os fatos técnicos vêm da página citada e, quando disponível, da ficha do desenvolvedor. A ficha descreve um checkpoint; não comprova os pesos servidos pelo gateway. Os preços vêm apenas do catálogo da Y-API. Não afirmamos ter medido latência, disponibilidade ou pontuações deste endpoint.