GLM 5.3 Flash

z-ai/glm-5.3-flash

GLM 5.3 Flash introduce multimodalidad nativa en la serie GLM 5. Usa una base nueva con atención dispersa y lineal, distinta del GLM 5.3 de texto.

Entrada · Crédito de la cuenta
$0.15

por 1 M de tokens

Equivalente pagado $0.015

Salida · Crédito de la cuenta
$0.50

por 1 M de tokens

Equivalente pagado $0.05

Ventana de contexto
1.048.576

tokens · OpenRouter

Entrada → Salida
Texto · Imagen · Vídeo→ Texto
Especificaciones
Fuentes revisadas: Fecha del catálogo de Y-API:

Cómo elegir este modelo

Recomendaciones de selección de Y-API. Las comprobaciones propuestas no son resultados de pruebas ya realizadas.

Por dónde empezar

Evalúa coherencia entre capturas, requisitos y código. Solicita primero hechos visibles y después cambios para detectar observaciones sin fundamento.

Qué tener en cuenta

Flash no es una opción de precio de GLM 5.3. La visión y tools en la documentación no prueban que las rutas equivalentes funcionen en Y-API.

Especificaciones

Son especificaciones de OpenRouter a nivel de modelo, no una prueba de compatibilidad de Y-API. Una ruta puede aceptar menos formatos, parámetros o tokens. Valida las funciones necesarias con una petición pequeña: una respuesta de texto no demuestra visión ni llamadas a herramientas.

Ventana de contexto
1.048.576 tokens
Entrada
Texto · Imagen · Vídeo
Salida
Texto
Alta en OpenRouter
Parámetros que enumera OpenRouter
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_pparallel_tool_callspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Página y especificaciones en OpenRouter

Calcula el coste

Crédito estimado
0,40 US$
Pago equivalente estimado
0,04 US$

Presupuesto ilustrativo, no uso medido ni oferta vinculante. Incluye entrada y salida; excluye cargos de medios separados, descuentos de caché y reintentos. Incluye los tokens de razonamiento facturados en la salida. El cobro real depende del uso devuelto por el servicio.

Cada $1 pagado añade $10 de crédito. Equivalente pagado = crédito consumido ÷ 10; no es el precio oficial del desarrollador.

Mismo presupuesto de tokens, distintos modelos
ModeloCrédito estimadoPago equivalente estimado
GLM 5.3 Flash0,40 US$0,04 US$
GLM 5.33,90 US$0,39 US$
Qwen3.8 Flash0,45 US$0,045 US$

Usar la API

Peticiones mínimas de texto con el ID exacto de Y-API. No demuestran compatibilidad con imágenes, audio, vídeo, archivos o herramientas. Reserva salida para el razonamiento; una respuesta vacía con finish_reason=length puede indicar que se agotó el presupuesto.

Una tarea para probar

Un formulario marca los errores solo con un borde rojo. Diseña validación accesible con texto, foco y avisos para lectores de pantalla.

Guarda una clave de la consola en la variable TOKEN. Ejecuta el ejemplo localmente o en tu servidor; nunca expongas la clave en código del navegador o repositorios públicos.

cURL · GLM 5.3 Flash
curl --fail-with-body --silent --show-error --max-time 120 \
  'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
  -H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
  -H 'Content-Type: application/json' \
  --data-binary @- <<'JSON'
{
  "model": "z-ai/glm-5.3-flash",
  "messages": [
    {
      "role": "user",
      "content": "Un formulario marca los errores solo con un borde rojo. Diseña validación accesible con texto, foco y avisos para lectores de pantalla."
    }
  ],
  "max_tokens": 4096
}
JSON

Cómo evaluar el resultado

Debe asociar el error al campo y ofrecer señales no basadas solo en color. Prueba visión por separado con una captura conocida.

Antes de elegir

¿Es simplemente un GLM 5.3 más pequeño?

El desarrollador describe una nueva base y otra arquitectura de atención. Evalúalo como candidato independiente, no como calidad idéntica con otra tarifa.

Fuentes y alcance

Los datos técnicos proceden de la página citada y de la ficha del desarrollador cuando está disponible. La ficha describe un checkpoint, no demuestra qué pesos sirve el gateway. Los precios provienen únicamente del catálogo de Y-API. No afirmamos haber medido latencia, disponibilidad ni puntuaciones de este endpoint.