Cómo elegir este modelo
Recomendaciones de selección de Y-API. Las comprobaciones propuestas no son resultados de pruebas ya realizadas.
Por dónde empezar
Úsalo como caballo de batalla detrás de un modelo mayor: resumir contexto recuperado, dirigir llamadas a herramientas en un subagente o atender la mayor parte de las peticiones que no exigen razonamiento profundo.
Qué tener en cuenta
Un precio bajo por token no acota la factura cuando los tokens de razonamiento se cobran como salida; una traza de razonamiento larga puede costar mucho más de lo que sugiere la entrada. Comprueba el uso real en el registro de peticiones en vez de estimarlo a partir de la tarifa anunciada.
Especificaciones
Son especificaciones de OpenRouter a nivel de modelo, no una prueba de compatibilidad de Y-API. Una ruta puede aceptar menos formatos, parámetros o tokens. Valida las funciones necesarias con una petición pequeña: una respuesta de texto no demuestra visión ni llamadas a herramientas.
- Ventana de contexto
- 1.000.000 tokens
- Entrada
- Texto · Imagen · Archivo
- Salida
- Texto
- Alta en OpenRouter
- Parámetros que enumera OpenRouter
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstool_choicetoolsverbosity
Calcula el coste
- Crédito estimado
- 0,45 US$
- Pago equivalente estimado
- 0,045 US$
Presupuesto ilustrativo, no uso medido ni oferta vinculante. Incluye entrada y salida; excluye cargos de medios separados, descuentos de caché y reintentos. Incluye los tokens de razonamiento facturados en la salida. El cobro real depende del uso devuelto por el servicio.
Cada $1 pagado añade $10 de crédito. Equivalente pagado = crédito consumido ÷ 10; no es el precio oficial del desarrollador.
| Modelo | Crédito estimado | Pago equivalente estimado |
|---|---|---|
| Claude Haiku 5.5 | 0,45 US$ | 0,045 US$ |
| Claude Haiku 4.5 | 3,75 US$ | 0,375 US$ |
| GPT-6 Luna | 0,35 US$ | 0,035 US$ |
Usar la API
Peticiones mínimas de texto con el ID exacto de Y-API. No demuestran compatibilidad con imágenes, audio, vídeo, archivos o herramientas. Reserva salida para el razonamiento; una respuesta vacía con finish_reason=length puede indicar que se agotó el presupuesto.
Una tarea para probar
Resume este informe de incidente en cinco puntos para el ingeniero de guardia, conservando exactos todas las marcas de tiempo y los nombres de los servicios afectados.
Guarda una clave de la consola en la variable TOKEN. Ejecuta el ejemplo localmente o en tu servidor; nunca expongas la clave en código del navegador o repositorios públicos.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "anthropic/claude-haiku-5.5",
"messages": [
{
"role": "user",
"content": "Resume este informe de incidente en cinco puntos para el ingeniero de guardia, conservando exactos todas las marcas de tiempo y los nombres de los servicios afectados."
}
],
"max_tokens": 4096
}
JSONCómo evaluar el resultado
Comprueba que ninguna marca de tiempo ni nombre de servicio se alteró o se perdió, y compara después con Haiku 4.5 sobre los mismos informes para ver cuál conserva los detalles a menor coste.
Antes de elegir
¿Puede Haiku 5.5 sustituir a un modelo mayor en trabajo de agentes?
Para pasos de alto volumen y bien especificados, a menudo sí. Para razonamiento de varios pasos que deba mantenerse coherente a lo largo de una sesión larga, compáralo con las entradas Opus y Sonnet en tus propias tareas antes de desviar el tráfico.
Fuentes y alcance
Los datos técnicos proceden de la página citada y de la ficha del desarrollador cuando está disponible. La ficha describe un checkpoint, no demuestra qué pesos sirve el gateway. Los precios provienen únicamente del catálogo de Y-API. No afirmamos haber medido latencia, disponibilidad ni puntuaciones de este endpoint.