Cómo elegir este modelo
Recomendaciones de selección de Y-API. Las comprobaciones propuestas no son resultados de pruebas ya realizadas.
Por dónde empezar
Úsalo en tareas que exijan iteración ágil con ejecución fiable de varios pasos: un agente que lea el resultado de una herramienta y decida de inmediato la siguiente llamada, o un bucle de código con muchos ciclos cortos.
Qué tener en cuenta
Google retiró este modelo el 2026-10-08: sus peticiones se enrutan automáticamente a 3.8 Flash y su precio ya no figura en la lista de tarifas. La ventana y el reenvío de medios del gateway no cambian, pero lo que responde ya no es este modelo; fija el nombre del modelo que quieras usar. La compatibilidad de medios de entrada sigue necesitando su propia comprobación contra el gateway.
Especificaciones
Son especificaciones de OpenRouter a nivel de modelo, no una prueba de compatibilidad de Y-API. Una ruta puede aceptar menos formatos, parámetros o tokens. Valida las funciones necesarias con una petición pequeña: una respuesta de texto no demuestra visión ni llamadas a herramientas.
- Ventana de contexto
- 1.048.576 tokens
- Entrada
- Texto · Imagen · Vídeo · Archivo · Audio
- Salida
- Texto
- Alta en OpenRouter
- Parámetros que enumera OpenRouter
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
Calcula el coste
- Crédito estimado
- 5,25 US$
- Pago equivalente estimado
- 0,525 US$
Presupuesto ilustrativo, no uso medido ni oferta vinculante. Incluye entrada y salida; excluye cargos de medios separados, descuentos de caché y reintentos. Incluye los tokens de razonamiento facturados en la salida. El cobro real depende del uso devuelto por el servicio.
Cada $1 pagado añade $10 de crédito. Equivalente pagado = crédito consumido ÷ 10; no es el precio oficial del desarrollador.
| Modelo | Crédito estimado | Pago equivalente estimado |
|---|---|---|
| Gemini 3.7 Flash | 5,25 US$ | 0,525 US$ |
| Gemini 3.8 Flash | 5,25 US$ | 0,525 US$ |
| Gemini 3.5 Flash | 8,00 US$ | 0,80 US$ |
Usar la API
Peticiones mínimas de texto con el ID exacto de Y-API. No demuestran compatibilidad con imágenes, audio, vídeo, archivos o herramientas. Reserva salida para el razonamiento; una respuesta vacía con finish_reason=length puede indicar que se agotó el presupuesto.
Una tarea para probar
Dados los tres últimos resultados de herramientas, decide la siguiente llamada e indica la condición de parada de este bucle.
Guarda una clave de la consola en la variable TOKEN. Ejecuta el ejemplo localmente o en tu servidor; nunca expongas la clave en código del navegador o repositorios públicos.
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "google/gemini-3.7-flash",
"messages": [
{
"role": "user",
"content": "Dados los tres últimos resultados de herramientas, decide la siguiente llamada e indica la condición de parada de este bucle."
}
],
"max_tokens": 4096
}
JSONCómo evaluar el resultado
Ejecuta el bucle sobre una tarea con solución conocida y cuenta cuántos pasos necesita, si termina por sí solo y si repite una llamada fallida en lugar de cambiar de enfoque.
Antes de elegir
¿Es 3.7 Flash más lento o más rápido que 3.8 Flash?
En esta entrada la pregunta ya no tiene respuesta: Google retiró 3.7 Flash el 2026-10-08 y enruta sus peticiones a 3.8 Flash, así que una llamada a cualquiera de los dos nombres llega al mismo modelo. Llama directamente a 3.8 Flash y mide eso.
Fuentes y alcance
Los datos técnicos proceden de la página citada y de la ficha del desarrollador cuando está disponible. La ficha describe un checkpoint, no demuestra qué pesos sirve el gateway. Los precios provienen únicamente del catálogo de Y-API. No afirmamos haber medido latencia, disponibilidad ni puntuaciones de este endpoint.