Gemini 3.7 Flash

google/gemini-3.7-flash

Gemini 3.7 Flash es una entrada multimodal concebida para flujos de agentes rápidos, código y razonamiento de varios pasos, con una ventana de 1.048.576 tokens sobre entrada de texto, imagen, vídeo, archivo y audio.

Entrada · Crédito de la cuenta
$1.50

por 1 M de tokens

Equivalente pagado $0.15

Salida · Crédito de la cuenta
$7.50

por 1 M de tokens

Equivalente pagado $0.75

Ventana de contexto
1.048.576

tokens · OpenRouter

Entrada → Salida
Texto · Imagen · Vídeo · Archivo · Audio→ Texto
Especificaciones
Fuentes revisadas: Fecha del catálogo de Y-API:

Cómo elegir este modelo

Recomendaciones de selección de Y-API. Las comprobaciones propuestas no son resultados de pruebas ya realizadas.

Por dónde empezar

Úsalo en tareas que exijan iteración ágil con ejecución fiable de varios pasos: un agente que lea el resultado de una herramienta y decida de inmediato la siguiente llamada, o un bucle de código con muchos ciclos cortos.

Qué tener en cuenta

Google retiró este modelo el 2026-10-08: sus peticiones se enrutan automáticamente a 3.8 Flash y su precio ya no figura en la lista de tarifas. La ventana y el reenvío de medios del gateway no cambian, pero lo que responde ya no es este modelo; fija el nombre del modelo que quieras usar. La compatibilidad de medios de entrada sigue necesitando su propia comprobación contra el gateway.

Especificaciones

Son especificaciones de OpenRouter a nivel de modelo, no una prueba de compatibilidad de Y-API. Una ruta puede aceptar menos formatos, parámetros o tokens. Valida las funciones necesarias con una petición pequeña: una respuesta de texto no demuestra visión ni llamadas a herramientas.

Ventana de contexto
1.048.576 tokens
Entrada
Texto · Imagen · Vídeo · Archivo · Audio
Salida
Texto
Alta en OpenRouter
Parámetros que enumera OpenRouter
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
Página y especificaciones en OpenRouter

Calcula el coste

Crédito estimado
5,25 US$
Pago equivalente estimado
0,525 US$

Presupuesto ilustrativo, no uso medido ni oferta vinculante. Incluye entrada y salida; excluye cargos de medios separados, descuentos de caché y reintentos. Incluye los tokens de razonamiento facturados en la salida. El cobro real depende del uso devuelto por el servicio.

Cada $1 pagado añade $10 de crédito. Equivalente pagado = crédito consumido ÷ 10; no es el precio oficial del desarrollador.

Mismo presupuesto de tokens, distintos modelos
ModeloCrédito estimadoPago equivalente estimado
Gemini 3.7 Flash5,25 US$0,525 US$
Gemini 3.8 Flash5,25 US$0,525 US$
Gemini 3.5 Flash8,00 US$0,80 US$
Detalles completos de facturación

Usar la API

Peticiones mínimas de texto con el ID exacto de Y-API. No demuestran compatibilidad con imágenes, audio, vídeo, archivos o herramientas. Reserva salida para el razonamiento; una respuesta vacía con finish_reason=length puede indicar que se agotó el presupuesto.

Una tarea para probar

Dados los tres últimos resultados de herramientas, decide la siguiente llamada e indica la condición de parada de este bucle.

Guarda una clave de la consola en la variable TOKEN. Ejecuta el ejemplo localmente o en tu servidor; nunca expongas la clave en código del navegador o repositorios públicos.

cURL · Gemini 3.7 Flash
curl --fail-with-body --silent --show-error --max-time 120 \
  'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
  -H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
  -H 'Content-Type: application/json' \
  --data-binary @- <<'JSON'
{
  "model": "google/gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "Dados los tres últimos resultados de herramientas, decide la siguiente llamada e indica la condición de parada de este bucle."
    }
  ],
  "max_tokens": 4096
}
JSON

Cómo evaluar el resultado

Ejecuta el bucle sobre una tarea con solución conocida y cuenta cuántos pasos necesita, si termina por sí solo y si repite una llamada fallida en lugar de cambiar de enfoque.

Antes de elegir

¿Es 3.7 Flash más lento o más rápido que 3.8 Flash?

En esta entrada la pregunta ya no tiene respuesta: Google retiró 3.7 Flash el 2026-10-08 y enruta sus peticiones a 3.8 Flash, así que una llamada a cualquiera de los dos nombres llega al mismo modelo. Llama directamente a 3.8 Flash y mide eso.

Fuentes y alcance

Los datos técnicos proceden de la página citada y de la ficha del desarrollador cuando está disponible. La ficha describe un checkpoint, no demuestra qué pesos sirve el gateway. Los precios provienen únicamente del catálogo de Y-API. No afirmamos haber medido latencia, disponibilidad ni puntuaciones de este endpoint.