Gemini 3.7 Flash

google/gemini-3.7-flash

Gemini 3.7 Flash 是面向快速 Agent 工作流、编码与多步推理的多模态条目,在文本、图像、视频、文件与音频输入上提供 1,048,576 token 窗口。

输入 · 账户额度价
$1.50

每 100 万 tokens

折合实付 $0.15

输出 · 账户额度价
$7.50

每 100 万 tokens

折合实付 $0.75

上下文窗口
1,048,576

tokens · OpenRouter

输入 → 输出
文本 · 图片 · 视频 · 文件 · 音频→ 文本
模型规格
资料核对日期: Y-API 价格快照:

如何选择这个模型

以下为 Y-API 的选型建议与评估方法,不是已经完成的实测结论。

适合从这些任务开始

可用于既要响应迅速、又要求多步执行可靠的任务:读完一个工具结果就立刻决定下一次调用的 Agent,或连续跑很多短周期的编码循环。

选择前需要注意

Google 已于 2026-10-08 弃用这个型号:发给它的请求会被自动路由到 3.8 Flash,费率表上的价也已撤下。窗口与网关的媒体转发都没变,但应答的已经不是这个型号——要哪个就把模型名钉死。媒体输入支持仍要单独对网关验证。

模型规格

以下是 OpenRouter 的模型级规格快照,不是 Y-API 的兼容性实测。具体路由可接受的输入格式、参数和 token 上限可能更少。上线前请用小请求验证所需能力;文本请求成功不等于看图或工具调用已经验证。

上下文窗口
1,048,576 tokens
输入
文本 · 图片 · 视频 · 文件 · 音频
输出
文本
OpenRouter 收录日期
OpenRouter 列出的参数
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
OpenRouter 模型页与规格

API 价格与成本估算

预计消耗额度
US$5.25
预计折合实付
US$0.525

这是示例用量预算,不是实测用量或报价承诺。包含输入和输出,不含单独的媒体收费、缓存优惠及重试;若推理 tokens 计费,也应计入输出预算。实际扣费以服务返回的用量为准。

充值 $1 获得 $10 额度。折合实付 = 消耗额度 ÷ 10,不是模型发布方的官方报价。

相同用量下的模型成本
模型预计消耗额度预计折合实付
Gemini 3.7 FlashUS$5.25US$0.525
Gemini 3.8 FlashUS$5.25US$0.525
Gemini 3.5 FlashUS$8.00US$0.80
查看大模型 API 价格与计费

API 接入示例

示例使用 Y-API 的完整模型 ID,仅发送文本,不代表图片、音频、视频、文件或工具能力已经验证。输出上限还需给推理过程留空间;若正文为空且 finish_reason=length,可能是预算已耗尽。

可以先试的任务

根据最近三次工具返回,决定下一次调用,并说明这个循环的终止条件。

将控制台创建的密钥写入环境变量 TOKEN,在本地或服务端运行。不要把密钥放进浏览器代码或公开仓库。

cURL · Gemini 3.7 Flash
curl --fail-with-body --silent --show-error --max-time 120 \
  'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
  -H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
  -H 'Content-Type: application/json' \
  --data-binary @- <<'JSON'
{
  "model": "google/gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "根据最近三次工具返回,决定下一次调用,并说明这个循环的终止条件。"
    }
  ],
  "max_tokens": 4096
}
JSON

如何判断结果是否合格

拿一个有已知解的任务跑这个循环,统计它用了几步、是否自己停下来,以及失败后是换个思路还是重复同一个调用。

选型常见问题

3.7 Flash 比 3.8 Flash 慢还是快?

在这个条目上这个问题已经没有答案:Google 在 2026-10-08 弃用了 3.7 Flash,把它的请求路由到 3.8 Flash,调哪个名字落到的是同一个模型。直接调 3.8 Flash 去测。

资料来源与适用范围

技术信息来自所列模型页及其关联的发布方模型卡。模型卡描述相应检查点,不构成网关实际使用何种权重的证明。本站价格仅取自 Y-API 清单;本页没有宣称该接口的实测延迟、可用率或基准分数。