如何选择这个模型
以下为 Y-API 的选型建议与评估方法,不是已经完成的实测结论。
适合从这些任务开始
可先用来建立客服工单分类、文本清理、小段代码解释的基线。保留一组难例,再判断是否值得把任务迁到更新的 Flash 版本,而不是只比较正常样本的回答流畅度。
选择前需要注意
没有日期后缀的 API ID 不代表自动跟随最新版。OpenRouter 将此条目标为 0423;不要推断它具备 V4.1 Flash 的图片输入或相同行为。
模型规格
以下是 OpenRouter 的模型级规格快照,不是 Y-API 的兼容性实测。具体路由可接受的输入格式、参数和 token 上限可能更少。上线前请用小请求验证所需能力;文本请求成功不等于看图或工具调用已经验证。
- 上下文窗口
- 1,048,576 tokens
- 输入
- 文本
- 输出
- 文本
- OpenRouter 收录日期
- OpenRouter 列出的参数
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_completion_tokensmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p
估算使用成本
当前清单将此模型标记为免费,调用不扣额度。这不代表无限容量、永久可用,也不保证以后仍免费。
- 预计消耗额度
- 免费 — 不扣额度
- 预计折合实付
- 免费 — 不扣额度
这是示例用量预算,不是实测用量或报价承诺。包含输入和输出,不含单独的媒体收费、缓存优惠及重试;若推理 tokens 计费,也应计入输出预算。实际扣费以服务返回的用量为准。
充值 $1 获得 $10 额度。折合实付 = 消耗额度 ÷ 10,不是模型发布方的官方报价。
| 模型 | 预计消耗额度 | 预计折合实付 |
|---|---|---|
| DeepSeek V4 Flash 0423 | 免费 — 不扣额度 | |
| DeepSeek V4 Flash 0731 | US$0.30 | US$0.03 |
| DeepSeek V4.1 Flash | US$0.70 | US$0.07 |
API 接入
示例使用 Y-API 的完整模型 ID,仅发送文本,不代表图片、音频、视频、文件或工具能力已经验证。输出上限还需给推理过程留空间;若正文为空且 finish_reason=length,可能是预算已耗尽。
可以先试的任务
把这条工单归为账单、登录或故障,并给出一个理由:同一张发票被扣款了两次。
将控制台创建的密钥写入环境变量 TOKEN,在本地或服务端运行。不要把密钥放进浏览器代码或公开仓库。
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "deepseek/deepseek-v4-flash",
"messages": [
{
"role": "user",
"content": "把这条工单归为账单、登录或故障,并给出一个理由:同一张发票被扣款了两次。"
}
],
"max_tokens": 4096
}
JSON如何判断结果是否合格
应归入账单,理由只使用工单提供的信息。再加入描述模糊、一条工单包含多个问题的样本,统计分错队列的比例。
选型常见问题
它和 V4 Flash 0731 是同一个模型吗?
不是,两者的调用 ID 不同。发布方将 0731 描述为替代预览版的正式发布。保存评估结果时应记录完整 ID,切换前重新测试,不能沿用旧版本结论。
资料来源与适用范围
技术信息来自所列模型页及其关联的发布方模型卡。模型卡描述相应检查点,不构成网关实际使用何种权重的证明。本站价格仅取自 Y-API 清单;本页没有宣称该接口的实测延迟、可用率或基准分数。