モデルの選び方
Y-API による選定上の提案です。以下の確認方法は評価の例であり、実測済みの結果ではありません。
最初に試したい用途
意図分類や少数フィールドの抽出など、境界が明確な仕事から試します。曖昧または重要な判断は別のモデルや人へ回す経路を用意します。
選定時の注意点
位置づけは Y-API の遅延測定ではありません。構造化出力の仕様があっても、スキーマ検査、未知値の処理、エスカレーションは必要です。
モデル仕様
OpenRouter のモデル単位の仕様であり、Y-API の互換性試験ではありません。経路によって入力形式、パラメーター、トークン上限が異なる場合があります。必要な機能を小さなリクエストで確認してください。テキスト応答の成功だけでは画像認識やツール呼び出しは検証できません。
- コンテキスト長
- 1,050,000 tokens
- 入力
- ファイル · 画像 · テキスト
- 出力
- テキスト
- OpenRouter 掲載日
- OpenRouter に記載されたパラメーター
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetoolsverbosity
費用を試算
- 推定消費クレジット
- $0.95
- 推定支払額換算
- $0.095
例示用のトークン予算であり、実測値や見積保証ではありません。入力と出力を含み、個別のメディア料金、キャッシュ割引、再試行は含みません。課金される推論トークンも出力予算に含めてください。実際の請求はサービスが返す使用量に従います。
$1 の支払いで $10 のクレジットが付与されます。支払額換算は消費クレジット ÷ 10。開発元の公式価格ではありません。
| モデル | 推定消費クレジット | 推定支払額換算 |
|---|---|---|
| GPT-5.6 Luna | $0.95 | $0.095 |
| GPT-5.6 Sol | $20.00 | $2.00 |
| Qwen3.8 Flash | $0.45 | $0.045 |
API の利用
正確な Y-API モデル ID を使う最小限のテキストリクエストです。画像・音声・動画・ファイル・ツールの対応確認にはなりません。出力上限には推論の余地も必要です。本文が空で finish_reason=length の場合、予算を使い切った可能性があります。
試せるタスク
次の文から order_id と intent を JSON で抽出し、情報を追加しないでください。発送前に注文 A-1042 をキャンセルしてください。
管理画面のキーを環境変数 TOKEN に設定し、ローカルまたはサーバーで実行してください。ブラウザーのコードや公開リポジトリにキーを含めないでください。
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "openai/gpt-5.6-luna",
"messages": [
{
"role": "user",
"content": "次の文から order_id と intent を JSON で抽出し、情報を追加しないでください。発送前に注文 A-1042 をキャンセルしてください。"
}
],
"max_tokens": 4096
}
JSON結果の評価方法
番号と意図を検証し、番号欠落や複数注文も試します。確信した誤抽出と JSON の形式エラーを分けて測定します。
選定時の疑問
いつ Sol に切り替えるべきですか?
証拠の衝突、検証の反復失敗、深い推論が必要な課題などを自社評価で定義してください。モデル自身の自信だけを判断基準にしないでください。
出典と適用範囲
技術情報は掲載したモデルページと、参照先の開発元カードに基づきます。カードはそのチェックポイントの説明であり、ゲートウェイの実際の重みを証明しません。料金は Y-API の一覧のみを使用しています。このエンドポイントの実測速度、稼働率、ベンチマーク値は掲載していません。