モデルの選び方
Y-API による選定上の提案です。以下の確認方法は評価の例であり、実測済みの結果ではありません。
最初に試したい用途
分類・抽出・要約を大量に回す用途や、難しい例だけを大型モデルへ回す二段構成の安価な前段に向きます。
選定時の注意点
200,000 トークンは新しい Haiku の 5 分の 1 で、入力価格はむしろ高めです。この系列で費用対効果の良い選択肢ではありません。公開されているパラメーター一覧も新しいモデルより狭くなっています。
モデル仕様
OpenRouter のモデル単位の仕様であり、Y-API の互換性試験ではありません。経路によって入力形式、パラメーター、トークン上限が異なる場合があります。必要な機能を小さなリクエストで確認してください。テキスト応答の成功だけでは画像認識やツール呼び出しは検証できません。
- コンテキスト長
- 200,000 tokens
- 入力
- テキスト · 画像 · ファイル
- 出力
- テキスト
- OpenRouter 掲載日
- OpenRouter に記載されたパラメーター
include_reasoningmax_completion_tokensmax_tokensreasoningresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
費用を試算
- 推定消費クレジット
- $3.75
- 推定支払額換算
- $0.375
例示用のトークン予算であり、実測値や見積保証ではありません。入力と出力を含み、個別のメディア料金、キャッシュ割引、再試行は含みません。課金される推論トークンも出力予算に含めてください。実際の請求はサービスが返す使用量に従います。
$1 の支払いで $10 のクレジットが付与されます。支払額換算は消費クレジット ÷ 10。開発元の公式価格ではありません。
| モデル | 推定消費クレジット | 推定支払額換算 |
|---|---|---|
| Claude Haiku 4.5 | $3.75 | $0.375 |
| Claude Haiku 5.5 | $0.45 | $0.045 |
| Claude Sonnet 5 | $7.00 | $0.70 |
API の利用
正確な Y-API モデル ID を使う最小限のテキストリクエストです。画像・音声・動画・ファイル・ツールの対応確認にはなりません。出力上限には推論の余地も必要です。本文が空で finish_reason=length の場合、予算を使い切った可能性があります。
試せるタスク
各サポートメッセージを請求・ログイン・障害のいずれかに分類し、1 行につきラベルと短い理由を返してください。
管理画面のキーを環境変数 TOKEN に設定し、ローカルまたはサーバーで実行してください。ブラウザーのコードや公開リポジトリにキーを含めないでください。
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "anthropic/claude-haiku-4.5",
"messages": [
{
"role": "user",
"content": "各サポートメッセージを請求・ログイン・障害のいずれかに分類し、1 行につきラベルと短い理由を返してください。"
}
],
"max_tokens": 4096
}
JSON結果の評価方法
手作業で確認した正解ラベルと照合して採点します。低信頼の例を上位モデルへ回すなら、その昇格率も併せて追跡してください。
選定時の疑問
Haiku 4.5 は Haiku 5.5 より安いですか?
いいえ、カタログでは逆です。Haiku 4.5 は入力 100 万トークンあたり $1.00 で、Haiku 5.5 の $0.15 より高く、窓も短くなっています。選ぶ前にモデル一覧で最新の数字を確認してください。
出典と適用範囲
技術情報は掲載したモデルページと、参照先の開発元カードに基づきます。カードはそのチェックポイントの説明であり、ゲートウェイの実際の重みを証明しません。料金は Y-API の一覧のみを使用しています。このエンドポイントの実測速度、稼働率、ベンチマーク値は掲載していません。