モデルの選び方
Y-API による選定上の提案です。以下の確認方法は評価の例であり、実測済みの結果ではありません。
最初に試したい用途
実装、テスト、再レビューにまたがる修正で評価できます。先に合格条件を渡し、テストを弱めずに修正できたかを確認します。
選定時の注意点
推論を無効にするスイッチがあるとは仮定しないでください。推論と最終テキストの両方に予算を確保し、空の応答では打ち切りを確認します。
モデル仕様
OpenRouter のモデル単位の仕様であり、Y-API の互換性試験ではありません。経路によって入力形式、パラメーター、トークン上限が異なる場合があります。必要な機能を小さなリクエストで確認してください。テキスト応答の成功だけでは画像認識やツール呼び出しは検証できません。
- コンテキスト長
- 1,048,576 tokens
- 入力
- テキスト
- 出力
- テキスト
- OpenRouter 掲載日
- OpenRouter に記載されたパラメーター
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_pparallel_tool_callspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
費用を試算
- 推定消費クレジット
- $3.90
- 推定支払額換算
- $0.39
例示用のトークン予算であり、実測値や見積保証ではありません。入力と出力を含み、個別のメディア料金、キャッシュ割引、再試行は含みません。課金される推論トークンも出力予算に含めてください。実際の請求はサービスが返す使用量に従います。
$1 の支払いで $10 のクレジットが付与されます。支払額換算は消費クレジット ÷ 10。開発元の公式価格ではありません。
| モデル | 推定消費クレジット | 推定支払額換算 |
|---|---|---|
| GLM 5.3 | $3.90 | $0.39 |
| GLM 5.2 | $3.60 | $0.36 |
| GLM 5.3 Flash | $0.40 | $0.04 |
API の利用
正確な Y-API モデル ID を使う最小限のテキストリクエストです。画像・音声・動画・ファイル・ツールの対応確認にはなりません。出力上限には推論の余地も必要です。本文が空で finish_reason=length の場合、予算を使い切った可能性があります。
試せるタスク
支払い webhook が重複し、順序も入れ替わります。二重入金を防ぐ冪等な設計と、それを証明するテストを提案してください。
管理画面のキーを環境変数 TOKEN に設定し、ローカルまたはサーバーで実行してください。ブラウザーのコードや公開リポジトリにキーを含めないでください。
curl --fail-with-body --silent --show-error --max-time 120 \
'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
-H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
-H 'Content-Type: application/json' \
--data-binary @- <<'JSON'
{
"model": "z-ai/glm-5.3",
"messages": [
{
"role": "user",
"content": "支払い webhook が重複し、順序も入れ替わります。二重入金を防ぐ冪等な設計と、それを証明するテストを提案してください。"
}
],
"max_tokens": 4096
}
JSON結果の評価方法
永続的な一意制約と原子的な状態変更が必要です。同時重複と順序逆転を検証し、メモリー内の集合だけで済ませていないかを確認します。
選定時の疑問
GLM 5.3 の推論は無効化できますか?
確認した OpenRouter の説明ではできません。強度の選択肢と無効化は別です。Y-API のパラメーター転送も別途試験してください。
出典と適用範囲
技術情報は掲載したモデルページと、参照先の開発元カードに基づきます。カードはそのチェックポイントの説明であり、ゲートウェイの実際の重みを証明しません。料金は Y-API の一覧のみを使用しています。このエンドポイントの実測速度、稼働率、ベンチマーク値は掲載していません。