コードを変えずにモデル切替
コードには vm/<slug> だけ。主力モデルの変更や順番の調整はダッシュボードで即反映。
タイムアウト・429・5xx・ソース利用不可なら次のステップへ。課金は成功したステップだけ。
イメージのアニメーションです。429・5xx・タイムアウト・接続先の利用不可で次のステップへ進み、その他のクライアントエラーは停止し、出力開始後は再試行しません。プラットフォームのステップはクレジット利用への同意が必要です。
あなたのアプリ: model: "vm/writer" → vm/writer 失敗したときだけ次へ
openai/gpt-6.1-sol まず自分の OpenAI キーqwen/qwen3.8-27b 次に自前の GPUopenai/gpt-6-luna 最後に BazaarLink が受け止めるコードには vm/<slug> だけ。主力モデルの変更や順番の調整はダッシュボードで即反映。
BYOK キーと BYOC ノードを先に使い、足りないときだけプラットフォームクレジットへ。
Sol が混んでいれば Luna へ、クラウド障害なら自前 GPU へ。各ステップで別モデルも可能。
利用量と費用を vm 名ごとに集計し、チームや製品ごとのコストが一目でわかります。
/v1/chat/completions・/v1/responses・/v1/messages。OpenAI / Anthropic SDK をそのまま使えます。
個人アカウントと組織はそれぞれ独立した名前空間。組織メンバーは同じ仮想モデルを共有。
温度・推論強度・システムプロンプトは送ったまま転送。仮想モデルは誰が答えるかだけを決めます。
4xx などリクエスト自体の誤りは再試行せず、出力開始後に途中で切り替えることもありません。
ダッシュボードの「仮想モデル」で writer などの名前を付けます。
各ステップでソース(BYOK・BYOC・クレジット)とモデルを選び、順番を調整。
ほかのコードはそのままです。
最初の仮想モデルは 1 分ほどで作れます。
仮想モデルを作成