BazaarLinkBazaarLink
登入
BETA

一個模型名稱,
串起你的金鑰、算力與點數

把自己的 API 金鑰(BYOK)、自有算力(BYOC)和平台點數,排成一條會自動接手的備援鏈。程式只要呼叫 vm/<slug>,換模型、換供應商都不用改程式碼。

建立虛擬模型看使用文件

一個請求,依你排的順序找到能回答的那一步

第一步失敗(逾時、429、5xx、來源不可用)就自動換下一步;成功的那一步才計費。

一個請求會怎麼走?
你的應用
model: "vm/writer"
BazaarLink 虛擬模型
vm/writer
① BYOK
你的 BYOK 金鑰
帳單:你的上游帳號
② BYOC
你的 GPU 節點
模型費:零計價
③ 平台點數
BazaarLink 平台
帳單:平台點數
你的應用照常送出請求,程式不用改。

示意動畫。429、5xx、逾時或來源不可用時換下一步;其他用戶端錯誤會停止;回應開始輸出後不再重試。含平台步驟時需勾選同意使用點數。

你的應用: model: "vm/writer" → vm/writer 失敗才換下一步

  1. BYOK openai/gpt-6.1-sol 先用你自己的 OpenAI 金鑰
  2. BYOC qwen/qwen3.8-27b 再交給你的自有 GPU
  3. 平台點數 openai/gpt-6-luna 最後由 BazaarLink 兜底

為什麼用虛擬模型

不改程式碼就能換模型

程式裡只寫 vm/<slug>。要換主力模型、加備援或調順序,在後台改完立即生效。

先用自己的額度

BYOK 金鑰和 BYOC 節點排在前面,平台點數只在需要時接手,成本自然最低。

跨模型、跨來源備援

Sol 忙不過來就換 Luna,雲端出問題就換到自有 GPU;每一步都可以是不同模型。

依虛擬模型分帳

用量與費用按 vm 名稱統計,不同團隊、不同產品線的成本一眼分清楚。

三種 API 都能用

/v1/chat/completions、/v1/responses、/v1/messages 都支援,OpenAI 和 Anthropic SDK 直接沿用。

個人與組織各自管理

個人帳號和組織各有自己的命名空間,組織成員共用同一組虛擬模型。

不動你的參數

溫度、推理強度、系統提示照你送的原樣轉發,虛擬模型只負責決定由誰回答。

只在該換時才換

4xx 這類請求本身的錯誤不會被重試;開始輸出後也不會中途改換,避免重複計費。

三步開始

01

建立虛擬模型

在控制台的「虛擬模型」頁取一個名稱,例如 writer。

02

排好備援鏈

每一步選來源(BYOK、BYOC 或平台點數)和模型,拖曳或上下移動調整順序。

03

把 model 改成 vm/<slug>

其他程式碼完全不用動。

Python · OpenAI SDK
import os
from openai import OpenAI
client = OpenAI(api_key=os.environ["BAZAARLINK_API_KEY"], base_url="https://api.bazaarlink.ai/v1")
reply = client.chat.completions.create(
    model="vm/writer",
    messages=[{"role": "user", "content": "Hello"}],
)

跟一般的模型備援有什麼不同

一般閘道的備援BazaarLink 虛擬模型
備援來源只能在平台自己的模型之間切換你的金鑰、你的 GPU、平台點數排在同一條鏈
順序由平台決定完全由你決定,可隨時調整
換模型要改程式碼裡的模型名稱後台改鏈,程式碼不動
成本歸屬混在總帳裡按虛擬模型名稱分開統計

運作規則

  • 429、5xx、逾時或來源不可用時嘗試下一步;4xx 等請求本身的錯誤會直接回傳,不再重試。
  • 開始串流輸出後就不會改換來源,避免回應重複或內容混雜。
  • 成功的那一步依 BYOK、BYOC 或平台的既有規則計費;失敗的嘗試不收推論點數。
  • 虛擬模型目前為 Beta,功能和介面可能調整。

把備援交給規則,把時間留給產品

建立第一個虛擬模型只要一分鐘。

建立虛擬模型
客服
客服
您好!有什麼可以協助?
請留下訊息,我們會盡快回覆。
虛擬模型 (Beta) | BazaarLink | BazaarLink