BazaarLinkBazaarLink
登入
BETA

一个模型名称,
串起你的密钥、算力与点数

把自己的 API 密钥(BYOK)、自有算力(BYOC)和平台点数,排成一条会自动接手的备援链。程序只要调用 vm/<slug>,换模型、换供应商都不用改代码。

创建虚拟模型查看使用文档

一个请求,按你排的顺序找到能回答的那一步

第一步失败(超时、429、5xx、来源不可用)就自动换下一步;成功的那一步才计费。

一个请求会怎么走?
你的应用
model: "vm/writer"
BazaarLink 虚拟模型
vm/writer
① BYOK
你的 BYOK 密钥
账单:你的上游账号
② BYOC
你的 GPU 节点
模型费:零计价
③ 平台点数
BazaarLink 平台
账单:平台点数
你的应用照常发送请求,程序不用改。

示意动画。429、5xx、超时或来源不可用时换下一步;其他客户端错误会停止;响应开始输出后不再重试。含平台步骤时需勾选同意使用点数。

你的应用: model: "vm/writer" → vm/writer 失败才换下一步

  1. BYOK openai/gpt-6.1-sol 先用你自己的 OpenAI 密钥
  2. BYOC qwen/qwen3.8-27b 再交给你的自有 GPU
  3. 平台点数 openai/gpt-6-luna 最后由 BazaarLink 兜底

为什么用虚拟模型

不改代码就能换模型

代码里只写 vm/<slug>。要换主力模型、加备援或调顺序,在后台改完立即生效。

先用自己的额度

BYOK 密钥和 BYOC 节点排在前面,平台点数只在需要时接手,成本自然最低。

跨模型、跨来源备援

Sol 忙不过来就换 Luna,云端出问题就换到自有 GPU;每一步都可以是不同模型。

按虚拟模型分账

用量与费用按 vm 名称统计,不同团队、不同产品线的成本一目了然。

三种 API 都能用

/v1/chat/completions、/v1/responses、/v1/messages 都支持,OpenAI 和 Anthropic SDK 直接沿用。

个人与组织各自管理

个人账号和组织各有自己的命名空间,组织成员共用同一组虚拟模型。

不动你的参数

温度、推理强度、系统提示按你发送的原样转发,虚拟模型只负责决定由谁回答。

只在该换时才换

4xx 这类请求本身的错误不会被重试;开始输出后也不会中途改换,避免重复计费。

三步开始

01

创建虚拟模型

在控制台的「虚拟模型」页取一个名称,例如 writer。

02

排好备援链

每一步选来源(BYOK、BYOC 或平台点数)和模型,上下移动调整顺序。

03

把 model 改成 vm/<slug>

其他代码完全不用动。

Python · OpenAI SDK
import os
from openai import OpenAI
client = OpenAI(api_key=os.environ["BAZAARLINK_API_KEY"], base_url="https://api.bazaarlink.ai/v1")
reply = client.chat.completions.create(
    model="vm/writer",
    messages=[{"role": "user", "content": "Hello"}],
)

跟一般的模型备援有什么不同

一般网关的备援BazaarLink 虚拟模型
备援来源只能在平台自己的模型之间切换你的密钥、你的 GPU、平台点数排在同一条链
顺序由平台决定完全由你决定,可随时调整
换模型要改代码里的模型名称后台改链,代码不动
成本归属混在总账里按虚拟模型名称分开统计

运作规则

  • 429、5xx、超时或来源不可用时尝试下一步;4xx 等请求本身的错误会直接返回,不再重试。
  • 开始流式输出后就不会改换来源,避免回应重复或内容混杂。
  • 成功的那一步按 BYOK、BYOC 或平台的既有规则计费;失败的尝试不收推理点数。
  • 虚拟模型目前为 Beta,功能和界面可能调整。

把备援交给规则,把时间留给产品

创建第一个虚拟模型只要一分钟。

创建虚拟模型
客服
客服
您好!有什么可以协助?
请留下消息,我们会尽快回复。
虚拟模型 (Beta) | BazaarLink | BazaarLink