不改代码就能换模型
代码里只写 vm/<slug>。要换主力模型、加备援或调顺序,在后台改完立即生效。
第一步失败(超时、429、5xx、来源不可用)就自动换下一步;成功的那一步才计费。
示意动画。429、5xx、超时或来源不可用时换下一步;其他客户端错误会停止;响应开始输出后不再重试。含平台步骤时需勾选同意使用点数。
你的应用: model: "vm/writer" → vm/writer 失败才换下一步
openai/gpt-6.1-sol 先用你自己的 OpenAI 密钥qwen/qwen3.8-27b 再交给你的自有 GPUopenai/gpt-6-luna 最后由 BazaarLink 兜底代码里只写 vm/<slug>。要换主力模型、加备援或调顺序,在后台改完立即生效。
BYOK 密钥和 BYOC 节点排在前面,平台点数只在需要时接手,成本自然最低。
Sol 忙不过来就换 Luna,云端出问题就换到自有 GPU;每一步都可以是不同模型。
用量与费用按 vm 名称统计,不同团队、不同产品线的成本一目了然。
/v1/chat/completions、/v1/responses、/v1/messages 都支持,OpenAI 和 Anthropic SDK 直接沿用。
个人账号和组织各有自己的命名空间,组织成员共用同一组虚拟模型。
温度、推理强度、系统提示按你发送的原样转发,虚拟模型只负责决定由谁回答。
4xx 这类请求本身的错误不会被重试;开始输出后也不会中途改换,避免重复计费。
在控制台的「虚拟模型」页取一个名称,例如 writer。
每一步选来源(BYOK、BYOC 或平台点数)和模型,上下移动调整顺序。
其他代码完全不用动。
创建第一个虚拟模型只要一分钟。
创建虚拟模型