你的 GPU 算力
模型與推理留在你的設備
示意動畫。Agent 主動連出到 gateway,不需要開對外 port;節點要先在「模型綁定」把 byoc/<slug> 對應到本機模型 ID。
模型與推理環境留在你的設備。Agent 主動連到 gateway,gateway 將屬於你的請求交給你的節點;應用程式維持同一個 API 入口。
模型與推理留在你的設備
節點滿載或離線時,可依你的備援設定接手(依平台費率)
自己節點處理的流量,模型費零計價
同一個入口,程式不用改
選擇要執行模型的本機 backend,再把連線設定提供給 Agent。
預設 backend;預設 URL 是 http://localhost:11434。
使用 --backend openai 與 --url,模型 ID 填本地服務實際接受的值。
同樣走 OpenAI-compatible streaming 路徑,不會自動轉換模型名稱。
模型檔案、推理程序、硬體與本地運行環境由你管理。
自己節點處理的流量,BazaarLink 不收模型費用;若同時使用網路搜尋等平台功能,該功能依平台價格計費。設備、電力與維運成本仍由你負責。
本地模型透過 gateway 接入,產品程式不必為每個 backend 另寫一套傳輸層。 節點目前接收 /v1/chat/completions、/v1/responses、/v1/messages 與圖片生成(/v1/images)的請求。
工作只會交給綁定帳戶或組織的節點,不加入共享算力池,也不是算力市集。
Agent 會把圖片生成請求轉給你 backend 的 /images/generations。
tools 與 tool_choice 會轉給你的 backend,tool_calls 以 OpenAI 格式回傳(OpenAI-compatible 與 Ollama backend 都支援)。
推理模型的思考內容會放在 reasoning_content 欄位回傳。
在「備援設定」頁指定這個節點套用到哪些 BazaarLink API 金鑰。節點滿載、離線或出錯時,請求會依備援順序改試下一個來源;改由平台模型處理的請求依平台費率計費。
由你的節點處理的請求,一樣可以加上 :online 先查網路再回答:搜尋在平台端完成,結果連同問題一起交給你的節點。模型費零計價,只收搜尋費(依平台價格),帳戶需有足夠餘額支付搜尋費。
BYOC 的本地日誌由你自己管理;請求進入你的 GPU 前,平台入口仍會先做審查,而敏感資料過濾可以由你選擇啟用。
平台審查在 API 入口(/v1/chat/completions、/v1/responses)處理請求前執行,BYOC 無法停用;被擋的請求不會到你的節點。
這是 opt-in:組織 key 由組織開規則,個人 key 由 key 主人在 /content-filter 開啟。啟用後,inbound prompt 裡的 API 金鑰(OpenAI/Anthropic/GitHub/Google/AWS)、JWT、私鑰、信用卡號與台灣身分證字號,會在進節點前換成 [REDACTED:TYPE];prompt injection 會被擋下(403,code: content_filter)。
前往 /content-filter 開啟@bazaarlink/byoc-agent v0.2.0 採 MIT 授權;現在可從公開 GitHub 全域安裝 CLI,npm registry 版本稍後推出。 Authenticated 只代表 gateway 連線成功。接著開啟 /keys/byok?tab=byoc,將像 byoc/<lowercase-slug> 這樣的 canonical API ID 對應到本機 backend 實際接受的 model ID,之後用該 canonical ID 呼叫 API。
從公開 GitHub 安裝 MIT 授權的 CLI。
npm install -g github:Bazaarlinkorg/bazaarlink-byoc-agent已有 key 可直接下一步;沒有時用 register 提交帳戶 email。
bazaarlink-byoc register \
--email you@example.com \
--max-concurrent 4login 會呼叫 /auth/byoc/login 並將 key 與短期 token 存在本機設定檔。
bazaarlink-byoc login \
--key "byoc_..." \
--gateway "https://byoc-gateway.bazaarlink.ai" \
--input-price 0 \
--output-price 0Authenticated 只代表 gateway 連線成功。接著開啟 /keys/byok?tab=byoc,將像 byoc/<lowercase-slug> 這樣的 canonical API ID 對應到本機 backend 實際接受的 model ID,之後用該 canonical ID 呼叫 API。
bazaarlink-byoc start
# Authenticated only confirms the gateway connection.
# In /keys/byok?tab=byoc, map byoc/<lowercase-slug> to exact backend ID.以下欄位對應目前 CLI 與套件 metadata;npm registry 版本推出前,請從公開 GitHub 安裝。
CLI 現在可從公開 GitHub 全域安裝;npm registry 版本稍後推出。
--backend ollama 是預設值;需要其他 Ollama 位址時再加 --ollama-url。
LM Studio、vLLM、llama.cpp 使用 --backend openai;--url 必填,連線後在 BYOC 綁定頁將 canonical API ID 對應到 backend 接受的 model ID。
你有自己的 GPU 主機與本地模型,希望模型檔案和推理環境留在自己的設備,同時讓產品繼續使用熟悉的 API 入口。
你不想出租閒置算力,也不希望請求進入共享節點;BYOC 將自有設備、自己的帳戶與統一 gateway 接在同一條路徑上。
準備一台本地模型機器與 BYOC key,就能開始驗證自己的算力、自己的節點與統一 API 入口如何配合。
管理 BYOC 節點