あなたの GPU リソース
モデルと推論は自分の機器に残る
イメージのアニメーションです。Agent は gateway へ外向きに接続するため、受信ポートの開放は不要です。先に「モデルバインド」で byoc/<slug> をローカルのモデル ID に対応づけます。
モデルと推論環境は自分の機器に置きます。Agent が gateway に接続し、gateway が所有アカウントの処理を自分のノードへ送り、アプリは一つの API 入口を使います。
モデルと推論は自分の機器に残る
ノードが満杯・オフラインのとき、フォールバック設定に従って引き受け可能(プラットフォーム料金)
自分のノードが処理した分はモデル料金 0
同じ入口のまま、アプリの変更は不要
モデルを実行するローカル backend を選び、その接続設定を Agent に渡します。
既定の backend。既定 URL は http://localhost:11434 です。
--backend openai と --url を使い、ローカルが受け付ける model ID を指定します。
モデル名の変換なしで同じ OpenAI-compatible streaming 経路を使います。
モデル、推論処理、ハードウェア、ローカル環境を自分で管理できます。
自分のノードが処理するトラフィックに BazaarLink のモデル料金はかかりません。Web 検索などのプラットフォーム機能を併用した場合、その機能はプラットフォーム料金で課金されます。機器、電力、運用は自分の負担です。
ローカルモデルを gateway 経由で接続するため、backend ごとの通信層を製品コードに追加しません。 ノードは現在、/v1/chat/completions、/v1/responses、/v1/messages、画像生成(/v1/images)のリクエストを受け付けます。
処理はバインドされたアカウントまたは組織のノードにだけ渡され、共有プールや計算資源マーケットには入りません。
Agent は画像生成リクエストを backend の /images/generations に転送します。
tools と tool_choice を backend に転送し、tool_calls を OpenAI 形式で返します(OpenAI-compatible と Ollama backend に対応)。
推論モデルの思考内容は reasoning_content フィールドで返します。
「フォールバック設定」ページで、このノードを適用する BazaarLink API キーを指定できます。ノードが満杯・オフライン・エラーのときは、フォールバック順の次の接続元を試します。プラットフォームのモデルが処理したリクエストはプラットフォーム料金で課金されます。
あなたのノードが処理するリクエストでも :online を付ければ、モデルは回答前に Web を検索します。検索はプラットフォーム側で行い、結果を質問と一緒にノードへ渡します。モデル料金は 0 で、検索料金(プラットフォーム料金)のみ請求するため、検索料金を支払える残高が必要です。
BYOC のローカルログはあなたが管理します。リクエストが GPU に届く前に、入口ではモデレーションが適用され、機密データフィルターは opt-in で有効化できます。
プラットフォームのモデレーションは API 入口(/v1/chat/completions、/v1/responses)でリクエスト処理前に実行され、BYOC から無効化できません。ブロックされたリクエストはノードに届きません。
これは opt-in です。組織キーは組織のルールで、個人キーはキー所有者が /content-filter で有効化します。有効化すると、inbound prompt の API キー(OpenAI/Anthropic/GitHub/Google/AWS)、JWT、秘密鍵、カード番号、台湾の身分証番号をノード到達前に [REDACTED:TYPE] へ置換します。prompt injection は 403(code: content_filter)でブロックされます。
/content-filter で有効化@bazaarlink/byoc-agent v0.2.0 は MIT ライセンスです。公開 GitHub から CLI をグローバルインストールでき、npm registry 版は後日提供します。 Authenticated は gateway 接続の確認だけです。次に /keys/byok?tab=byoc を開き、byoc/<lowercase-slug> のような canonical API ID をローカル backend が受け付ける正確な model ID に対応付けてから、その canonical ID を API で呼び出します。
公開 GitHub から MIT ライセンスの CLI をグローバルインストールします。
npm install -g github:Bazaarlinkorg/bazaarlink-byoc-agentkey があれば次へ進みます。なければ account email を指定して register を実行します。
bazaarlink-byoc register \
--email you@example.com \
--max-concurrent 4login は /auth/byoc/login を呼び出し、key と短期 token をローカルに保存します。
bazaarlink-byoc login \
--key "byoc_..." \
--gateway "https://byoc-gateway.bazaarlink.ai" \
--input-price 0 \
--output-price 0Authenticated は gateway 接続の確認だけです。次に /keys/byok?tab=byoc を開き、byoc/<lowercase-slug> のような canonical API ID をローカル backend が受け付ける正確な model ID に対応付けてから、その canonical ID を API で呼び出します。
bazaarlink-byoc start
# Authenticated only confirms the gateway connection.
# In /keys/byok?tab=byoc, map byoc/<lowercase-slug> to exact backend ID.以下は現在の CLI と package metadata に対応しています。npm registry 版が提供されるまでは公開 GitHub からインストールしてください。
公開 GitHub から CLI をグローバルインストールしてください。npm registry 版は後日提供します。
--backend ollama が既定値です。別の URL なら --ollama-url を追加します。
LM Studio、vLLM、llama.cpp は --backend openai。--url は必須です。接続後、BYOC binding page で canonical API ID を backend が受け付ける model ID に対応付けます。
GPU ホストとローカルモデルがあり、モデルと推論環境を管理下に置きながら、製品には馴染みのある API 入口を残したいチーム。
アイドル計算資源を貸し出したくなく、共有ノードへ処理を送らない構成を求めるチーム。BYOC は機器、アカウント、gateway を一つの経路でつなぎます。
ローカルモデルマシンと BYOC key を用意し、自分の計算資源、ノード、API 入口の連携を確認できます。
BYOC ノードを管理