GPU ของคุณ
โมเดลและการประมวลผลอยู่บนเครื่องของคุณ
แอนิเมชันตัวอย่าง Agent เชื่อมต่อออกไปยัง gateway จึงไม่ต้องเปิดพอร์ตขาเข้า ผูก byoc/<slug> กับรหัสโมเดลในเครื่องของคุณที่ “การผูกโมเดล” ก่อน
โมเดลและสภาพแวดล้อม inference อยู่ในอุปกรณ์ของคุณ Agent เชื่อม gateway, gateway ส่งงานของบัญชีคุณกลับไปยังโหนดของคุณ และแอปใช้ API เดียว
โมเดลและการประมวลผลอยู่บนเครื่องของคุณ
รับงานแทนได้เมื่อโหนดของคุณเต็มหรือออฟไลน์ ตามการตั้งค่า Fallback (ราคาแพลตฟอร์ม)
ทราฟฟิกที่โหนดของคุณประมวลผลไม่มีค่าโมเดลของ BazaarLink
ปลายทางเดิม ไม่ต้องแก้แอป
เลือก backend ในเครื่องที่รันโมเดล แล้วส่งค่าการเชื่อมต่อให้ Agent
backend เริ่มต้นที่ http://localhost:11434
ใช้ --backend openai และ --url พร้อม local model ID
ใช้ OpenAI-compatible streaming โดยไม่แปลงชื่อโมเดล
คุณดูแลไฟล์โมเดล inference ฮาร์ดแวร์ และสภาพแวดล้อมในเครื่องเอง
traffic ที่ node BYOC ของคุณประมวลผล BazaarLink ไม่เก็บค่าโมเดล หากใช้ฟีเจอร์ของแพลตฟอร์มร่วมด้วย เช่น การค้นเว็บ ฟีเจอร์นั้นจะคิดตามราคาแพลตฟอร์ม ส่วนอุปกรณ์และการดำเนินงานเป็นความรับผิดชอบของคุณ
โมเดลในเครื่องเชื่อมผ่าน gateway จึงไม่ต้องเขียน transport layer แยกตาม backend ขณะนี้โหนดรับคำขอสำหรับ /v1/chat/completions, /v1/responses, /v1/messages และการสร้างรูปภาพ (/v1/images)
งานจะส่งให้เฉพาะโหนดที่ผูกกับบัญชีหรือองค์กรนั้น และไม่เข้า shared pool หรือตลาด compute
Agent ส่งต่อคำขอสร้างรูปภาพไปยัง /images/generations ของ backend คุณ
tools และ tool_choice จะส่งต่อไปยัง backend ของคุณ และ tool_calls จะส่งกลับในรูปแบบ OpenAI (รองรับ backend แบบ OpenAI-compatible และ Ollama)
โมเดลแบบ reasoning ส่งเนื้อหาการคิดกลับมาในฟิลด์ reasoning_content
ในหน้า "การตั้งค่า Fallback" เลือกได้ว่าโหนดนี้ใช้กับ BazaarLink API key ใด เมื่อโหนดเต็ม ออฟไลน์ หรือเกิดข้อผิดพลาด คำขอจะลองแหล่งถัดไปตามลำดับ fallback คำขอที่โมเดลของแพลตฟอร์มประมวลผลจะคิดตามอัตราแพลตฟอร์ม
คำขอที่โหนดของคุณประมวลผลก็เพิ่ม :online ได้ ให้โมเดลค้นเว็บก่อนตอบ การค้นหาทำฝั่งแพลตฟอร์ม แล้วส่งผลลัพธ์พร้อมคำถามไปยังโหนดของคุณ ไม่มีค่าโมเดล เก็บเฉพาะค่าค้นหาตามราคาแพลตฟอร์ม บัญชีจึงต้องมียอดเงินพอสำหรับค่าค้นหา
You manage the local logs for BYOC; before a request reaches your GPU, the platform entry still applies moderation, and sensitive-data filtering is available as an opt-in.
Platform moderation runs at the API entry (/v1/chat/completions, /v1/responses) before the request is processed; BYOC cannot disable it. Blocked requests do not reach your node.
This is opt-in: organization keys use the organization rule, while personal keys are enabled by the key owner at /content-filter. Once enabled, inbound prompts replace API keys (OpenAI/Anthropic/GitHub/Google/AWS), JWTs, private keys, credit-card numbers, and Taiwan national ID numbers with [REDACTED:TYPE] before the node; prompt injection is blocked (403, code: content_filter).
Enable at /content-filter@bazaarlink/byoc-agent v0.2.0 อยู่ภายใต้ MIT ติดตั้ง CLI แบบ global จาก GitHub สาธารณะได้ ส่วนเวอร์ชัน npm registry จะตามมา Authenticated ยืนยันเพียงการเชื่อมต่อ gateway เปิด /keys/byok?tab=byoc แล้วจับคู่ canonical API ID เช่น byoc/<lowercase-slug> กับ model ID ที่ local backend ของคุณรับได้จริง จากนั้นเรียก canonical ID นั้นผ่าน API
ติดตั้ง CLI ภายใต้ MIT แบบ global จาก GitHub สาธารณะ
npm install -g github:Bazaarlinkorg/bazaarlink-byoc-agentถ้ายังไม่มี key ให้ใช้ register พร้อม email ของบัญชี
bazaarlink-byoc register \
--email you@example.com \
--max-concurrent 4login เรียก /auth/byoc/login และเก็บ key กับ token อายุสั้นไว้ในเครื่อง
bazaarlink-byoc login \
--key "byoc_..." \
--gateway "https://byoc-gateway.bazaarlink.ai" \
--input-price 0 \
--output-price 0Authenticated ยืนยันเพียงการเชื่อมต่อ gateway เปิด /keys/byok?tab=byoc แล้วจับคู่ canonical API ID เช่น byoc/<lowercase-slug> กับ model ID ที่ local backend ของคุณรับได้จริง จากนั้นเรียก canonical ID นั้นผ่าน API
bazaarlink-byoc start
# Authenticated only confirms the gateway connection.
# In /keys/byok?tab=byoc, map byoc/<lowercase-slug> to exact backend ID.ค่าต่อไปนี้ตรงกับ CLI และ package metadata ปัจจุบัน ก่อนเวอร์ชัน npm registry จะมา ให้ติดตั้งจาก GitHub สาธารณะ
ติดตั้ง CLI แบบ global จาก GitHub สาธารณะได้แล้ว ส่วนเวอร์ชัน npm registry จะตามมา
--backend ollama เป็นค่าเริ่มต้น หากใช้ที่อยู่อื่นให้เพิ่ม --ollama-url
LM Studio, vLLM และ llama.cpp ใช้ --backend openai และต้องระบุ --url
มี GPU host และ local model ต้องการดูแลโมเดลกับ inference environment เอง แต่ให้ผลิตภัณฑ์ใช้ API entry ที่คุ้นเคย
ไม่ต้องการปล่อย compute ว่างให้ผู้อื่นใช้หรือส่งคำขอไปยังโหนดร่วม BYOC เชื่อมอุปกรณ์ บัญชี และ gateway ของคุณ
เตรียมเครื่องรันโมเดลในเครื่องและ BYOC key เพื่อดูการทำงานร่วมกันของ compute โหนด และ API เดียว
จัดการ BYOC node