Ваши GPU-мощности
Модель и инференс остаются на вашем оборудовании
Схематичная анимация. Агент сам подключается к шлюзу исходящим соединением, открывать входящий порт не нужно. Сначала свяжите byoc/<slug> с локальным ID модели в разделе привязок моделей.
Модель и среда инференса остаются на вашем устройстве. Agent подключается к gateway, gateway отправляет работу вашего аккаунта вашему узлу, а приложение сохраняет один API.
Модель и инференс остаются на вашем оборудовании
Могут подхватить запросы, когда ваш узел загружен или офлайн, согласно настройкам резерва (по тарифу платформы)
Без платы BazaarLink за модель для трафика через собственный узел
Тот же endpoint, приложение не меняется
Выберите локальный backend для модели и передайте Agent его параметры подключения.
Backend по умолчанию; URL по умолчанию — http://localhost:11434.
Используйте --backend openai и --url с локальным model ID.
Использует потоковый OpenAI-compatible путь без переименования модели.
Вы управляете файлами моделей, инференсом, оборудованием и локальной средой.
За трафик, который обрабатывает ваш собственный BYOC-узел, BazaarLink не берёт плату за модель; если вы используете функции платформы, например веб-поиск, они оплачиваются по ценам платформы. Устройство и эксплуатация остаются вашей ответственностью.
Локальная модель подключается через gateway, поэтому в коде продукта не нужна отдельная транспортная прослойка для каждого backend. Узел сейчас принимает запросы к /v1/chat/completions, /v1/responses, /v1/messages и для генерации изображений (/v1/images).
Задачи получают только узлы, привязанные к этому аккаунту или организации; они не попадают в общий пул или рынок вычислений.
Agent передаёт запросы на генерацию изображений в /images/generations вашего backend.
tools и tool_choice передаются вашему backend, а tool_calls возвращаются в формате OpenAI (backend OpenAI-compatible и Ollama).
Модели с рассуждениями возвращают ход мысли в поле reasoning_content.
На странице «Настройки резерва» выберите, к каким API-ключам BazaarLink применяется этот узел. Если узел загружен, офлайн или вернул ошибку, запрос пробует следующий источник в резервном порядке; запросы, обработанные моделью платформы, оплачиваются по тарифу платформы.
К запросам, которые обрабатывает ваш узел, тоже можно добавить :online, чтобы модель перед ответом искала в интернете: поиск выполняется на стороне платформы, а результаты передаются узлу вместе с вопросом. Плата за модель — ноль; берётся только плата за поиск по цене платформы, поэтому на счёте нужен достаточный баланс.
You manage the local logs for BYOC; before a request reaches your GPU, the platform entry still applies moderation, and sensitive-data filtering is available as an opt-in.
Platform moderation runs at the API entry (/v1/chat/completions, /v1/responses) before the request is processed; BYOC cannot disable it. Blocked requests do not reach your node.
This is opt-in: organization keys use the organization rule, while personal keys are enabled by the key owner at /content-filter. Once enabled, inbound prompts replace API keys (OpenAI/Anthropic/GitHub/Google/AWS), JWTs, private keys, credit-card numbers, and Taiwan national ID numbers with [REDACTED:TYPE] before the node; prompt injection is blocked (403, code: content_filter).
Enable at /content-filter@bazaarlink/byoc-agent v0.2.0 распространяется по MIT. Установите CLI глобально из публичного GitHub; версия в npm registry выйдет позже. Authenticated подтверждает только подключение к gateway. Откройте /keys/byok?tab=byoc, сопоставьте canonical API ID вида byoc/<lowercase-slug> с точным ID модели, который принимает ваш локальный backend, затем вызывайте этот canonical ID через API.
Установите CLI с лицензией MIT глобально из публичного GitHub.
npm install -g github:Bazaarlinkorg/bazaarlink-byoc-agentЕсли ключа нет, зарегистрируйтесь через register с email вашего аккаунта.
bazaarlink-byoc register \
--email you@example.com \
--max-concurrent 4login вызывает /auth/byoc/login и сохраняет key и краткоживущий token в локальной конфигурации.
bazaarlink-byoc login \
--key "byoc_..." \
--gateway "https://byoc-gateway.bazaarlink.ai" \
--input-price 0 \
--output-price 0Authenticated подтверждает только подключение к gateway. Откройте /keys/byok?tab=byoc, сопоставьте canonical API ID вида byoc/<lowercase-slug> с точным ID модели, который принимает ваш локальный backend, затем вызывайте этот canonical ID через API.
bazaarlink-byoc start
# Authenticated only confirms the gateway connection.
# In /keys/byok?tab=byoc, map byoc/<lowercase-slug> to exact backend ID.Эти значения соответствуют текущим CLI и metadata пакета. До выхода версии в npm registry устанавливайте из публичного GitHub.
CLI устанавливается глобально из публичного GitHub; версия в npm registry выйдет позже.
--backend ollama используется по умолчанию; для другого адреса добавьте --ollama-url.
LM Studio, vLLM и llama.cpp используют --backend openai; --url обязателен.
У вас есть GPU host и локальная модель: вы хотите сами управлять моделью и средой инференса, сохранив привычную API-точку для продукта.
Вы не хотите сдавать свободные вычисления и отправлять запросы в общий пул узлов. BYOC соединяет ваше устройство, аккаунт и gateway.
Подготовьте локальную машину с моделью и BYOC key, чтобы проверить связку вычислений, узла и единого API.
Управлять BYOC-узлами