BazaarLinkBazaarLink
Войти
ДокументацияAPI СсылкаSDK СсылкаАгентное использованиеAI Навыки
Веб-поиск

Извлечь веб-контент

Извлекает необработанный веб-контент из одного URL или из пакета до 20 URL. Успешные URL находятся в results, а ошибки для отдельных URL — в failed_results; даже если HTTP 200 возвращает пустой массив results, проверяйте оба массива. Порядок вывода не гарантируется. Поддерживаются переранжирование по query, 1–5 фрагментов на источник (только при наличии query), извлечение basic или advanced, изображения, favicon, форматы markdown или text и тайм-аут 1–60 секунд. Неизвестные поля запроса игнорируются. Используйте Authorization: Bearer <key> или передайте api_key в JSON body как совместимый с Tavily fallback. Поддерживаются оба base URL BazaarLink: https://api.bazaarlink.ai/v1 и https://bazaarlink.ai/api/v1. Каждые 5 успешно извлечённых URL стоят 1 credit для basic или 2 credits для advanced; неуспешные URL бесплатны. Цена для клиента равна числу credits, умноженному на цену одного credit, заданную администратором. См. BazaarLink pricing page и используйте usage.cost из ответа. Бесплатный лимит использует те же дневные credits, что и search; если лимит исчерпан и остатка нет, ответ будет 432. cURL: `curl https://api.bazaarlink.ai/v1/extract -H "Authorization: Bearer $BAZAARLINK_API_KEY" -H "Content-Type: application/json" -d '{"urls":["https://example.com/article"]}'` Python: `TavilyClient(api_key=..., api_base_url="https://api.bazaarlink.ai/v1").extract(urls=[...])` JavaScript: `tavily({ apiKey, apiBaseURL })` LangChain: `TavilyExtract(api_base_url=...)`

POST/v1/extract

Авторизация

Authorizationобязательно
string · header

Ключ API как Bearer-токен в заголовке Authorization.

Тело

urlsобязательно
string | string[]

URL для извлечения. Передайте одну строку или массив из 1–20 URL. Пустой массив или отсутствие допустимого URL возвращает 400.

string or array of 1–20 URLs
Example: ["https://example.com/article"]
query
string

Намерение пользователя для переранжирования извлечённых фрагментов.

Example: "key findings"
chunks_per_source
integer

Максимальное число релевантных фрагментов на источник. Должно быть от 1 до 5 и доступно только при указании query.

1–5; only with query
Example: 3
extract_depth
string

Глубина извлечения. advanced может получать таблицы и встроенный контент с большей задержкой; basic стоит 1 credit за каждые 5 успешных URL, advanced — 2 credits.

default: basic
basicadvanced
Example: "basic"
include_images
boolean

Добавлять ли URL изображений, извлечённых с каждой успешной страницы.

default: false
Example: true
include_favicon
boolean

Добавлять ли URL favicon в каждый успешный результат.

default: false
Example: true
format
string

Формат извлечённого контента. markdown сохраняет структуру Markdown, а text возвращает обычный текст.

default: markdown
markdowntext
Example: "markdown"
timeout
number

Максимальное время ожидания извлечения в секундах, от 1 до 60. Если не указано, по умолчанию 10 секунд для basic и 30 секунд для advanced.

1–60 seconds; default depends on extract_depth
Example: 30
include_usage
boolean

Добавлять ли credits и usage.cost в ответ.

default: false
Example: true
POST /v1/extract
curl https://api.bazaarlink.ai/v1/extract \
  -H "Authorization: Bearer $BAZAARLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "urls": ["https://example.com/article", "https://example.org/docs"],
    "query": "key findings",
    "chunks_per_source": 3,
    "extract_depth": "basic",
    "include_images": true,
    "include_favicon": true,
    "format": "markdown",
    "timeout": 30,
    "include_usage": true
  }'
Примеры ответов

Извлечение завершено. Проверяйте results на успешные элементы и failed_results на ошибки отдельных URL. При HTTP 200 массив results может быть пустым, а порядок вывода не гарантируется. usage.credits — расход credits; usage.cost — цена в USD, выставленная BazaarLink клиенту, а не стоимость upstream; request_id — созданный BazaarLink ID запроса.

{
  "results": [
    {
      "url": "https://example.com/article",
      "raw_content": "Article content extracted as Markdown.",
      "images": [
        "https://example.com/image.jpg"
      ],
      "favicon": "https://example.com/favicon.ico"
    }
  ],
  "failed_results": [
    {
      "url": "https://example.org/unavailable",
      "error": "Failed to retrieve content"
    }
  ],
  "response_time": 0.42,
  "usage": {
    "credits": 1,
    "cost": 0
  },
  "request_id": "bl-extract-example-request"
}
Поддержка
Поддержка
Здравствуйте! Чем мы можем помочь?
Отправьте сообщение, и мы ответим в ближайшее время.