BazaarLinkBazaarLink
Masuk
DokumentasiReferensi APIReferensi SDKPenggunaan AgentikSkill AI
Pencarian Web

Ekstrak konten web

Ekstrak konten web mentah dari satu URL atau kumpulan hingga 20 URL. URL yang berhasil muncul di results dan kegagalan per URL muncul di failed_results; meskipun HTTP 200 mengembalikan array results kosong, periksa kedua array. Urutan output tidak dijamin. Endpoint ini mendukung pemeringkatan ulang dengan query, 1–5 chunk per sumber (hanya jika query diberikan), ekstraksi basic atau advanced, gambar, favicon, format markdown atau text, serta timeout 1–60 detik. Field permintaan yang tidak dikenal akan diabaikan. Gunakan Authorization: Bearer <key>, atau kirim api_key dalam JSON body sebagai fallback kompatibel Tavily. Kedua base URL BazaarLink didukung: https://api.bazaarlink.ai/v1 dan https://bazaarlink.ai/api/v1. Setiap 5 ekstraksi URL yang berhasil memakai 1 credit untuk basic atau 2 credits untuk advanced; URL yang gagal gratis. Harga pelanggan adalah credits dikalikan harga per credit yang ditetapkan admin. Lihat BazaarLink pricing page dan gunakan usage.cost dari response. Kuota gratis berbagi credits harian yang sama dengan search; jika habis tanpa saldo, response adalah 432. cURL: `curl https://api.bazaarlink.ai/v1/extract -H "Authorization: Bearer $BAZAARLINK_API_KEY" -H "Content-Type: application/json" -d '{"urls":["https://example.com/article"]}'` Python: `TavilyClient(api_key=..., api_base_url="https://api.bazaarlink.ai/v1").extract(urls=[...])` JavaScript: `tavily({ apiKey, apiBaseURL })` LangChain: `TavilyExtract(api_base_url=...)`

POST/v1/extract

Otorisasi

Authorizationwajib
string · header

API key sebagai bearer token di header Authorization.

Body

urlswajib
string | string[]

URL yang akan diekstrak. Kirim satu string atau array berisi 1–20 URL. Array kosong atau tidak ada URL valid mengembalikan 400.

string or array of 1–20 URLs
Example: ["https://example.com/article"]
query
string

Maksud pengguna yang digunakan untuk memberi peringkat ulang chunk konten yang diekstrak.

Example: "key findings"
chunks_per_source
integer

Jumlah maksimum chunk konten relevan per sumber. Harus 1–5 dan hanya tersedia jika query diberikan.

1–5; only with query
Example: 3
extract_depth
string

Kedalaman ekstraksi. advanced dapat mengambil tabel dan konten tertanam dengan latensi lebih tinggi; basic memakai 1 credit per 5 URL berhasil dan advanced 2 credits.

default: basic
basicadvanced
Example: "basic"
include_images
boolean

Apakah URL gambar yang diekstrak dari setiap halaman berhasil disertakan.

default: false
Example: true
include_favicon
boolean

Apakah URL favicon disertakan di setiap hasil yang berhasil.

default: false
Example: true
format
string

Format konten yang diekstrak. markdown mempertahankan struktur Markdown; text mengembalikan teks biasa.

default: markdown
markdowntext
Example: "markdown"
timeout
number

Maksimum detik untuk menunggu ekstraksi, dari 1–60. Jika dihilangkan, default 10 detik untuk basic dan 30 detik untuk advanced.

1–60 seconds; default depends on extract_depth
Example: 30
include_usage
boolean

Apakah credits dan usage.cost disertakan dalam response.

default: false
Example: true
POST /v1/extract
curl https://api.bazaarlink.ai/v1/extract \
  -H "Authorization: Bearer $BAZAARLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "urls": ["https://example.com/article", "https://example.org/docs"],
    "query": "key findings",
    "chunks_per_source": 3,
    "extract_depth": "basic",
    "include_images": true,
    "include_favicon": true,
    "format": "markdown",
    "timeout": 30,
    "include_usage": true
  }'
Contoh respons

Ekstraksi selesai. Periksa results untuk item yang berhasil dan failed_results untuk kegagalan per URL. HTTP 200 dapat memiliki array results kosong dan urutan output tidak dijamin. usage.credits adalah penggunaan credit; usage.cost adalah harga USD yang ditagihkan BazaarLink kepada pelanggan, bukan biaya upstream; request_id adalah ID permintaan yang dibuat BazaarLink.

{
  "results": [
    {
      "url": "https://example.com/article",
      "raw_content": "Article content extracted as Markdown.",
      "images": [
        "https://example.com/image.jpg"
      ],
      "favicon": "https://example.com/favicon.ico"
    }
  ],
  "failed_results": [
    {
      "url": "https://example.org/unavailable",
      "error": "Failed to retrieve content"
    }
  ],
  "response_time": 0.42,
  "usage": {
    "credits": 1,
    "cost": 0
  },
  "request_id": "bl-extract-example-request"
}
Support
Support
Hi! How can we help you?
Send a message and we'll get back to you soon.