擷取網頁內容
從單一 URL 或一次最多 20 個 URL 擷取原始網頁內容。成功的 URL 會出現在 results,逐 URL 的失敗會出現在 failed_results;即使 HTTP 200 的 results 為空,也必須檢查這兩個陣列。輸出順序不保證。支援 query 重新排序、每來源 1–5 個 chunks(只有提供 query 時可用)、basic/advanced 擷取、圖片、favicon、markdown/text 格式,以及 1–60 秒的 timeout。未知的請求欄位會被忽略。 可使用 Authorization: Bearer <key>,也可為 Tavily 相容性在 JSON body 傳入 api_key;兩個 BazaarLink base URL 都支援:https://api.bazaarlink.ai/v1 與 https://bazaarlink.ai/api/v1。每 5 個成功 URL 擷取,basic 收取 1 credit、advanced 收取 2 credits;失敗 URL 免費。客戶價格是 credits 乘以管理員設定的每 credit 價格,請查看 BazaarLink pricing page,並以回應中的 usage.cost 為準。免費額度與 search 共用每日 credits;每日免費額度用完且沒有餘額時回傳 432。 cURL: `curl https://api.bazaarlink.ai/v1/extract -H "Authorization: Bearer $BAZAARLINK_API_KEY" -H "Content-Type: application/json" -d '{"urls":["https://example.com/article"]}'` Python: `TavilyClient(api_key=..., api_base_url="https://api.bazaarlink.ai/v1").extract(urls=[...])` JavaScript: `tavily({ apiKey, apiBaseURL })` LangChain: `TavilyExtract(api_base_url=...)`
/v1/extract驗證
Authorization必填在 Authorization 標頭以 Bearer token 傳入 API 金鑰。
Body
urls必填要擷取的 URL。可傳單一字串,或包含 1–20 個 URL 的陣列。空陣列或沒有有效 URL 會回傳 400。
["https://example.com/article"]query使用者意圖,用於重新排序擷取的內容區塊。
"key findings"chunks_per_source每個來源最多返回的相關內容區塊數。必須是 1–5,且只有提供 query 時可用。
3extract_depth擷取深度。advanced 可能擷取表格與嵌入內容,延遲較高; basic 每 5 個成功 URL 需 1 credit,advanced 需 2 credits。
basicadvanced"basic"include_images是否在每個成功結果中包含擷取到的圖片 URL。
trueinclude_favicon是否在每個成功結果中包含 favicon URL。
trueformat擷取內容的格式。markdown 保留 Markdown 結構,text 回傳純文字。
markdowntext"markdown"timeout等待 URL 擷取完成的最長秒數,範圍為 1–60。未指定時,basic 預設 10 秒,advanced 預設 30 秒。
30include_usage是否在回應中包含 credits 與 usage.cost。
true