提取网页内容
从单个 URL 或一次最多 20 个 URL 提取原始网页内容。成功的 URL 会出现在 results 中,每个 URL 的失败会出现在 failed_results 中;即使 HTTP 200 返回空的 results 数组,也必须检查这两个数组。输出顺序不保证。支持 query 重排、每个来源 1–5 个 chunks(仅在提供 query 时可用)、basic/advanced 提取、图片、favicon、markdown/text 格式,以及 1–60 秒的 timeout。未知请求字段会被忽略。 可以使用 Authorization: Bearer <key>,也可以为兼容 Tavily 在 JSON body 中传入 api_key。支持两个 BazaarLink base URL:https://api.bazaarlink.ai/v1 和 https://bazaarlink.ai/api/v1。每成功提取 5 个 URL,basic 收取 1 credit,advanced 收取 2 credits;失败 URL 免费。客户价格为 credits 乘以管理员设置的每 credit 价格,请查看 BazaarLink pricing page,并以响应中的 usage.cost 为准。免费额度与 search 共用每日 credits;每日免费额度用完且没有余额时返回 432。 cURL: `curl https://api.bazaarlink.ai/v1/extract -H "Authorization: Bearer $BAZAARLINK_API_KEY" -H "Content-Type: application/json" -d '{"urls":["https://example.com/article"]}'` Python: `TavilyClient(api_key=..., api_base_url="https://api.bazaarlink.ai/v1").extract(urls=[...])` JavaScript: `tavily({ apiKey, apiBaseURL })` LangChain: `TavilyExtract(api_base_url=...)`
/v1/extract验证
Authorization必填在 Authorization 标头以 Bearer token 传入 API 密钥。
Body
urls必填要提取的 URL。可传单个字符串,或包含 1–20 个 URL 的数组。空数组或没有有效 URL 时返回 400。
["https://example.com/article"]query用于重新排列提取内容块的用户意图。
"key findings"chunks_per_source每个来源返回的相关内容块数量上限。必须为 1–5,且仅在提供 query 时可用。
3extract_depth提取深度。advanced 可提取表格和嵌入内容,但延迟可能更高;basic 每 5 个成功 URL 收取 1 credit,advanced 收取 2 credits。
basicadvanced"basic"include_images是否在每个成功结果中包含提取到的图片 URL。
trueinclude_favicon是否在每个成功结果中包含 favicon URL。
trueformat提取内容的格式。markdown 保留 Markdown 结构,text 返回纯文本。
markdowntext"markdown"timeout等待提取完成的最长秒数,范围为 1–60。未指定时,basic 默认 10 秒,advanced 默认 30 秒。
30include_usage是否在响应中包含 credits 和 usage.cost。
true