ดึงเนื้อหาเว็บ
ดึงเนื้อหาเว็บดิบจาก URL เดียวหรือชุดที่มีไม่เกิน 20 URL URL ที่สำเร็จจะอยู่ใน results และความล้มเหลวของแต่ละ URL จะอยู่ใน failed_results แม้ HTTP 200 จะมีอาร์เรย์ results ว่าง ก็ต้องตรวจสอบทั้งสองอาร์เรย์ ลำดับผลลัพธ์ไม่รับประกัน รองรับการจัดอันดับใหม่ด้วย query, 1–5 chunks ต่อแหล่งที่มา (ใช้ได้เมื่อมี query เท่านั้น), การดึงแบบ basic หรือ advanced, รูปภาพ, favicon, รูปแบบ markdown หรือ text และ timeout 1–60 วินาที ระบบจะละเว้นฟิลด์คำขอที่ไม่รู้จัก ใช้ Authorization: Bearer <key> หรือส่ง api_key ใน JSON body เป็น fallback ที่เข้ากันได้กับ Tavily รองรับ base URL ของ BazaarLink ทั้ง https://api.bazaarlink.ai/v1 และ https://bazaarlink.ai/api/v1 ทุกการดึง URL สำเร็จ 5 รายการใช้ 1 credit สำหรับ basic หรือ 2 credits สำหรับ advanced ส่วน URL ที่ล้มเหลวไม่คิดค่าใช้จ่าย ราคาลูกค้าคือจำนวน credits คูณราคาต่อ credit ที่ผู้ดูแลระบบตั้งไว้ ให้ดู BazaarLink pricing page และใช้ค่า usage.cost จาก response โควต้าฟรีใช้ credits รายวันร่วมกับ search เมื่อโควต้าฟรีหมดและไม่มีเงินคงเหลือ response จะเป็น 432 cURL: `curl https://api.bazaarlink.ai/v1/extract -H "Authorization: Bearer $BAZAARLINK_API_KEY" -H "Content-Type: application/json" -d '{"urls":["https://example.com/article"]}'` Python: `TavilyClient(api_key=..., api_base_url="https://api.bazaarlink.ai/v1").extract(urls=[...])` JavaScript: `tavily({ apiKey, apiBaseURL })` LangChain: `TavilyExtract(api_base_url=...)`
/v1/extractการอนุญาต
Authorizationจำเป็นAPI key เป็น bearer token ใน header Authorization
Body
urlsจำเป็นURL ที่ต้องการดึงเนื้อหา ส่งเป็นสตริงเดียวหรืออาร์เรย์ที่มี 1–20 URL อาร์เรย์ว่างหรือไม่มี URL ที่ถูกต้องจะคืนค่า 400
["https://example.com/article"]queryเจตนาของผู้ใช้สำหรับจัดอันดับ chunks ของเนื้อหาที่ดึงมาใหม่
"key findings"chunks_per_sourceจำนวน chunks ของเนื้อหาที่เกี่ยวข้องสูงสุดต่อแหล่งที่มา ต้องอยู่ระหว่าง 1–5 และใช้ได้เมื่อมี query เท่านั้น
3extract_depthระดับการดึงเนื้อหา advanced อาจดึงตารางและเนื้อหาที่ฝังอยู่ได้แต่มีความหน่วงสูงกว่า basic ใช้ 1 credit ต่อ URL ที่สำเร็จ 5 รายการ และ advanced ใช้ 2 credits
basicadvanced"basic"include_imagesว่าจะรวม URL ของรูปภาพที่ดึงจากแต่ละหน้าที่สำเร็จหรือไม่
trueinclude_faviconว่าจะรวม URL ของ favicon ในผลลัพธ์ที่สำเร็จแต่ละรายการหรือไม่
trueformatรูปแบบของเนื้อหาที่ดึงมา markdown จะรักษาโครงสร้าง Markdown ส่วน text จะคืนค่าเป็นข้อความธรรมดา
markdowntext"markdown"timeoutจำนวนวินาทีสูงสุดที่รอการดึงเนื้อหา อยู่ระหว่าง 1–60 หากไม่ระบุ ค่าเริ่มต้นคือ 10 วินาทีสำหรับ basic และ 30 วินาทีสำหรับ advanced
30include_usageว่าจะรวม credits และ usage.cost ใน response หรือไม่
true