รวบรวมข้อมูลหน้าเว็บ
สำรวจกราฟลิงก์ของเว็บไซต์จาก URL รากและดึงเนื้อหาจากหน้าที่สำเร็จ ใช้ Bearer API key หรือส่ง api_key ใน JSON body เป็นทางเลือกเพื่อความเข้ากันได้ รองรับทั้ง https://api.bazaarlink.ai/v1 และ https://bazaarlink.ai/api/v1 ระบบจะละเว้นฟิลด์ที่ไม่รู้จัก คำตอบมีหน้าที่สำเร็จ response_time usage.credits usage.cost ที่เราเพิ่ม (เครดิตคูณด้วยราคาต่อเครดิตที่ผู้ดูแลตั้งไว้) และ request_id Tavily รับ timeout 10–150 วินาที แต่ค่าสูงสุดที่มีผลของ BazaarLink คือ 90 วินาที ค่าที่เกิน 90 จะลดเป็น 90 เพื่อให้อยู่ต่ำกว่าขีดจำกัด edge 100 วินาที ค่าบริการคือค่า mapping บวกค่า extraction: basic ที่สำเร็จ 10 หน้าใช้ 1 + 2 = 3 credits; advanced extraction เพิ่มส่วน extraction เป็นสองเท่า และ instructions เพิ่มส่วน mapping เป็นสองเท่า หน้าที่ล้มเหลวไม่คิดค่าใช้จ่าย เครดิตจริงจะหักจากโควต้าฟรีรายวันที่ใช้ร่วมกัน หากค่าประเมินจาก limit เกินโควต้าที่เหลือ จะคิดส่วนเกินจากยอดคงเหลือ หรือคืน 432 เมื่อไม่มียอดพร้อมแนะนำให้ลด limit ตัวอย่าง SDK โปรดเก็บคีย์ไว้ในตัวแปรสภาพแวดล้อมหรือการตั้งค่าฝั่งเซิร์ฟเวอร์ที่ปลอดภัย Python: from tavily import TavilyClient client = TavilyClient(api_key="...", api_base_url="https://api.bazaarlink.ai/v1") response = client.crawl("docs.tavily.com", instructions="Find Python SDK pages") JavaScript: import { tavily } from "@tavily/core" const tvly = tavily({ apiKey: process.env.BAZAARLINK_API_KEY, apiBaseURL: "https://api.bazaarlink.ai/v1" }) const response = await tvly.crawl("docs.tavily.com", { instructions: "Find Python SDK pages" }) LangChain (crawl only): from langchain_tavily import TavilyCrawl tool = TavilyCrawl(api_key="...", api_base_url="https://api.bazaarlink.ai/v1") response = tool.invoke({"url": "docs.tavily.com", "instructions": "Find Python SDK pages"})
/v1/crawlการอนุญาต
Authorizationจำเป็นAPI key เป็น bearer token ใน header Authorization
Body
urlจำเป็นURL รากที่จะเริ่มรวบรวมข้อมูล สามารถละ scheme ได้ เช่น docs.tavily.com
"docs.tavily.com"instructionsคำสั่งภาษาธรรมชาติสำหรับการรวบรวมข้อมูล เมื่อระบุแล้วจะใช้ chunks_per_source ได้ และส่วน mapping คิด 2 credits ต่อ 10 หน้าที่สำเร็จ
"Find Python SDK pages"chunks_per_sourceจำนวนชิ้นเนื้อหาสั้นสูงสุดต่อแหล่งที่มา ใช้ได้เมื่อมี instructions เท่านั้น อยู่ระหว่าง 1–5 ค่าเริ่มต้น 3
3max_depthความลึกสูงสุดของการรวบรวมข้อมูล 1–5 ค่าเริ่มต้น 1
1max_breadthจำนวนลิงก์สูงสุดที่ติดตามต่อหน้าในแต่ละระดับ 1–500 ค่าเริ่มต้น 20
20limitจำนวนลิงก์รวมที่จะประมวลผลก่อนหยุด ขั้นต่ำ 1 ค่าเริ่มต้น 50
50select_pathsอาร์เรย์รูปแบบ regex สำหรับ การเลือกเส้นทาง สูงสุด 50 รายการ และแต่ละรูปแบบยาวไม่เกิน 200 อักขระ
["^/docs/.*"]select_domainsอาร์เรย์รูปแบบ regex สำหรับ การเลือกโดเมน สูงสุด 50 รายการ และแต่ละรูปแบบยาวไม่เกิน 200 อักขระ
["^docs\.example\.com$"]exclude_pathsอาร์เรย์รูปแบบ regex สำหรับ การยกเว้นเส้นทาง สูงสุด 50 รายการ และแต่ละรูปแบบยาวไม่เกิน 200 อักขระ
["^/private/.*"]exclude_domainsอาร์เรย์รูปแบบ regex สำหรับ การยกเว้นโดเมน สูงสุด 50 รายการ และแต่ละรูปแบบยาวไม่เกิน 200 อักขระ
["^private\.example\.com$"]allow_externalกำหนดว่าจะรวมลิงก์จากโดเมนภายนอกในผลลัพธ์สุดท้ายหรือไม่ ค่าเริ่มต้น true
trueinclude_imagesกำหนดว่าจะรวมรูปภาพที่ดึงจากหน้าหรือไม่ ค่าเริ่มต้น false
falseextract_depthระดับการดึงข้อมูล advanced รองรับตารางและเนื้อหาฝังตัวมากขึ้น และเพิ่มส่วนเครดิต extraction เป็นสองเท่าต่อ 5 หน้าที่สำเร็จ
basicadvanced"basic"formatรูปแบบเนื้อหาหน้าที่ดึงออกมา markdown หรือข้อความธรรมดา ค่าเริ่มต้น markdown
markdowntext"markdown"include_faviconกำหนดว่าจะรวม URL favicon ในแต่ละผลลัพธ์หรือไม่ ค่าเริ่มต้น false
falsetimeoutจำนวนวินาทีที่จะรอการรวบรวมข้อมูล Tavily อยู่ที่ 10–150 แต่ค่าสูงสุดที่มีผลของ BazaarLink คือ 90 วินาที ค่าที่เกิน 90 จะลดเป็น 90
90include_usageกำหนดว่าจะรวม usage ในคำตอบหรือไม่ ค่าเริ่มต้น false หากรวมจะแสดง credits และ usage.cost
false