BazaarLinkBazaarLink
เข้าสู่ระบบ
เอกสารAPI ข้อมูลอ้างอิงSDK ข้อมูลอ้างอิงการใช้งาน AgentAI ทักษะ
การค้นหาเว็บ

ดึงเนื้อหาเว็บ

ดึงเนื้อหาเว็บดิบจาก URL เดียวหรือชุดที่มีไม่เกิน 20 URL URL ที่สำเร็จจะอยู่ใน results และความล้มเหลวของแต่ละ URL จะอยู่ใน failed_results แม้ HTTP 200 จะมีอาร์เรย์ results ว่าง ก็ต้องตรวจสอบทั้งสองอาร์เรย์ ลำดับผลลัพธ์ไม่รับประกัน รองรับการจัดอันดับใหม่ด้วย query, 1–5 chunks ต่อแหล่งที่มา (ใช้ได้เมื่อมี query เท่านั้น), การดึงแบบ basic หรือ advanced, รูปภาพ, favicon, รูปแบบ markdown หรือ text และ timeout 1–60 วินาที ระบบจะละเว้นฟิลด์คำขอที่ไม่รู้จัก ใช้ Authorization: Bearer <key> หรือส่ง api_key ใน JSON body เป็น fallback ที่เข้ากันได้กับ Tavily รองรับ base URL ของ BazaarLink ทั้ง https://api.bazaarlink.ai/v1 และ https://bazaarlink.ai/api/v1 ทุกการดึง URL สำเร็จ 5 รายการใช้ 1 credit สำหรับ basic หรือ 2 credits สำหรับ advanced ส่วน URL ที่ล้มเหลวไม่คิดค่าใช้จ่าย ราคาลูกค้าคือจำนวน credits คูณราคาต่อ credit ที่ผู้ดูแลระบบตั้งไว้ ให้ดู BazaarLink pricing page และใช้ค่า usage.cost จาก response โควต้าฟรีใช้ credits รายวันร่วมกับ search เมื่อโควต้าฟรีหมดและไม่มีเงินคงเหลือ response จะเป็น 432 cURL: `curl https://api.bazaarlink.ai/v1/extract -H "Authorization: Bearer $BAZAARLINK_API_KEY" -H "Content-Type: application/json" -d '{"urls":["https://example.com/article"]}'` Python: `TavilyClient(api_key=..., api_base_url="https://api.bazaarlink.ai/v1").extract(urls=[...])` JavaScript: `tavily({ apiKey, apiBaseURL })` LangChain: `TavilyExtract(api_base_url=...)`

POST/v1/extract

การอนุญาต

Authorizationจำเป็น
string · header

API key เป็น bearer token ใน header Authorization

Body

urlsจำเป็น
string | string[]

URL ที่ต้องการดึงเนื้อหา ส่งเป็นสตริงเดียวหรืออาร์เรย์ที่มี 1–20 URL อาร์เรย์ว่างหรือไม่มี URL ที่ถูกต้องจะคืนค่า 400

string or array of 1–20 URLs
Example: ["https://example.com/article"]
query
string

เจตนาของผู้ใช้สำหรับจัดอันดับ chunks ของเนื้อหาที่ดึงมาใหม่

Example: "key findings"
chunks_per_source
integer

จำนวน chunks ของเนื้อหาที่เกี่ยวข้องสูงสุดต่อแหล่งที่มา ต้องอยู่ระหว่าง 1–5 และใช้ได้เมื่อมี query เท่านั้น

1–5; only with query
Example: 3
extract_depth
string

ระดับการดึงเนื้อหา advanced อาจดึงตารางและเนื้อหาที่ฝังอยู่ได้แต่มีความหน่วงสูงกว่า basic ใช้ 1 credit ต่อ URL ที่สำเร็จ 5 รายการ และ advanced ใช้ 2 credits

default: basic
basicadvanced
Example: "basic"
include_images
boolean

ว่าจะรวม URL ของรูปภาพที่ดึงจากแต่ละหน้าที่สำเร็จหรือไม่

default: false
Example: true
include_favicon
boolean

ว่าจะรวม URL ของ favicon ในผลลัพธ์ที่สำเร็จแต่ละรายการหรือไม่

default: false
Example: true
format
string

รูปแบบของเนื้อหาที่ดึงมา markdown จะรักษาโครงสร้าง Markdown ส่วน text จะคืนค่าเป็นข้อความธรรมดา

default: markdown
markdowntext
Example: "markdown"
timeout
number

จำนวนวินาทีสูงสุดที่รอการดึงเนื้อหา อยู่ระหว่าง 1–60 หากไม่ระบุ ค่าเริ่มต้นคือ 10 วินาทีสำหรับ basic และ 30 วินาทีสำหรับ advanced

1–60 seconds; default depends on extract_depth
Example: 30
include_usage
boolean

ว่าจะรวม credits และ usage.cost ใน response หรือไม่

default: false
Example: true
POST /v1/extract
curl https://api.bazaarlink.ai/v1/extract \
  -H "Authorization: Bearer $BAZAARLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "urls": ["https://example.com/article", "https://example.org/docs"],
    "query": "key findings",
    "chunks_per_source": 3,
    "extract_depth": "basic",
    "include_images": true,
    "include_favicon": true,
    "format": "markdown",
    "timeout": 30,
    "include_usage": true
  }'
ตัวอย่างการตอบกลับ

ดึงเนื้อหาเสร็จแล้ว ตรวจสอบ results สำหรับรายการที่สำเร็จและ failed_results สำหรับความล้มเหลวของแต่ละ URL ต้องตรวจสอบทั้งสองรายการ เพราะ HTTP 200 อาจมีอาร์เรย์ results ว่าง และลำดับผลลัพธ์ไม่รับประกัน usage.credits คือการใช้ credits usage.cost คือราคาที่ BazaarLink เรียกเก็บจากลูกค้าเป็น USD ไม่ใช่ต้นทุน upstream ส่วน request_id คือ ID คำขอที่ BazaarLink สร้าง

{
  "results": [
    {
      "url": "https://example.com/article",
      "raw_content": "Article content extracted as Markdown.",
      "images": [
        "https://example.com/image.jpg"
      ],
      "favicon": "https://example.com/favicon.ico"
    }
  ],
  "failed_results": [
    {
      "url": "https://example.org/unavailable",
      "error": "Failed to retrieve content"
    }
  ],
  "response_time": 0.42,
  "usage": {
    "credits": 1,
    "cost": 0
  },
  "request_id": "bl-extract-example-request"
}
Support
Support
Hi! How can we help you?
Send a message and we'll get back to you soon.