Webinhalte extrahieren
Extrahiert rohe Webinhalte aus einer URL oder aus einer Gruppe von bis zu 20 URLs. Erfolgreiche URLs stehen in results, Fehler pro URL in failed_results; auch bei HTTP 200 mit einem leeren results-Array müssen beide Arrays geprüft werden. Die Ausgabereihenfolge ist nicht garantiert. Unterstützt werden query-Reranking, 1–5 Chunks pro Quelle (nur mit query), basic- oder advanced-Extraktion, Bilder, Favicons, das Format markdown oder text sowie ein Timeout von 1–60 Sekunden. Unbekannte Anfragefelder werden ignoriert. Verwenden Sie Authorization: Bearer <key> oder als Tavily-kompatiblen Fallback api_key im JSON-Body. Beide BazaarLink-Base-URLs werden unterstützt: https://api.bazaarlink.ai/v1 und https://bazaarlink.ai/api/v1. Je 5 erfolgreiche URL-Extraktionen kosten basic 1 Credit oder advanced 2 Credits; fehlgeschlagene URLs sind kostenlos. Der Kundenpreis ergibt sich aus Credits multipliziert mit dem vom Administrator festgelegten Preis pro Credit. Maßgeblich sind die BazaarLink pricing page und usage.cost in der Antwort. Das kostenlose Kontingent teilt sich die täglichen Credits mit search; ist es ohne Guthaben aufgebraucht, wird 432 zurückgegeben. cURL: `curl https://api.bazaarlink.ai/v1/extract -H "Authorization: Bearer $BAZAARLINK_API_KEY" -H "Content-Type: application/json" -d '{"urls":["https://example.com/article"]}'` Python: `TavilyClient(api_key=..., api_base_url="https://api.bazaarlink.ai/v1").extract(urls=[...])` JavaScript: `tavily({ apiKey, apiBaseURL })` LangChain: `TavilyExtract(api_base_url=...)`
/v1/extractAutorisierung
AuthorizationerforderlichAPI-Schlüssel als Bearer-Token im Authorization-Header.
Body
urlserforderlichDie zu extrahierenden URLs. Übergeben Sie einen einzelnen String oder ein Array mit 1–20 URLs. Ein leeres Array oder keine gültige URL liefert 400.
["https://example.com/article"]queryDie Benutzerabsicht zum erneuten Rangordnen extrahierter Inhalts-Chunks.
"key findings"chunks_per_sourceMaximale Anzahl relevanter Inhalts-Chunks pro Quelle. Muss 1–5 sein und ist nur mit query verfügbar.
3extract_depthExtraktionstiefe. advanced kann Tabellen und eingebettete Inhalte mit höherer Latenz abrufen; basic kostet je 5 erfolgreiche URLs 1 Credit, advanced 2 Credits.
basicadvanced"basic"include_imagesGibt an, ob aus jeder erfolgreichen Seite extrahierte Bild-URLs enthalten sein sollen.
trueinclude_faviconGibt an, ob die Favicon-URL in jedem erfolgreichen Ergebnis enthalten sein soll.
trueformatFormat der extrahierten Inhalte. markdown bewahrt die Markdown-Struktur, text liefert reinen Text.
markdowntext"markdown"timeoutMaximale Wartezeit für die Extraktion in Sekunden, 1–60. Ohne Angabe sind es 10 Sekunden für basic und 30 Sekunden für advanced.
30include_usageGibt an, ob Credits und usage.cost in der Antwort enthalten sein sollen.
true