ウェブページをクロール
ルート URL からウェブサイトのリンクグラフを探索し、成功したページの内容を抽出します。Bearer API キー、または互換性のため JSON body の api_key を使えます。https://api.bazaarlink.ai/v1 と https://bazaarlink.ai/api/v1 の両方に対応します。未知のフィールドは無視されます。レスポンスには成功したページ、response_time、usage.credits、管理者設定の credit 単価を掛けた追加フィールド usage.cost、request_id が含まれます。Tavily の timeout は 10~150 秒ですが、BazaarLink の有効上限は 90 秒です。90 を超える値は 90 に下げ、100 秒のエッジ制限未満に保ちます。 料金は mapping コストと extraction コストの合計です。basic の成功ページ 10 件は 1 + 2 = 3 credits、advanced extraction は extraction 部分を、instructions は mapping 部分を 2 倍にします。失敗ページは無料です。実際の credits は共通の日次無料枠から引かれます。limit からの見積りが残りを超える場合、超過分は残高から請求され、残高がなければ 432 を返して limit を下げるよう案内します。 SDK の例です。キーは環境変数など安全なサーバー側設定に保存してください。 Python: from tavily import TavilyClient client = TavilyClient(api_key="...", api_base_url="https://api.bazaarlink.ai/v1") response = client.crawl("docs.tavily.com", instructions="Find Python SDK pages") JavaScript: import { tavily } from "@tavily/core" const tvly = tavily({ apiKey: process.env.BAZAARLINK_API_KEY, apiBaseURL: "https://api.bazaarlink.ai/v1" }) const response = await tvly.crawl("docs.tavily.com", { instructions: "Find Python SDK pages" }) LangChain (crawl only): from langchain_tavily import TavilyCrawl tool = TavilyCrawl(api_key="...", api_base_url="https://api.bazaarlink.ai/v1") response = tool.invoke({"url": "docs.tavily.com", "instructions": "Find Python SDK pages"})
/v1/crawl認証
Authorization必須Authorization ヘッダーに Bearer トークンとして API キーを渡します。
Body
url必須クロールを開始するルート URL。scheme は省略でき、例は docs.tavily.com です。
"docs.tavily.com"instructionsクロールへの自然言語指示。指定すると chunks_per_source が使え、成功ページ 10 件ごとの mapping 部分が 2 credits になります。
"Find Python SDK pages"chunks_per_sourceソースごとの短いコンテンツチャンク数。instructions 指定時のみ使用でき、1~5、既定値は 3 です。
3max_depthクロールの最大深度。1~5、既定値は 1 です。
1max_breadth各レベルで 1 ページあたりに追跡するリンク数。1~500、既定値 20 です。
20limit停止するまでに処理するリンクの総数。最小 1、既定値 50 です。
50select_pathsパス選択 用の正規表現配列です。最大 50 件、各パターンは 200 文字までです。
["^/docs/.*"]select_domainsドメイン選択 用の正規表現配列です。最大 50 件、各パターンは 200 文字までです。
["^docs\.example\.com$"]exclude_pathsパス除外 用の正規表現配列です。最大 50 件、各パターンは 200 文字までです。
["^/private/.*"]exclude_domainsドメイン除外 用の正規表現配列です。最大 50 件、各パターンは 200 文字までです。
["^private\.example\.com$"]allow_external外部ドメインのリンクを最終結果に含めるか。既定値は true です。
trueinclude_imagesページから抽出した画像を含めるか。既定値は false です。
falseextract_depth抽出の深度。advanced は表や埋め込みコンテンツを多く扱い、成功ページ 5 件ごとの抽出部分の credit を 2 倍にします。
basicadvanced"basic"format抽出ページの形式。markdown または text、既定値は markdown です。
markdowntext"markdown"include_favicon各結果に favicon URL を含めるか。既定値は false です。
falsetimeoutクロールを待つ秒数。Tavily は 10~150 ですが、BazaarLink の有効上限は 90 秒で、90 を超える値は 90 に下げられます。
90include_usageレスポンスに usage を含めるか。既定値は false で、含めると credits と usage.cost が表示されます。
false