BazaarLinkBazaarLink
ログイン
ドキュメントAPIリファレンスSDKリファレンスエージェント利用AIスキル
ウェブ検索

ウェブコンテンツを抽出

1つのURL、または1回のリクエストで最大20個のURLから生のウェブコンテンツを抽出します。成功したURLは results に、URLごとの失敗は failed_results に入ります。HTTP 200 でも results が空になることがあるため、必ず両方の配列を確認してください。出力順序は保証されません。query による再ランキング、ソースごとの1~5チャンク(query 指定時のみ)、basic/advanced 抽出、画像、favicon、markdown/text 形式、1~60秒の timeout に対応します。不明なリクエストフィールドは無視されます。 Authorization: Bearer <key> を使うか、Tavily互換のフォールバックとしてJSON bodyに api_key を指定します。対応するBazaarLinkのbase URLは https://api.bazaarlink.ai/v1 と https://bazaarlink.ai/api/v1 です。成功したURLが5件増えるごとに、basic は1 credit、advanced は2 creditsです。失敗URLは無料です。顧客価格は credits と管理者が設定した1 creditあたりの価格の積です。BazaarLinkのpricing pageを確認し、レスポンスの usage.cost を基準にしてください。無料枠はsearchと同じ日次creditsを共有し、無料枠を使い切って残高がない場合は432を返します。 cURL: `curl https://api.bazaarlink.ai/v1/extract -H "Authorization: Bearer $BAZAARLINK_API_KEY" -H "Content-Type: application/json" -d '{"urls":["https://example.com/article"]}'` Python: `TavilyClient(api_key=..., api_base_url="https://api.bazaarlink.ai/v1").extract(urls=[...])` JavaScript: `tavily({ apiKey, apiBaseURL })` LangChain: `TavilyExtract(api_base_url=...)`

POST/v1/extract

認証

Authorization必須
string · header

Authorization ヘッダーに Bearer トークンとして API キーを渡します。

Body

urls必須
string | string[]

抽出対象のURL。単一の文字列、または1~20個のURLを含む配列を指定します。空の配列や有効なURLがない場合は400を返します。

string or array of 1–20 URLs
Example: ["https://example.com/article"]
query
string

抽出したコンテンツチャンクを再ランキングするユーザーの意図。

Example: "key findings"
chunks_per_source
integer

ソースごとに返す関連コンテンツチャンクの最大数。1~5で、query指定時のみ利用できます。

1–5; only with query
Example: 3
extract_depth
string

抽出の深度。advancedは表や埋め込みコンテンツも取得でき、遅延が増える場合があります。basicは成功URL 5件ごとに1 credit、advancedは2 creditsです。

default: basic
basicadvanced
Example: "basic"
include_images
boolean

各成功ページから抽出した画像URLを含めるかどうか。

default: false
Example: true
include_favicon
boolean

各成功結果にfavicon URLを含めるかどうか。

default: false
Example: true
format
string

抽出コンテンツの形式。markdownはMarkdown構造を保持し、textはプレーンテキストを返します。

default: markdown
markdowntext
Example: "markdown"
timeout
number

抽出を待つ最大秒数(1~60)。省略時はbasicが10秒、advancedが30秒です。

1–60 seconds; default depends on extract_depth
Example: 30
include_usage
boolean

レスポンスにcreditsとusage.costを含めるかどうか。

default: false
Example: true
POST /v1/extract
curl https://api.bazaarlink.ai/v1/extract \
  -H "Authorization: Bearer $BAZAARLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "urls": ["https://example.com/article", "https://example.org/docs"],
    "query": "key findings",
    "chunks_per_source": 3,
    "extract_depth": "basic",
    "include_images": true,
    "include_favicon": true,
    "format": "markdown",
    "timeout": 30,
    "include_usage": true
  }'
レスポンス例

抽出が完了しました。成功項目は results、URLごとの失敗は failed_results に入るため、両方を確認してください。HTTP 200でもresultsが空になる場合があり、出力順序は保証されません。usage.creditsはcredits使用量、usage.costは上流コストではなくBazaarLinkが顧客に請求するUSD価格、request_idはBazaarLinkが生成したリクエストIDです。

{
  "results": [
    {
      "url": "https://example.com/article",
      "raw_content": "Article content extracted as Markdown.",
      "images": [
        "https://example.com/image.jpg"
      ],
      "favicon": "https://example.com/favicon.ico"
    }
  ],
  "failed_results": [
    {
      "url": "https://example.org/unavailable",
      "error": "Failed to retrieve content"
    }
  ],
  "response_time": 0.42,
  "usage": {
    "credits": 1,
    "cost": 0
  },
  "request_id": "bl-extract-example-request"
}
サポート
サポート
こんにちは。どのようなご用件でしょうか?
メッセージをお送りください。担当者より返信します。