WebスクレイピングAPI

ヘッドレスブラウザでJavaScriptレンダリング済みHTMLを取得。柔軟なレンダリングオプション、リソースブロック、SSRF保護付きの同期・非同期エンドポイント。

API エンドポイント
GET https://scrape.cleariflow.com/v1/scrape/?api_key=YOUR_API_KEY

今すぐ試す

ライブデータで API をテスト

例が必要?試してください:

API のメリット

JavaScriptレンダリング

ヘッドレスブラウザがJavaScriptを実行し、完全にレンダリングされたHTMLを返します。

柔軟なレンダリングオプション

wait_until、タイムアウト、読み込み後待機、HTTPSエラー処理を設定可能。

同期・非同期エンドポイント

低レイテンシ向け同期scrape、または遅いページ向け非同期ジョブ。

リソースブロック

画像・フォント・メディアをブロックして高速化と帯域削減。

SSRF保護

組み込みの安全策がプライベートネットワークや危険なURLをブロック。

銀行レベルのセキュリティ

すべてのAPI通信はTLS(HTTPS)で保護されます。

主な機能

  • ヘッドレスブラウザでのレンダリング
  • キャプチャ前の完全なJavaScript実行
  • 同期 POST /v1/scrape
  • ポーリング付き非同期ジョブキュー
  • 設定可能な wait_until(domcontentloaded, networkidle)
  • 画像・フォント・メディアのブロック
  • SSRF安全なURL検証
  • 読み込み後のオプション待機
  • HTMLとメタデータのJSONレスポンス
  • 最大60秒の設定可能タイムアウト
  • TLS暗号化APIアクセス
  • リクエストごとのrender/resourceオプション

クイックスタート

1. API キーを取得

無料登録ですぐにキーを取得。

2. 最初のリクエスト

cURL
curl -X POST "https://scrape.cleariflow.com/v1/scrape" \
  -H 'Content-Type: application/json' \
  -d '{
    "api_key": "YOUR_API_KEY",
    "url": "https://quotes.toscrape.com/"
  }'

3. 応答を処理

JSON
{
  "html": "\u003c!DOCTYPE html\u003e\u003chtml\u003e\u003chead\u003e\u003ctitle\u003eQuotes to Scrape\u003c/title\u003e\u003c/head\u003e\u003cbody\u003e...\u003c/body\u003e\u003c/html\u003e",
  "meta": {
    "elapsed_ms": 4521
  },
  "ok": true
}