Web-Scraping-API

Extrahieren Sie JavaScript-gerendertes HTML mit einem echten Headless-Browser. Sync- und Async-Endpunkte mit flexiblen Render-Optionen, Ressourcenblockierung und SSRF-Schutz.

API-Endpunkt
GET https://scrape.cleariflow.com/v1/scrape/?api_key=YOUR_API_KEY

Jetzt testen

API mit Live-Daten prüfen

Inspiration? Probieren Sie:

API-Vorteile

JavaScript-Rendering

Echter Headless-Browser führt JavaScript aus und liefert vollständig gerendertes HTML.

Flexible Render-Optionen

wait_until, Timeouts, Verzögerungen nach dem Laden und HTTPS-Fehlerbehandlung.

Sync- und Async-Endpunkte

Synchroner Scrape für niedrige Latenz oder Async-Jobs für langsame Seiten.

Ressourcenblockierung

Bilder, Schriften und Medien blockieren für schnellere Scrapes.

SSRF-Schutz

Eingebaute Prüfungen blockieren private Netzwerke und unsichere URLs.

Bank-Level-Sicherheit

Der gesamte API-Verkehr ist per TLS (HTTPS) verschlüsselt.

Hauptfunktionen

  • Rendering im Headless-Browser
  • Vollständige JavaScript-Ausführung vor dem Capture
  • Synchroner POST /v1/scrape
  • Asynchrone Job-Warteschlange mit Polling
  • Konfigurierbares wait_until (domcontentloaded, networkidle)
  • Bilder, Schriften und Medien blockieren
  • SSRF-sichere URL-Validierung
  • Optionale Verzögerung nach dem Laden
  • JSON-Antwort mit HTML und Metadaten
  • Konfigurierbares Timeout bis 60 s
  • TLS-verschlüsselter API-Zugriff
  • Render- und Ressourcenoptionen pro Anfrage

Schnellstart

1. API-Key holen

Kostenlos registrieren und sofort den Key erhalten.

2. Erste Anfrage

cURL
curl -X POST "https://scrape.cleariflow.com/v1/scrape" \
  -H 'Content-Type: application/json' \
  -d '{
    "api_key": "YOUR_API_KEY",
    "url": "https://quotes.toscrape.com/"
  }'

3. Antwort verarbeiten

JSON
{
  "html": "\u003c!DOCTYPE html\u003e\u003chtml\u003e\u003chead\u003e\u003ctitle\u003eQuotes to Scrape\u003c/title\u003e\u003c/head\u003e\u003cbody\u003e...\u003c/body\u003e\u003c/html\u003e",
  "meta": {
    "elapsed_ms": 4521
  },
  "ok": true
}