Crawler.
URLs pushen, Daten pullen, async im großen Maßstab.
Pushen Sie Millionen von URLs in eine verwaltete Push/Pull-Queue auf Basis der Crawling API und empfangen Sie die gerenderten Daten auf Ihrem Webhook oder im Cloud Storage.
Keine Queues, Retries oder Proxys zu betreiben.
Eine URL pushen. Ausgeliefert bekommen.
Der Crawler, live getippt. Pushen Sie eine URL in die Queue und empfangen Sie das gerenderte Ergebnis auf Ihrem Webhook. Fahren Sie mit der Maus darüber, um anzuhalten und mitzulesen.
Crawling im großen Maßstab, Queues inklusive.
Alles, was große Crawls schwierig macht, für Sie erledigt: eine async Queue, Retries, Auslieferung und Monitoring, alles auf Basis der Crawling API.
Asynchrones Push und Pull
Pushen Sie so viele URLs, wie Sie möchten, und machen Sie weiter. Crawlbase reiht sie in die Queue ein, plant und rendert sie im Hintergrund, sodass Ihr Client nie blockiert.
Auf Basis der Crawling API
Jede Funktion der Crawling API bleibt erhalten: JavaScript-Rendering, Residential Proxys, Geotargeting, Parameter und Anti-Bot-Handling bei jedem Request.
Webhook-Auslieferung
Richten Sie den Crawler auf Ihren Endpoint aus, und jedes Ergebnis wird an ihn gepostet. Crawlbase überwacht Ihren Webhook, damit die Auslieferung präzise und zuverlässig bleibt.
Cloud Storage
Lieber pullen? Behalten Sie jede gecrawlte Seite im Crawlbase Cloud Storage und rufen Sie sie nach Ihrem eigenen Zeitplan ab. Cloud Storage ansehen.
Individuelle Crawler, Live-Statistiken
Benennen Sie einen Crawler pro Workload und beobachten Sie ihn in Echtzeit. Prüfen Sie Statistiken über die API und pausieren oder setzen Sie fort, passend zu Ihrem Budget.
Frische Daten, weniger Retries
Jede Seite wird live gecrawlt, nichts wird gecacht. Das Push/Pull-System bringt die Erfolgsraten nahe an 100%, sodass clientseitige Retries so gut wie verschwinden.
Migrieren Sie mit zwei zusätzlichen Parametern.
Behalten Sie Ihre Crawling-API-Calls. Fügen Sie einen Callback und einen Crawler-Namen hinzu, und Sie sind async.
Einen Crawler erstellen
Öffnen Sie das Crawler-Dashboard, erstellen Sie einen benannten Crawler und richten Sie ihn auf Ihren Webhook oder Cloud Storage aus.
Die URLs pushen
Rufen Sie die Crawling API mit callback=true und crawler=YourCrawlerName auf, für eine URL oder Millionen.
Wir reihen ein und rendern
Crawlbase plant jeden Request, rotiert einen Residential Proxy, rendert die Seite und wiederholt fehlgeschlagene Versuche.
Das Ergebnis ausliefern
Jede gerenderte Seite wird an Ihren Webhook gepostet oder in Cloud Storage geschrieben, als HTML oder strukturiertes JSON.
Pullen und überwachen
Pullen Sie aus dem Storage, wenn bereit, und verfolgen Sie jeden Crawler live, mit Pause und Fortsetzen auf Abruf.
Was Teams mit dem Crawler bauen.
Millionen von Seiten
Pushen Sie ganze Kataloge oder Sitemaps und lassen Sie die Queue sie abarbeiten, ganz ohne clientseitige Planung.
Daten in Ihren Stack
Liefern Sie gerenderte Seiten direkt an einen Webhook oder Storage, bereit für Ihr Warehouse, Ihren Index oder Ihr Modell.
Kontinuierliches Monitoring
Crawlen Sie Preise, Bestände und Listings nach Zeitplan neu, mit frischen Daten bei jedem Durchlauf.
Trainings- und RAG-Korpora
Bauen Sie große, saubere Seitensets für Training und Retrieval auf, aus dem Storage im großen Umfang gepullt.
Weg vom eigenen Crawler
Tauschen Sie Ihr Push/Pull-System gegen unseres mit zwei Parametern und lassen Sie Proxys, Queues und Retries fallen.
Millionen von Websites
Crawlen Sie über Millionen unterstützter Websites mit einem Crawler und einem Token.
Fügen Sie die Websites hinzu, die Sie crawlen, und sehen Sie den Preis.
Fügen Sie die Websites hinzu, die Sie crawlen, mit ihrem monatlichen Volumen und Request-Typ. Wir gruppieren sie nach Schwierigkeit und Typ und berechnen jede Gruppe nach ihrem kombinierten Volumen, sodass es günstiger wird, je mehr Sie crawlen.
Noch keine Websites. Fügen Sie oben eine hinzu, um Ihre Schätzung zu starten.
Bis zu 20,000 Requests kostenlos. Keine Kreditkarte.
Kostenlos startenCrawlen Sie über 1B pro Monat? Sprechen Sie mit uns →Gut zu wissen.
Kostenlos testen
Bis zu 20,000 Requests sind kostenlos, ohne Kreditkarte. Derselbe Token funktioniert über den Crawler, die Crawling API und jeden Scraper.
Nutzungsbasierte Preise
Zahlen Sie für das, was Sie crawlen, keine langfristigen Verträge, jederzeit kündbar. Pausieren und fortsetzen, passend zu Ihrem Budget. Sehen Sie die vollständige Aufschlüsselung auf der Preisseite.
Vollständig dokumentiert
Das Erstellen von Crawlern, Callbacks und die Auslieferung werden alle in den Crawler-Docs behandelt, mit Copy-Paste-Beispielen.
GDPR- und CCPA-konform
Crawlbase wendet Verbraucherschutzstandards weltweit an, mit Fairness und Transparenz, die in den Umgang mit Daten eingebaut sind.
Gebaut, um das Web im großen Maßstab zu crawlen.
Der Crawler läuft auf demselben Netzwerk, das 70,000+ Entwickler und die anspruchsvollsten Crawling-Workloads der Welt bedient. Keine Queues zu betreiben, keine Proxys zu kaufen, nichts zu patchen, wenn sich eine Website ändert.
Ein Token über den Crawler, die Crawling API und jeden Scraper, mit Auslieferung an Ihren Webhook oder Storage.
Fragen zum Crawler.
Crawlen Sie das Web asynchron.
URLs pushen, wir liefern die Daten.
Kostenlos beginnen mit bis zu 20,000 Requests. Ein Token für den Crawler, die Crawling API und jeden Scraper.