Cloud Storage.
Jeder Crawl behalten, keiner erneut geholt.
Fügen Sie store=true zu jedem Crawl hinzu und Crawlbase behält die gerenderte Seite, JSON und Screenshots in der Cloud.
Rufen Sie per RID ab, führen Sie eine Volltextsuche aus und sparen Sie sich die Datenbank, den S3-Bucket und die Backups.
Speichern mit einem Flag. Abrufen per RID.
Cloud Storage, live getippt. Speichern Sie einen Crawl mit einem Parameter und rufen Sie ihn später per RID ab. Fahren Sie mit der Maus darüber, um anzuhalten und mitzulesen.
Ein Store, gebaut für Crawls.
Behalten, finden und ziehen Sie Ihre gecrawlten Daten, ohne eigenen Storage aufzusetzen.
Speichern mit einem Flag
Fügen Sie store=true zu jedem Crawling-API-Aufruf hinzu, oder richten Sie einen Crawler auf Cloud Storage, und die gerenderte Seite wird automatisch behalten.
Abrufen per RID
Jeder gespeicherte Crawl erhält eine RID. Senden Sie einen GET-Request damit und die Seite kommt direkt zurück, ohne erneuten Crawl.
Volltextsuche
Durchsuchen Sie alles, was Sie gecrawlt haben, um die exakten Seiten zu finden, die Sie brauchen, statt Ihre eigene Datenbank zu durchsuchen.
Seiten und Screenshots
Behalten Sie gerendertes HTML, strukturiertes JSON und Full-Page-Screenshots zusammen, alles abrufbar über dieselbe RID.
Skalierung erledigt
Crawlbase verwaltet Skalierung, Backups und Bereinigung Ihres Speichers, sodass Sie den S3-Bucket und die Wartung aufgeben können.
Crawler-Webhook-Ziel
Nutzen Sie Storage als Auslieferungsziel für den asynchronen Crawler, sodass große Crawls abrufbereit ankommen.
Ein Flag zum Speichern, ein Aufruf zum Abrufen.
Behalten Sie Ihren Crawl, wie er ist. Fügen Sie einen Parameter zum Speichern hinzu und einen GET zum Abrufen.
store=true hinzufügen
Crawlen Sie jede URL mit store=true, oder legen Sie Cloud Storage als Ihr Crawler-Webhook-Ziel fest.
Wir speichern und indexieren
Die gerenderte Seite, JSON und Screenshot werden gespeichert und für die Volltextsuche indexiert, mit erledigter Skalierung.
RID speichern
Die Response gibt eine Storage-RID zurück, die die soeben behaltene Seite eindeutig identifiziert.
Abrufen oder suchen
Senden Sie einen GET an den Storage-Endpoint mit der RID, durchsuchen Sie Ihre Crawls oder ziehen Sie sie aus dem Dashboard.
Was Teams in Cloud Storage behalten.
Ein Puffer für Ihren Stack
Lassen Sie gecrawlte Seiten im Storage landen und ziehen Sie sie nach Ihrem eigenen Zeitplan in Ihr Warehouse, Ihren Index oder Ihr Modell.
Snapshots über die Zeit
Behalten Sie jeden Crawl, um eine Seite über verschiedene Zeitpunkte hinweg zu vergleichen, ohne sie erneut zu crawlen.
Über Ihre Crawls hinweg finden
Führen Sie eine Volltextsuche über alles Gespeicherte aus, um die exakten Seiten und Felder zu finden, die Sie brauchen.
Eigenen Storage aufgeben
Lassen Sie den S3-Bucket und die Datenbank weg. Storage skaliert, sichert und bereinigt sich für Sie selbst.
Korpora für Training und RAG
Bauen und ziehen Sie große, saubere Seitensets für Training und Retrieval direkt aus dem Storage.
Crawler-Auslieferung
Kombinieren Sie Storage mit dem Crawler, sodass umfangreiche asynchrone Crawls abrufbereit ankommen.
Kostenlos starten, günstig skalieren.
Cloud Storage ist kostenlos für Entwickler und günstig für Unternehmen. Sie zahlen für das Crawl-Volumen, nicht für eine Datenbank, die Sie betreiben müssen.
- 10k Requests
- 14 Tage Aufbewahrung
- Get API
- Delete API
- Bulk API
- 100k Requests
- 30 Tage Aufbewahrung
- Get API
- Delete API
- Bulk API
- 1M Requests
- 30 Tage Aufbewahrung
- Get API
- Delete API
- Bulk API
- Individuelles Volumen
- Individuelle Aufbewahrung
- Get API
- Delete API
- Bulk API
Storage, den Sie nicht selbst betreiben müssen.
Cloud Storage läuft auf demselben Netzwerk, das 70,000+ Entwickler bedient. Kein S3 zum Bereitstellen, keine Datenbank zum Sichern, nichts zum Aufräumen, wenn es voll wird.
Fügen Sie store=true einmal hinzu, und jeder Crawl wird behalten, indexiert und ist abrufbereit.
Fragen zu Cloud Storage.
Behalten Sie jede Seite, die Sie crawlen.
Sparen Sie sich die Datenbank.
Kostenlos beginnen, bis zu 10,000 Dokumente für 14 Tage speichern. Ein Token über Cloud Storage und jedes Produkt hinweg.