Crawling API / Stack Exchange

Stack Exchange Scraper.
Jede Site, vollständig gerendert.

Senden Sie eine beliebige Stack-Exchange-URL und erhalten Sie das vollständig gerenderte HTML zurück, über Residential Proxys mit integriertem Anti-Bot-Handling.
Oder holen Sie strukturiertes JSON mit den Scrapern stackexchange-serp und stackexchange-thread.

99 % Erfolgsrate140M Residential IPs30 Regionen
Stack Exchange URLHTML or JSONstackoverflow.com/questions/2861071CrawlbaseRouteRendernExtrahierenGerendertes HTMLStrukturiertes JSONcrawling-apistackexchange-threadstackoverflow.com · Rate-Limit umgeleitet · 200
Live-Crawl-Feed · Stack Exchange1.24M req/minStreaming
200serverfault.com/questionsDE61ms
200mathoverflow.net/questions/tagged/nt.number-theoryES129ms
200stackoverflow.com/questions/tagged/pythonFR188ms
200unix.stackexchange.com/questions/tagged/bashES63ms
200stackoverflow.com/questions/tagged/pythonSG210ms
200askubuntu.com/questionsAU166ms
200superuser.com/questions/217504/how-do-i-record-my-screenNL130ms
200stackoverflow.com/questions/tagged/pythonAU216ms
200stackoverflow.com/questions/2861071/how-to-modify-a-text-fileGB126ms
200dba.stackexchange.com/questions/tagged/postgresqlUS81ms
200serverfault.com/questions/tagged/nginxCA172ms
200unix.stackexchange.com/questions/tagged/bashNL94ms
404stackoverflow.com/search?q=segmentation+faultBR167ms
200stackoverflow.com/questions/tagged/rustES145ms
200serverfault.com/questions/tagged/nginxGB155ms
200math.stackexchange.com/questions/tagged/linear-algebraIN95ms
200superuser.com/questions/217504/how-do-i-record-my-screenGB110ms
200stackoverflow.com/search?q=async+awaitGB77ms
200stackoverflow.com/search?q=async+awaitUS123ms
200stackoverflow.com/questions/tagged/rustUS63ms
200stackoverflow.com/questions/tagged/rustBR132ms
200askubuntu.com/questions/tagged/aptIN178ms
200superuser.com/questions/217504/how-do-i-record-my-screenGB198ms
200stackoverflow.com/search?q=segmentation+faultNL72ms
200stackoverflow.com/questions/tagged/pythonIN111ms
200superuser.com/questions/tagged/windowsAU200ms
200serverfault.com/questionsDE61ms
200mathoverflow.net/questions/tagged/nt.number-theoryES129ms
200stackoverflow.com/questions/tagged/pythonFR188ms
200unix.stackexchange.com/questions/tagged/bashES63ms
200stackoverflow.com/questions/tagged/pythonSG210ms
200askubuntu.com/questionsAU166ms
200superuser.com/questions/217504/how-do-i-record-my-screenNL130ms
200stackoverflow.com/questions/tagged/pythonAU216ms
200stackoverflow.com/questions/2861071/how-to-modify-a-text-fileGB126ms
200dba.stackexchange.com/questions/tagged/postgresqlUS81ms
200serverfault.com/questions/tagged/nginxCA172ms
200unix.stackexchange.com/questions/tagged/bashNL94ms
404stackoverflow.com/search?q=segmentation+faultBR167ms
200stackoverflow.com/questions/tagged/rustES145ms
200serverfault.com/questions/tagged/nginxGB155ms
200math.stackexchange.com/questions/tagged/linear-algebraIN95ms
200superuser.com/questions/217504/how-do-i-record-my-screenGB110ms
200stackoverflow.com/search?q=async+awaitGB77ms
200stackoverflow.com/search?q=async+awaitUS123ms
200stackoverflow.com/questions/tagged/rustUS63ms
200stackoverflow.com/questions/tagged/rustBR132ms
200askubuntu.com/questions/tagged/aptIN178ms
200superuser.com/questions/217504/how-do-i-record-my-screenGB198ms
200stackoverflow.com/search?q=segmentation+faultNL72ms
200stackoverflow.com/questions/tagged/pythonIN111ms
200superuser.com/questions/tagged/windowsAU200ms
01 Live-Demo

Ein Scraper, jede Stack-Exchange-Site.

Die Crawling API, live getippt. Sehen Sie, wie der Scraper stackexchange-serp strukturiertes JSON von Super User, Ask Ubuntu und MathOverflow zurückgibt - derselbe Aufruf funktioniert auf jeder Site im Netzwerk. Zum Pausieren und Lesen mit der Maus darüberfahren.

bereit
Tasten 1-3 wechseln · klicken zum Pausiereneigene URL ausführen
Starten Sie Ihre erste Anfrage in Minuten. Bis zu 20.000 kostenlose Anfragen, keine Kreditkarte.Kostenlos starten
02 Funktionen

Eine API, das ganze Stack-Exchange-Netzwerk.

Die beiden Scraper sind host-agnostisch, derselbe Aufruf funktioniert also auf Stack Overflow, Super User, Ask Ubuntu, MathOverflow und jeder *.stackexchange.com-Site. Die Crawling API rendert jede Seite in einem echten Browser, erreicht sie über Residential IPs und liefert Ihnen sauberes HTML oder JSON.

Netzwerk

Jede Stack-Exchange-Site

stackoverflow.com, superuser.com, askubuntu.com, serverfault.com, mathoverflow.net und alle *.stackexchange.com-Communities laufen über dieselben zwei Scraper.

Proxys

140M Residential IPs

Stack Exchange drosselt Datacenter-IPs, daher rotiert jede Anfrage eine Residential IP über 30 Regionen und erreicht jede Site wie ein echter lokaler Besucher.

Anti-Bot

Blockaden für Sie gelöst

CAPTCHAs, Bot-Walls und Rate-Limits werden automatisch überwunden. Nichts zu lösen, nichts zu warten.

Format

HTML oder JSON

Holen Sie das vollständig gerenderte HTML oder fügen Sie scraper=stackexchange-serp oder stackexchange-thread hinzu, um Fragenlisten und vollständige Threads als strukturiertes JSON zurückzugeben.

Extras

Screenshots und asynchron

Derselbe Aufruf kann einen ganzseitigen Screenshot erstellen oder asynchron mit Webhooks und Cloud-Storage laufen.

ein Token

Eine API für jede Site

Die Crawling API funktioniert mit jeder URL, derselbe Token deckt also das gesamte Stack-Exchange-Netzwerk und alles andere ab, was Sie crawlen. Live-Demo ansehen.

03 Ausgabe

Jedes Thread-Feld, als sauberes JSON.

Senden Sie eine Frage-URL mit scraper=stackexchange-thread und der Thread kommt als typisiertes JSON zurück. Tauschen Sie auf stackexchange-serp um, um dasselbe für Fragenlisten, Tags und Suchergebnisse zu tun.

{ "question": { "id": "2861071", "title": "How to modify a text file?", "score": 312, "viewCount": 486201, "tags": [ "python", "file" ], "askedAt": "2010-05-18T20:11:33Z", "author": { "name": "Nathan Fellman", "url": "https://stackoverflow.com/users/8460", "reputation": 127843 }, "comments": [ { "score": 3, "createdAt": "2010-05-18T20:19:04Z" } ] }, "answerCount": 2, "answers": [ { "id": "2861108", "score": 401, "isAccepted": true, "body": "Read the file into a list of lines, insert, then write it back.", "author": { "name": "Roberto Bonvallet", "url": "https://stackoverflow.com/users/193568", "reputation": 30215 }, "createdAt": "2010-05-18T20:15:52Z", "comments": [ { "score": 12, "createdAt": "2010-05-18T21:02:11Z" } ] } ] }

Frage

question.id · string  question.title · string  question.score · number  question.viewCount · number

Autor

question.author.name · string  question.author.url · string  question.author.reputation · number

Antworten

answerCount · number  answers[].score · number  answers[].isAccepted · boolean  answers[].body · string

Kommentare

question.comments[] · array  answers[].comments[].score · number  answers[].comments[].createdAt · string

Tags

question.tags · array  question.askedAt · string  answers[].createdAt · string

04 So funktioniert es

Von der URL zu Daten in einem Aufruf.

Jede Stack-Exchange-Anfrage nimmt denselben Weg. Sie senden eine URL, wir betreiben alles dazwischen.

01

URL senden

Übergeben Sie eine beliebige öffentliche Stack-Exchange-URL mit Ihrem Token: eine Frage, ein Tag, eine Suche oder eine Liste auf einer beliebigen Site im Netzwerk.

02

Proxy rotieren

Eine Residential IP und Region, die jede Site sauber erreichen, aus 140M IPs über 30 Regionen.

03

Seite rendern

Ein echter Browser lädt die Seite, sodass Scores, Antworten und Kommentare vor der Erfassung gerendert werden.

04

Anti-Bot überwinden

Die Bot-Prüfungen und Rate-Limits pro Seite jeder Site werden automatisch gehandhabt. Nichts zu lösen, nichts zu warten.

05

HTML oder JSON zurückgeben

Das vollständig gerenderte HTML kommt zurück, oder typisiertes JSON, wenn Sie stackexchange-serp oder stackexchange-thread hinzufügen.

05 Anwendungsfälle

Was Teams mit Stack-Exchange-Daten bauen.

USE / 01Wissen

Developer-Wissens-Mining

Ziehen Sie Fragen, akzeptierte Antworten und Kommentare aus dem Netzwerk, um durchsuchbare Wissensdatenbanken aufzubauen.

USE / 02Training

Trainingsdaten & RAG

Füttern Sie sauberen Frage-und-Antwort-Text über eine API in Modelle, RAG-Pipelines und Coding-Agents.

USE / 03Trends

Tech-Trend-Monitoring

Beobachten Sie Tags und Suchseiten über Sites hinweg, um aufkommende Sprachen, Tools und Themen früh zu erkennen.

USE / 04Q&A

Q&A-Datensätze

Stellen Sie strukturierte Frage-, Antwort- und Vote-Datensätze für Evaluierung und Benchmarks zusammen.

USE / 05Recherche

Wettbewerbs- & Dev-Recherche

Werten Sie echte Developer-Fragen, -Fehler und -Workarounds aus, um Produkt und Docs zu informieren.

USE / 06Abdeckung

Jede URL, eine API

Crawlen Sie Fragen, Tags, Nutzerseiten und Suche im Netzwerk, plus jede andere Site, die Sie brauchen.

06 Hinweise

Gut zu wissen beim Scrapen von Stack Exchange.

Ein Scraper-Paar, jede Site

stackexchange-serp und stackexchange-thread sind host-agnostisch, die beiden Scraper decken also Stack Overflow, Super User, Ask Ubuntu, MathOverflow und alle *.stackexchange.com-Communities ab.

HTML standardmäßig, JSON auf Anfrage

Sie erhalten das vollständig gerenderte HTML. Fügen Sie scraper=stackexchange-serp oder stackexchange-thread für geparstes JSON hinzu, oder parsen Sie das HTML selbst.

Residential Proxys von Haus aus

Stack Exchange drosselt Datacenter-IPs, daher laufen Anfragen über den Residential-Pool. Jede rotiert eine frische IP, sodass der Zugriff konsistent bleibt.

Jede Site von überall erreichen

Geotargeting über 30 Regionen und 140M Residential IPs bedeutet konsistenten Zugriff ohne Proxy-Verwaltung.

07 Warum Crawlbase

Gebaut, um Stack Exchange in großem Maßstab zu crawlen.

Die Crawling API läuft auf demselben Netzwerk, das über 46.000 zahlende Kunden und 70.000 Entwickler bedient. Keine Proxys zu kaufen, keine Browser zu betreiben, nichts zu patchen, wenn sich eine Stack-Exchange-Site ändert.

99%
Durchschnittliche Erfolgsrate der Anfragen
140M
Residential IPs, plus 98M Datacenter
30
Regionen für genaue lokale Ergebnisse
20/s
Anfragen pro Sekunde standardmäßig, mehr auf Anfrage

Ein Token, offizielle SDKs für Python, Node und Ruby und ein Netzwerk mit 99,99 % Uptime darunter.

08 FAQ

Fragen zum Scrapen von Stack Exchange.

Senden Sie eine beliebige Stack-Exchange-URL mit Ihrem Token an die Crawlbase Crawling API. Crawlbase rotiert einen Residential Proxy, rendert die Seite in einem echten Browser, überwindet Bot-Prüfungen und gibt das vollständig gerenderte HTML zurück. Fügen Sie einen dedizierten Scraper (scraper=stackexchange-serp oder stackexchange-thread) hinzu, um stattdessen strukturiertes JSON zu erhalten.
Ja. Standardmäßig gibt die Crawling API gerendertes HTML zurück; fügen Sie einen dedizierten Scraper (scraper=stackexchange-serp für Fragenlisten, Tags und Suche, stackexchange-thread für eine vollständige Frage mit Antworten und Kommentaren) hinzu, um strukturiertes JSON zu erhalten, oder parsen Sie das HTML selbst.
Beide Scraper sind host-agnostisch, sie funktionieren also auf stackoverflow.com, allen *.stackexchange.com-Sites, superuser.com, askubuntu.com, serverfault.com und mathoverflow.net über dieselbe API.
Crawlbase routet jede Anfrage über rotierende Residential IPs über 30 Regionen und überwindet Bot-Prüfungen automatisch. Stack Exchange drosselt Datacenter-IPs, daher hält der Residential-Pool den Zugriff konsistent, und es gibt nichts zu warten, wenn eine Site ihre Konfiguration ändert.
stackexchange-serp gibt eine Liste von Fragen aus einer Tag-, Such- oder Listenseite zurück, jede mit Titel, Score, Antwortanzahl, Aufrufanzahl, Tags und Auszug, plus Pagination. stackexchange-thread gibt eine einzelne Frageseite zurück: den vollständigen Fragetext mit jeder Antwort und jedem Kommentar, inklusive Scores, Akzeptiert-Status, Autor-Reputation und Zeitstempeln.
Jede öffentliche URL: Fragen und ihre Antworten, Tag-Listen, Nutzerprofile und Suchergebnisseiten auf jeder Site im Netzwerk. Dieselbe API funktioniert auch auf jeder anderen Site.
Starten Sie kostenlos mit bis zu 20.000 Anfragen und ohne Kreditkarte. Bezahlpläne skalieren mit der Nutzung, und derselbe Token funktioniert über die Crawling API und jeden Crawlbase-Scraper.

Starten Sie das Scrapen von Stack Exchange.
Sparen Sie sich Proxys und Rate-Limits.

Kostenlos zu beginnen mit bis zu 20.000 Anfragen. Ein Token für die Crawling API und jeden Scraper.