Duolingo Scraper.
Jede Seite, vollständig gerendert.
Senden Sie eine beliebige Duolingo-URL und erhalten Sie das vollständig gerenderte HTML zurück, über Residential Proxies mit integriertem Anti-Bot-Handling.
Verwandeln Sie es mit dem generic extractor in JSON.
Jede Duolingo-URL rein. HTML oder JSON raus.
Die Crawling API, live getippt. Erhalten Sie das gerenderte HTML oder wechseln Sie zum generic extractor für JSON. Fahren Sie mit der Maus darüber, um anzuhalten und mitzulesen.
Eine API für alles, was Duolingo Ihnen entgegenwirft.
Duolingo ist eine JavaScript-Single-Page-App, in der Kursbäume, Bestenlisten und Profile über interne APIs gerendert werden, mit Bot-Erkennung auf den App- und Profilseiten. Die Crawling API rendert sie in einem echten Browser, erreicht sie über Residential-IPs und liefert Ihnen sauberes HTML oder JSON.
Vollständiges JavaScript-Rendering
Ein echter Browser führt die Single-Page-App aus, sodass Kurseinheiten, Lektionen, Bestenlisten und Profildaten, die über interne APIs geladen werden, alle erfasst werden, nicht nur die anfängliche Shell.
140M Residential-IPs
Jeder Request rotiert eine Residential-IP über 30 Regionen, sodass Sie Duolingo wie ein echter lokaler Lernender erreichen.
Blockaden für Sie erledigt
CAPTCHAs, Bot-Walls und Rate Limits werden automatisch beseitigt. Nichts zu lösen, nichts zu warten.
HTML oder JSON
Erhalten Sie das vollständig gerenderte HTML oder fügen Sie scraper=generic-extractor hinzu, um Titel, Inhalt, Bilder und Links als strukturiertes JSON zurückzugeben.
Screenshots und asynchron
Derselbe Call kann einen ganzseitigen Screenshot erfassen oder asynchron mit Webhooks und Cloud Storage laufen.
Eine API für jede Website
Die Crawling API funktioniert mit jeder URL, sodass derselbe Token Duolingo und alles andere abdeckt, was Sie crawlen. Zur Live-Demo.
Gerendertes HTML oder sauberes JSON.
Standardmäßig erhalten Sie das gerenderte HTML. Fügen Sie den generic-extractor hinzu und dieselbe Seite kommt als typisiertes JSON zurück.
Page
title · string canonical · string favicon · string
Meta
meta.description · string meta.keywords · string
Content
content · string
Media
images · array og_images · array
Links
links · array
Von der URL zu Daten in einem Call.
Jeder Duolingo-Request nimmt denselben Pfad. Sie senden eine URL, wir betreiben alles dazwischen.
URL senden
Übergeben Sie eine beliebige öffentliche Duolingo-URL mit Ihrem Token: einen Kurs, den Katalog, eine Bestenliste oder ein öffentliches Profil.
Proxy rotieren
Eine Residential-IP und Region, die Duolingo sauber erreichen, aus 140M IPs über 30 Regionen.
Seite rendern
Ein echter Browser lädt die Single-Page-App, sodass Kurseinheiten, Bestenlisten und Profildaten vor der Erfassung rendern.
Anti-Bot beseitigen
Die Bot-Prüfungen von Duolingo auf den App- und Profilseiten werden automatisch gehandhabt. Nichts zu lösen, nichts zu warten.
HTML oder JSON zurückgeben
Das vollständig gerenderte HTML kommt zurück oder typisiertes JSON, wenn Sie den generic extractor hinzufügen.
Was Teams auf Duolingo-Daten aufbauen.
Kurs- & Inhaltsüberwachung
Verfolgen Sie Kurseinheiten, Lektionen und Katalogänderungen über Sprachpaare hinweg, während Duolingo sie aktualisiert.
Sprachlern-Daten
Sammeln Sie Kursinhalte, Übungsaufgaben und lokalisierte Strings, um zu untersuchen, wie Lektionen strukturiert sind.
Wettbewerbsanalyse
Vergleichen Sie Kursabdeckung, Funktionen und Bestenlisten mit anderen Sprachlern-Apps.
Lokalisierungsforschung
Vergleichen Sie denselben Kurs über Ausgangs- und Zielsprachen hinweg, um Übersetzungs- und Lokalisierungsarbeit zu unterstützen.
Trainingsdaten & RAG
Speisen Sie sauberen Duolingo-Text über eine API in Modelle, RAG-Pipelines und Agenten ein.
Jede URL, eine API
Crawlen Sie Kurse, den Katalog, Bestenlisten und Profile, sowie jede andere Website, die Sie brauchen.
Gut zu wissen beim Scrapen von Duolingo.
Gerendert wie ein echter Browser
Duolingo ist eine Single-Page-App; die Crawling API führt einen echten Browser aus, sodass Kursbäume, Bestenlisten und Profildaten über ihre internen APIs vor der Erfassung laden.
HTML standardmäßig, JSON auf Anfrage
Sie erhalten das vollständig gerenderte HTML. Fügen Sie scraper=generic-extractor für geparsten Titel, Inhalt, Bilder und Links hinzu, oder parsen Sie das HTML selbst.
Sprachpaare liegen im Pfad
Eine Kurs-URL trägt die Ausgangs- und Zielsprache, sodass Sie ein bestimmtes Paar targetieren und den Request für lokalisierte Inhalte geotargeten können.
Duolingo von überall erreichen
Geotargeting über 30 Regionen und 140M Residential-IPs bedeutet konsistenten Zugriff, ohne Proxys zu verwalten.
Gebaut, um Duolingo im großen Maßstab zu crawlen.
Die Crawling API läuft auf demselben Netzwerk, das 46,000+ zahlende Kunden und 70,000+ Entwickler bedient. Keine Proxys zu kaufen, keine Browser zu betreiben, nichts zu patchen, wenn Duolingo sich ändert.
Ein Token, offizielle SDKs für Python, Node und Ruby, und ein Netzwerk mit 99.99% Verfügbarkeit darunter.
Fragen zum Duolingo-Scraping.
Beginnen Sie, Duolingo zu scrapen.
Sparen Sie sich die Proxys und Blockaden.
Kostenloser Start mit bis zu 20,000 Requests. Ein Token für die Crawling API und jeden Scraper.