Ich werde Daten von Websites für dich sammeln
Moderne, responsive und skalierbare Web-Erlebnisse erstellen
Über diesen Service
Hallo!
Ich helfe dir dabei, Daten von deiner Wunschseite zu sammeln. Ich mache Web Scraping schon eine Weile für Kunden meiner Kollegen.
Ich nutze hauptsächlich Puppeteer mit NodeJS, um Daten zu extrahieren. Die extrahierten Daten kannst du in einer sauberen Excel-, CSV- (Komma-getrennte Werte) oder JSON-Datei erhalten – falls eine Rohdatei nicht dein Ding ist, kann ich auch eine Funktion implementieren, die die Daten in deine bevorzugte Datenbank hochlädt, da ich zuvor MongoDB und Supabase verwendet habe.
Technologie:
JavaScript
•
Python
•
NodeJS
•
Puppenspieler
•
Beautiful Soup
Technik:
Automatisiert
Mein Portfolio
FAQ
Automatische Übersetzung
Welche Art von Daten können extrahiert werden?
Alles, was in Textform vorliegt, kann extrahiert werden – bei Videos und Bildern speichere ich die URL.
In welcher Dateiformat sind die Daten nach der Extraktion?
Bisher habe ich nur Excel (mit mehreren Tabellenblättern), CSV (Komma-getrennte Werte) und JSON-Dateien verwendet, da diese am gängigsten sind.
Was, wenn ich eine große Menge an Daten extrahieren möchte?
In solchen Fällen bevorzuge ich die Nutzung einer Backend-Integration oder das Aufteilen der Dateien in mehrere Teile.
Wie lange dauert das normalerweise?
Je nach Seite, die keine großen Komplikationen wie Rate-Limiting oder ablaufende Tokens hat, dauert es nicht mehr als ein paar Stunden. Seiten mit Komplikationen brauchen auch nicht viel Zeit, sobald wir ihre Schutzmaßnahmen überwunden haben.

