Ich werde jede öffentliche Website in ein sauberes CSV- oder JSON-Dataset extrahieren
Datenbereinigung, Web Scraping und Spreadsheet-Automatisierung
Über diesen Service
Du erhältst innerhalb von 48 Stunden ein sauberes CSV- und JSON-Dataset von jeder öffentlichen Website.
Gib mir die URL und die Felder, die du brauchst, wie Produktname, Preis, Bewertung und Link, und ich liefere ein strukturiertes Dataset plus einen Coverage-Report, der genau zeigt, welche Seiten besucht wurden und wie vollständig jedes Feld ist.
So funktioniert es: Ein headless Browser lädt jede Seite so, wie es ein echter Besucher tun würde, sodass JavaScript-gerenderte Listings funktionieren. robots.txt wird vor jeder Anfrage geprüft und beachtet. Die Paginierung wird automatisch bis zum von dir gesetzten Limit verfolgt, mit einer bewussten Pause zwischen den Seiten.
Du erhältst dataset.csv, dataset.json und coverage.md, die jede besuchte Seite mit Status und Record-Anzahl auflisten, sowie eine Prozentsatzangabe zur Vollständigkeit pro Feld, damit du sehen kannst, was die Quelle wirklich nicht hatte.
Nur öffentliche Seiten. Ich extrahiere nicht hinter Logins oder Paywalls, umgehe keine CAPTCHAs oder Rate-Limits und sammle keine persönlichen Kontaktdaten wie E-Mail- oder Telefonlisten. Bitte bestelle diese nicht.
Dies ist ein AI-unterstützter Workflow mit menschlicher Überprüfung vor der Lieferung. Schick mir zuerst die URL, und ich sage dir ehrlich, ob es machbar ist.
Technologie:
Python
•
Beautiful Soup
•
Dramatiker
•
Pandas
Technik:
Automatisiert
Mein Portfolio
FAQ
Automatische Übersetzung
Kannst du eine Seite scrapen, die eine Anmeldung erfordert?
Nein. Dieses Gig umfasst nur öffentlich erreichbare Seiten. Alles, was hinter Login, Paywall oder CAPTCHA liegt, ist außerhalb des Umfangs und ich werde es ablehnen, anstatt es zu versuchen.
Kannst du mir eine Liste mit E-Mails oder Telefonnummern erstellen?
Nein. Ich sammele keine persönlichen Kontaktdaten. Das verstößt gegen die Fiverr-Bedingungen und Datenschutzgesetze in den meisten Ländern. Öffentliche Geschäftseinträge wie Firmennamen, Kategorien, Preise und öffentliche URLs sind in Ordnung.
Was, wenn die Seite das Scraping in robots.txt blockiert?
Ich prüfe robots.txt vor jeder Anfrage und halte mich daran. Wenn der Pfad verboten ist, sage ich dir das vor Beginn und storniere die Bestellung, anstatt es zu umgehen.
Die Daten, die ich brauche, befinden sich auf der eigenen Seite jedes Artikels, nicht in der Liste. Kannst du sie bekommen?
Ja, das ist die Premium-Stufe. Die Liste wird zuerst gesammelt, dann wird jede Detailseite besucht und in die gleiche Zeile integriert. Sag mir, welche Felder auf der Detailseite liegen.
Verwendest du KI dafür?
Ja, das ist ein AI-unterstützter Workflow, bei dem jeder Lieferung vor dem Versand von einem Menschen überprüft wird. Das Dataset wird nur für deine Bestellung erstellt.

