Ich werde einen benutzerdefinierten Website-Scraper mit geplanten Läufen und sauberem CSV-Export erstellen
Web Entwicklung
Über diesen Service
Ich erstelle saubere Python-Scraper, die Webdaten für dich nach einem Zeitplan abrufen. Produktpreise, Immobilienangebote, Wettbewerberkataloge, Bewertungen oder Leads.
Was du bekommst. Ein funktionierender Scraper, gebaut mit Python und Playwright. Er verarbeitet JavaScript-gerenderte Seiten, Paginierung, Anti-Bot-Edge-Cases und strukturierte Extraktion via JSON LD oder konfigurierbare CSS-Selektoren. Ausgabe als CSV, JSON, Excel, Google Sheets oder direkt in deine Datenbank.
Gängige Anwendungsfälle. Wettbewerberpreisüberwachung mit täglichen Slack-Benachrichtigungen bei Preisrückgängen. Immobilienangebot-Aggregation über Portale. E-Commerce-Produktkatalog- und Bewertungs-Extraktion. Lead-Generierung aus Verzeichnissen und Listing-Seiten. Nachrichten und Artikel für Analysen oder RAG-Pipelines.
Premium erweitert um vollständige Automatisierung. GitHub Actions Cron, CSV-Differenzierung und Benachrichtigungen bei Änderungen. Gleiche Architektur wie mein öffentliches Wettbewerberpreis-Überwachungs-Repo auf GitHub.
Ich bin ehrlich bei den Grenzen. Seiten mit aggressivem Anti-Bot-Schutz wie Cloudflare Turnstile, Login-Walls oder nur wohnsitzbezogener Zugriff können bezahlte Proxies erfordern oder sind das Scrapen nicht wert. Ich sage dir vorher, wenn dein Ziel in diese Kategorie fällt.
Mein Portfolio
FAQ
Automatische Übersetzung
Welche Informationen benötigen Sie, um loszulegen?
Die URL(s) der Seite(n), die du scrapen möchtest, die genauen Felder, die du brauchst (z.B. Produktname, Preis, SKU, Bild-URL), das Ausgabeformat (CSV/JSON/Excel/Sheets/Datenbank) und wie oft es laufen soll (einmalig, täglich, stündlich).
Ist Web Scraping legal?
In der Regel ja für öffentlich zugängliche Daten, aber es hängt von den Nutzungsbedingungen der Seite und deiner Verwendung der Daten ab (GDPR für personenbezogene Daten, Urheberrecht für Inhaltswiederverwendung). Ich scrape nur öffentliche Daten, respektiere robots.txt wo sinnvoll und füge höfliche Verzögerungen ein. Für Grauzonen-Ziele werde ich Risiko markieren.
Was passiert, wenn die Website ihr Layout ändert und den Scraper kaputt macht?
Meine Scraper verwenden mehrschichtige Extraktion (JSON-LD zuerst, Microdata, CSS-Selektoren als Fallback), sodass die meisten Neugestaltungen sie nicht zerstören. Selektoren sind in der Konfiguration, nicht im Code, also sind kleine Änderungen 1-Zeilen-Reparaturen. Wenn es innerhalb von 14 Tagen kaputt geht und konfigurierbar ist, repariere ich es kostenlos.
Kannst du Login, Captcha oder Anti-Bot-Schutz handhaben?
Login: ja, wenn du Zugangsdaten bereitstellst und kein hartes Captcha vorhanden ist. Grundlegender Anti-Bot (UA, Ratenbegrenzung): ja, über Header und Verzögerungen. Harte Anti-Bot (Cloudflare Turnstile, hCaptcha, nur wohnsitzbezogen): möglich mit bezahlten Proxies, aber die Kosten steigen und die Zuverlässigkeit sinkt. Ich sage es dir vorher.
Wo läuft der Scraper nach der Lieferung?
Basic/Standard: du führst ihn auf deinem Rechner oder Server aus (ich gebe Anweisungen). Premium: Ich setze ihn auf GitHub Actions ein (kostenlos für öffentlich, großzügig für privat), läuft nach Zeitplan ohne dein Zutun. AWS Lambda, Render oder dein eigener VPS auf Anfrage.
Was ist mit den laufenden Kosten?
GitHub Actions: kostenlos in den meisten Fällen. Speicher: CSV-Datei (kostenlos). Proxies (nur wenn die Seite sie benötigt): ab 30 $/Monat bei Anbietern wie Bright Data oder Smartproxy. Nach der Lieferung berechne ich nichts, es sei denn, du möchtest, dass ich den Scraper pflege oder erweitere.

