Ich erstelle einen maßgeschneiderten Web Scraper oder automatisierten Daten-Crawler in Python

Einige Informationen wurden automatisch übersetzt.

Pakistan

Ich spreche Paschtunische Sprache, Urdu, Englisch

Python Web Scraping und Automatisierungsexperte, Selenium, Playwright, OCR

Ich baue automatisierte Datenpipelines, die strukturierte Daten von Websites ziehen, inklusive Seiten mit Login, Captchas oder gescannten/bildbasierten Inhalten, und liefere sie sauber in Excel/Sheets...
Über diesen Service

Ich entwickle maßgeschneiderte Python-Web-Scraper und Datenautomatisierungs-Pipelines, die verstreutes Web-Content in saubere, strukturierte Datensätze verwandeln. Ich arbeite mit requests + BeautifulSoup für Standardseiten und Playwright für JavaScript-intensive oder bot-geschützte Seiten (Cloudflare, dynamischer Content, Login-geschützte Seiten).

Kürzlich habe ich ein reales Projekt abgeschlossen, bei dem ich 13 verschiedene Glossare und Referenzseiten der Öl- und Gasindustrie gescraped habe. Dabei wurden statisches HTML, eingebettete JSON-LD-Daten, JS-Klick-Interaktionen und Cloudflare-Schutz genutzt, um alles in einen sauberen, deduplizierten CSV-Datensatz zu verwandeln. Das vollständige Projekt kannst du auf meinem GitHub sehen.

Was ich für dich tun kann:

  • Produkte, Verzeichnisse, Glossare, Preise, Kontaktinformationen oder andere strukturierte Webdaten scrapen
  • Dynamische/JS-gerenderte Seiten und grundlegenden Bot-Schutz handhaben
  • Daten aus mehreren Quellen zusammenführen und duplizierte Einträge entfernen
  • Als CSV, Excel oder JSON liefern, was du möchtest

Sende mir vor der Bestellung deine Zielseite(n), damit ich die Machbarkeit prüfen kann (einige Seiten haben technische oder rechtliche Blockaden, die ich ehrlich im Voraus kennzeichnen werde, anstatt zu übertreiben).

Technologie:

Python

•

Excel

•

Selen

•

Beautiful Soup

•

Dramatiker

Informationstyp:

<br>Kontaktinformationen

Technik:

Automatisiert

Mein Portfolio