Ich werde eine Python-Web-Scraping- oder AI-Automatisierungs-Pipeline erstellen
KI-Automatisierungs- und Backend-Ingenieur, Python FastAPI RAG
Über diesen Service
Ich erstelle Datenpipelines, die nach der Übergabe weiterlaufen, keine Skripte, die nach einer Woche kaputtgehen.
Was ich mache:
- Geschäftsdaten, Produkt- und Kontaktdaten von Websites und APIs scrapen (Google Places, öffentliche Verzeichnisse, eigene Seiten)
- Diese ordentlich bereinigen: Telefonnummern zu E.164, Dubletten mit Fuzzy-Matching entfernen, E-Mails verifizieren (MX/SMTP), veraltete Einträge löschen
- In einer echten Datenbank speichern (PostgreSQL/Supabase) mit geplanten oder bedarfsgesteuerten Läufen
- Optional eine KI-Schicht: jeden Datensatz mit einem LLM bewerten und qualifizieren plus eine kurze Begründung, oder unstrukturierte Texte und PDFs extrahieren
Ich nutze offizielle APIs, wo sie existieren, und greife nur auf rohes Scraping zurück, wenn keine API vorhanden ist. Ich sage dir, was was ist, anstatt etwas zu liefern, das beim nächsten Layout-Update kaputtgeht.
Aktuelle Arbeit: eine grid-basierte Lead-Engine, die fast vollständige Stadtabdeckung erreicht, im Gegensatz zu den meist nur 60 Ergebnissen, die bei den meisten Scrapers stillschweigend verloren gehen.
Technologie: Python, httpx, BeautifulSoup, Playwright, Pandas, PostgreSQL, LLM-APIs.
Schick mir vor der Bestellung deine Zielseiten und Felder, damit ich bestätigen kann, dass es machbar ist, und gebe dir ein genaues Angebot.
Technologie:
scrapy
•
Selen
•
Beautiful Soup
•
Dramatiker
•
Pandas
Technik:
Automatisiert

