Ich extrahiere PDF-Tabellen in Excel oder CSV mit Quellseitenangaben

Einige Informationen wurden automatisch übersetzt.

China

Ich spreche Chinesisch, Englisch

Full Stack Entwickler für Python-Automatisierung und Web Scraping

Full-Stack-Entwickler, spezialisiert auf Python-Automatisierung, PDF- und Tabellen-Workflows, Datenbereinigung, Web-Datenextraktion, Fehlerbehebung und API-Integrationen. Ich liefere strukturierte Aus...
Über diesen Service

Ich extrahiere Tabellen aus textbasierten PDFs in saubere Excel- oder CSV-Dateien. Jede Zeile enthält den Dateinamen und die Seitenzahl, es sei denn, du bittest mich, diese wegzulassen. Ich kann mehrseitige Tabellen, wiederholte Kopfzeilen, gedrehte Seiten und deutlich markierte Zeilen, die überprüft werden müssen, verarbeiten.


Alle Pakete beinhalten eine strukturierte Ausgabe und eine grundlegende Validierung. Standardmäßig wird eine zusammengeführte Master-Tabelle, eine Ausnahmeliste und eine QA-Zusammenfassung erstellt. Premium umfasst außerdem einen wiederverwendbaren lokalen Kommandozeilenworkflow und eine README für zukünftige Dateien.


Bitte sende vor der Bestellung repräsentative Muster, damit ich das Layout und die Akzeptanzprüfungen bestätigen kann. Gescannte oder nur bildbasierte PDFs, Handschrift, verschlüsselte Dateien und sehr unregelmäßige Layouts sind nur auf Vereinbarung in einem individuellen Angebot enthalten. Lade nur Dateien hoch, zu denen du berechtigt bist, sie zu teilen.


Ich kann, wo erlaubt, Python und KI-gestützte Tools verwenden. Jede Lieferung ist individuell angepasst und geprüft. Sag mir vor der Bestellung, falls dein Workflow nicht KI-gestützt oder nur lokal sein soll.

Technologie:

Excel

Python

Expertise:

Datenextraktion

Datenmanipulation

Datenvalidierung

etl

Mein Portfolio