Ich werde PDF- und gescannte Dokumentdaten in Excel, CSV oder json extrahieren
Datenextraktion, Python-Automatisierung und Software-QA
Über diesen Service
Ich extrahiere nützliche Daten aus PDFs und gescannten Dokumenten in saubere Excel-, CSV- oder JSON-Dateien. Meine aktuelle Arbeit umfasst OCR und UCC-Aktenextraktion aus US-Regierungsquellen.
Das Pilotpaket beinhaltet:
- Bis zu 50 Seiten getippten Texts, mit einem einheitlichen Dokumentenlayout
- Bis zu 10 vereinbarte Felder
- Ein Ausgabeformat: Excel, CSV oder JSON
- Formatierung, Grundlegende Validierung und Duplikatsprüfung
- Ein wiederverwendbares Python-Extraktionsskript mit Setup-Anleitung
- Eine Überarbeitung innerhalb des ursprünglichen Umfangs
Bitte sende mir vor der Bestellung 2-3 repräsentative Seiten und dein gewünschtes Ausgabeformat, damit ich den Umfang bestätigen kann.
Handschrift, schlechte Scans, komplexe Tabellen, mehrere Layouts, Website-Scraping, API-Integrationen und Cloud-Hosting erfordern ein separates Angebot. Bezahlte OCR/API-Nutzung ist ausgeschlossen und muss im Voraus vereinbart werden. Unleserliche oder unsichere Werte werden zur Überprüfung markiert.
Mein Upwork-Rekord: Über 200.000 $ verdient, 100 % Job-Erfolg, Top Rated Plus, 193 Aufträge und über 5600 Stunden. Ich überprüfe die Ausgabe persönlich vor der Lieferung.
Technologie:
Excel
•
Google Sheets
•
Python
