Ich extrahiere Tabellen aus PDF- oder gescannten Berichten in sauberes Excel
Datenanalyse
Level 1
Hat bestimmte Leistungskriterien erfüllt und zeigt großes Potenzial auf dem Marktplatz.
Über diesen Service
Sende mir eine textbasierte PDF oder eine gescannte Version, und ich liefere dir eine saubere, strukturierte Excel-Datei mit jeder Tabelle extrahiert, richtig getypt und in eine einzige Arbeitsmappe zusammengeführt.
Was du bekommst:
- Eine saubere .xlsx mit einem Blatt pro Quelltabelle (oder auf Wunsch in eine einzige ordentliche Tabelle zusammengeführt)
- Normalisierte Spaltenüberschriften, korrigierte Datentypen (Zahlen, Daten, Währungen)
- Quellen-Seiten-Referenzspalte, damit du die Extraktion überprüfen kannst
- Optional: ein "Validation"-Blatt, das Zeilen mit niedriger Vertrauenswürdigkeit markiert
Ich extrahiere aus:
- Finanzberichten, Jahresabschlüssen, 10-Ks
- Regierungs- / Regulierungsdokumenten
- Wissenschaftlichen Arbeiten (Tabellen und Referenzlisten)
- Rechnungen und Quittungen
- Wissenschaftlichen Berichten und White Papers
- Immobilienanzeigen und Katalogen
- Umfrageergebnisse im PDF-Format
Sowohl textbasierte PDFs als auch gescannte Bild-PDFs werden verarbeitet, OCR ist bei Bedarf inklusive und kostenlos.
Warum ich schnell bin: KI-gestützte Tabellenerkennung und OCR + menschliche Qualitätskontrolle. Die meisten Aufträge versende ich am selben Tag bei weniger als 50 Seiten.
Lege das PDF in die Auftragsbeschreibung, zusammen mit einer Zeile, welche Tabellen du brauchst (oder "alle"). Ich kümmere mich um den Rest.
Anwendung:
Excel
•
Google Sheets
•
Google Docs
FAQ
Automatische Übersetzung
Was ist im Basispaket enthalten?
(1) Bis zu 10 Seiten; (2) Nur textbasierte PDFs (kein OCR); (3) Eine Tabelle pro Seite; (4) Sauberes .xlsx-Output; (5) Quellen-Seiten-Referenz
Was ist im Standardpaket enthalten?
(1) Bis zu 50 Seiten; (2) Text- oder gescannte PDFs (OCR inklusive); (3) Mehrere Tabellen pro Seite werden verarbeitet; (4) Normalisierte Überschriften, Typkorrektur; (5) Optional in eine einzige ordentliche Tabelle zusammengeführt; (6) Validation-Tab, der Zeilen mit geringem Vertrauen markiert
Was ist im Premium-Paket enthalten?
(1) Bis zu 200 Seiten; (2) Text- oder gescannte PDFs (OCR inklusive); (3) Komplexe Mehrseiten-Tabellen, Fußnotenbehandlung, gedrehte Tabellen; (4) Vollständige Reinigung + Validierung; (5) Wiederverwendbares Python-Skript, um bei ähnlichen PDFs in Zukunft die Extraktion zu wiederholen; (6) Walkthrough-README
Bleibt mein Dokument privat?
Ja — Ich teile oder wiederverwerte Kunden-Dateien niemals. NDA auf Anfrage erhältlich.
Mein PDF hat handschriftliche Notizen — kannst du die extrahieren?
Gedruckter Text und die meisten sauberen Handschriften ja. Grobe Handschriften sind nur Best-Effort und werden markiert. Schreib mir vorher eine Nachricht mit einer Beispielseite.
Kannst du nur bestimmte Tabellen extrahieren, nicht alle?
Ja — liste die Tabellen- oder Seitenzahlen auf, die du brauchst.
Kannst du auch PDFs in anderen Sprachen außer Englisch verarbeiten?
Ja — die meisten wichtigen lateinischen und CJK-Sprachen. Sag mir die Quellsprache vorher.
Meine PDFs kommen monatlich — kannst du etwas Automatisches einrichten?
Die Premium-Option beinhaltet ein Python-Skript, das du auf neue PDFs mit derselben Vorlage laufen lassen kannst. Für vollständige Automatisierung (Datei-Überwachung, Cloud-Funktion) schick mir eine Nachricht für ein individuelles Angebot.
Mein PDF hat mehr als 200 Seiten. Ist das möglich?
Ja, schick mir eine Nachricht für ein individuelles Angebot — typischerweise 1,50 $ pro Seite für Text-PDFs, 2,50 $ pro Seite für gescannte Dokumente.

