Ich werde strukturierte Daten aus PDFs in Excel, CSV und json extrahieren
Python- und lokale KI-Automatisierungsentwicklung
Über diesen Service
Ich extrahiere strukturierte Daten aus nativen Text-PDF-Dokumenten und liefere sie in einem sauberen, wiederverwendbaren Format.
Ich kann spezifische Felder aus Rechnungen, Berichten, Formularen, Kontoauszügen und anderen strukturierten oder semi-strukturierten PDFs in Excel, CSV oder JSON je nach gewähltem Paket extrahieren.
Mein Workflow kann umfassen:
Feldbasierte Datenerfassung
Excel- und CSV-Ausgabe
JSON-Ausgabe bei Standard und Premium
Seitenreferenzen für extrahierte Werte
Warnungen bei fehlenden oder ungültigen Werten
Datenvalidierung
QA-Bericht und organisierte ZIP-Lieferung
Individuelle Validierungsregeln bei Premium
Ich rate keine fehlenden Werte vor. Wenn ein Wert nicht zuverlässig gefunden werden kann, bleibt er fehlend oder wird zur Überprüfung markiert.
Dieser Service ist für native Text-PDFs konzipiert. OCR, handschriftliche Dokumente, passwortgeschützte Dateien, Login-Daten, API-Integration und Zugriff auf Produktionssysteme sind nicht enthalten.
Bitte sende die PDFs, die genauen Felder, die du extrahieren möchtest, und dein bevorzugtes Ausgabeformat.
Alle Kommunikation und Lieferung können asynchron über Fiverr erfolgen.
Technologie:
Excel
•
Python
Mein Portfolio
FAQ
Automatische Übersetzung
Welche Arten von PDF-Dateien unterstützt du?
Ich unterstütze native-text-PDF-Dokumente, bei denen Text ausgewählt oder kopiert werden kann. Gescannte Bild-PDFs und handschriftliche Dokumente, die OCR erfordern, sind nicht enthalten.
Welche Ausgabeformate bieten Sie an?
Excel und CSV sind in allen Paketen enthalten. JSON-Ausgabe ist bei Standard und Premium inklusive.
Kannst du spezifische Felder extrahieren, die ich auswähle?
Ja. Bitte gib die genauen Feldnamen an, die du extrahieren möchtest, wie Rechnungsnummer, Datum, Firmenname, Gesamtbetrag, E-Mail oder andere dokumentenspezifische Felder.
Stellst du Seitenreferenzen bereit?
Ja. Die extrahierten Werte können die Quelle PDF und die Seitenreferenz enthalten, damit du nachvollziehen kannst, woher jeder Wert stammt.
Was passiert, wenn ein Wert nicht gefunden werden kann?
Ich erfinde oder rate keine fehlenden Werte. Das Feld bleibt je nach Ergebnis der Extraktion und Validierung fehlend oder wird zur Überprüfung markiert.
Kannst du die extrahierten Daten validieren?
Ja. Standard und Premium beinhalten Validierungswarnungen. Premium kann auch benutzerdefinierte Validierungsregeln basierend auf deinen Anforderungen enthalten.
Unterstützt du gescannte PDFs oder OCR?
Nein. Dieses Gig ist derzeit auf native-text-PDFs beschränkt. Bildscans und handschriftliche Dokumente, die OCR erfordern, fallen außerhalb des unterstützten Rahmens.
Kannst du auf mein Konto, meine Website, API oder Datenbank zugreifen?
Nein. Dieser Service basiert nur auf Dateien. Ich benötige keinen Konto-Login, API-Zugang, Datenbankzugriff oder Zugriff auf Produktionssysteme.
Brauchen wir einen Videoanruf oder ein Treffen?
Nein. Das gesamte Projekt kann asynchron über Fiverr-Nachrichten und Dateiaustausch abgewickelt werden.
Was sollte ich vor Beginn der Bestellung schicken?
Bitte sende die Quell-PDFs, die genauen Felder, die du extrahieren möchtest, dein bevorzugtes Ausgabeformat sowie alle Validierungsregeln oder Beispielausgaben, die ich befolgen soll.

