Ich werde deine PDF-Tabellen in sauberes Excel umwandeln mit einem wiederverwendbaren Python-Skript

Einige Informationen wurden automatisch übersetzt.

Usbekistan

Ich spreche Russisch, Usbekisch, Englisch

Python-Automatisierung für Excel, PDF und Datenberichte

Ich entwickle kleine Python-Tools, die dir eine langweilige, sich wiederholende Arbeit abnehmen. Die meiste Arbeit sieht so aus: du hast Daten in einer bestimmten Form – PDFs, ein CRM-Export, einen O...
Über diesen Service

Deine PDF enthält eine Tabelle. Du brauchst sie in Excel, und zwar nicht nur einmal, sondern jede Woche.


Die meisten Verkäufer tippen sie von Hand ab und berechnen pro Seite. Ich schreibe dir stattdessen ein Python-Skript: du führst es selbst aus, so oft du willst, auf so vielen Dateien, wie du möchtest.


Was es auf echten Dokumenten zuverlässig macht: Tabellen, die sich über Seiten hinweg erstrecken und bei denen die Kopfzeile wiederholt wird (die Wiederholungen werden entfernt), Zwischensummen, die mitten im Dokument stehen (getrennt von den eigentlichen Positionen), Zahlen im Format 1 234 567,89 oder 1,234,567.89 (beide werden korrekt gelesen), und lange Artikelnamen, die innerhalb einer Zelle umgebrochen werden (zusammengehalten).


Es überprüft auch seine eigene Arbeit: Die Summe der extrahierten Zeilen wird mit der im PDF angezeigten Gesamtsumme verglichen, und Menge mal Preis wird für jede Zeile neu berechnet. Wenn die Werte nicht übereinstimmen, siehst du das im Ergebnis, statt es erst einen Monat später zu merken.


Du bekommst die saubere Excel-Datei, das Skript und eine kurze README, damit du es selbst ausführen kannst.


Gescannt PDFs (Bilder statt Text) benötigen OCR. Schreib mir zuerst eine Nachricht mit einer Beispiel-Datei.

Konvertieren von:

PDF

Konvertieren in:

XLS, XLSX