Welcher Weg passt zu Ihrer PDF?
Das entscheiden drei Fragen: Hat die PDF eine Textebene, wie viele Dateien sind es, und dürfen die Inhalte Ihr Haus verlassen? Ob eine Textebene da ist, sehen Sie schnell: Lässt sich in der PDF ein Wort markieren und kopieren, ist Text vorhanden. Geht das nicht, ist die Seite ein Bild, meist ein Scan, und braucht zuerst eine Texterkennung (OCR).
| Weg | Geeignet für | Grenzen | Datenschutz |
|---|---|---|---|
| Excel: Aus PDF (Power Query) | Digital erzeugte Tabellen; wiederkehrende Berichte mit gleichem Aufbau | Nur Excel für Windows mit Microsoft-365-Abo; Scans ohne Textebene liefern keine Tabelle; mehrzeilige Zellen brauchen Nacharbeit | Die Datei wird in Excel auf Ihrem Rechner eingelesen |
| Copilot in Excel für das Web | Einzelne PDFs mit klar erkennbaren Zeilen und Spalten, wenn Copilot ohnehin lizenziert ist | Passende Microsoft-365-Lizenz; Microsoft nennt gescannte, kennwortgeschützte und stark formatierte PDFs als Fehlerquellen | Die PDF geht an den Copilot-Dienst von Microsoft; zu Modellen und EU-Datengrenze siehe Abschnitt Copilot |
| Adobe Acrobat: Export nach Excel | Einzelne PDFs, auch Scans, weil der Export eine Texterkennung einschalten kann | Desktop-App nur mit kostenpflichtiger Acrobat-Version; Layout, verbundene Zellen und Zahlenformate prüfen | Das kostenlose Online-Werkzeug lädt die Datei zu Adobe hoch |
| Word als Zwischenschritt | Kurze Tabellen in textlastigen PDFs, wenn Acrobat fehlt | Tabellen mit Zellabständen gelten laut Microsoft als problematisch; danach von Word nach Excel kopieren | Kein zusätzlicher Anbieter, wenn Word ohnehin im Einsatz ist |
| Online-Konverter | Einmalige Dateien ohne Personenbezug und ohne Geschäftsgeheimnisse | Ergebnis und Nutzungsbedingungen je Anbieter verschieden | Die Datei geht an einen Dritten; bei personenbezogenen Daten ist ein AV-Vertrag nötig |
| KI-Agent am Arbeitsordner | Viele PDFs mit unterschiedlichem Aufbau, die in eine Tabelle mit festen Spalten sollen | Je nach Produkt ohne Texterkennung; Ergebnis mit Summenprobe und Stichproben prüfen | Verwendete Inhalte gehen an das Sprachmodell des Anbieters |
Fehlerfrei arbeitet keiner der Wege, und das liegt an der PDF selbst: Laut Microsoft legt sie eine Tabelle als Satz von Linien ab, ohne Bezug zum Inhalt der Zellen. Jedes Werkzeug muss die Tabelle aus der Lage der Wörter erschließen. Typische Stolperstellen sind mehrzeilige Zellen, Zwischensummen, wiederholte Kopfzeilen und Seitenumbrüche.
Wie funktioniert der PDF-Import in Excel?
In Excel für Windows lesen Sie eine PDF mit Power Query ein, dem Importwerkzeug von Excel. Laut Microsofts Übersicht der Datenquellen gehört der PDF-Import zu Excel im Microsoft-365-Abo (Stand September 2026). In den Kaufversionen Office 2016 und 2019 fehlt er, und für Excel für Mac führt Microsoft PDF nicht als Datenquelle.
- Import starten
Wählen Sie Daten → Daten abrufen → Aus Datei → Aus PDF, markieren Sie die Datei und klicken Sie auf „Öffnen“.
- Tabelle auswählen
Der Navigator zeigt die Tabellen, die Excel in der PDF erkannt hat. Klicken Sie die Einträge an und vergleichen Sie die Vorschau mit der PDF. Findet Excel keine brauchbare Tabelle, prüfen Sie zuerst, ob die PDF eine Textebene hat; ein Scan braucht einen der Wege aus dem nächsten Abschnitt.
- Laden oder erst bereinigen
„Laden“ legt die Tabelle direkt in einem neuen Blatt ab. „Daten transformieren“ öffnet zuerst den Power-Query-Editor, in dem Sie Kopfzeilen festlegen, leere Zeilen entfernen und Spalten umbenennen.
- Zahlen und Datumswerte deutsch lesen lassen
Power Query liest Zahlen und Datumsangaben nach dem Gebietsschema Ihres Systems. Passt das nicht zur PDF, klicken Sie im Editor mit der rechten Maustaste auf die Spaltenüberschrift, wählen Typ ändern → Gebietsschema verwenden und stellen den Datentyp und „Deutsch (Deutschland)“ ein. So werden 1.234,56 und 31.08.2026 als Zahl und als Datum erkannt.
- Seitenübergreifende Tabellen prüfen
Power Query fügt ähnliche Tabellen auf aufeinanderfolgenden Seiten standardmäßig zusammen. Prüfen Sie trotzdem, ob Kopfzeilen oder Überträge doppelt in den Daten stehen.
- Beim nächsten Mal nur aktualisieren
Liegt die neue PDF im nächsten Monat unter demselben Namen am selben Ort, genügt Daten → Alle aktualisieren. Excel wiederholt dann alle Bereinigungsschritte.
Meldet Excel beim ersten Versuch, dass zusätzliche Komponenten fehlen, braucht der PDF-Import das .NET Framework ab Version 4.5.
Kann Copilot in Excel eine PDF in eine Tabelle umwandeln?
Ja, mit einer Copilot-Lizenz und auf einem anderen Weg als der Import: Copilot liest die PDF und baut die Tabelle selbst auf, statt eine erkannte Tabelle zu übernehmen. Microsoft beschreibt das in seinem Excel-Blog vom 12. August 2026 in drei Schritten: in Excel für das Web eine neue Arbeitsmappe anlegen und den Copilot-Chat öffnen, die PDF über das Plus-Symbol anhängen und um die Umwandlung in eine Tabelle bitten, danach das Tabellenlayout prüfen, bevor Sie Formeln anwenden.
- Wo es laut Microsoft hakt: gescannte oder schlecht lesbare PDFs, kennwortgeschützte, beschädigte oder stark formatierte Dateien. Den Kennwortschutz entfernen Sie vorher.
- Was Copilot anders macht als der Import: Es ordnet Zeilen, Spalten und Überschriften nach eigenem Ermessen. Das hilft bei ungewöhnlichen Layouts, heißt aber auch, dass Sie jede Spalte gegen die PDF halten müssen; eine Summenprobe wie im Abschnitt Prüfen gehört dazu.
- Lizenz und Datenweg: Welche Microsoft-365-Lizenz Copilot in Excel voraussetzt und wann die Verarbeitung außerhalb der EU-Datengrenze stattfindet, steht im Artikel Excel mit KI auswerten.
Was tun bei gescannten PDFs oder auf dem Mac?
Ein Scan braucht zuerst eine Texterkennung, denn er enthält nur ein Bild der Seite; der Excel-Import liest daraus keine Zahlen. Auf dem Mac fehlt der PDF-Import ganz. Drei Wege helfen weiter, der dritte allerdings nur bei PDFs mit Textebene.
Adobe Acrobat
Acrobat erkennt Text in gescannten PDFs und legt eine durchsuchbare Textebene an, auf Wunsch für mehrere Dateien in einem Durchgang. Beim Export nach Excel lassen sich Texterkennung, Sprache sowie Dezimal- und Tausendertrennzeichen einstellen.
- Desktop-App nur mit kostenpflichtiger Acrobat-Version
- Adobe empfiehlt, das Ergebnis der Texterkennung zu prüfen
Excel: Daten aus Bild
In Excel mit Microsoft 365 wandelt die Funktion „Daten aus Bild“ auf der Registerkarte Daten ein Bildschirmfoto oder eine Bilddatei in Zellen um, unter Windows, auf dem Mac und im Web. Deutsch wird unterstützt, und Excel zeigt das Ergebnis vor dem Einfügen zur Korrektur an.
- Unter Windows ab Windows 10 Version 1903
- Das Bild sollte nur die Tabelle zeigen, gerade von vorn aufgenommen
Kopieren und Text in Spalten
Bei kurzen, digital erzeugten Tabellen genügt oft Kopieren und Einfügen. Landet jede Zeile in einer einzigen Zelle, teilt Daten → Text in Spalten sie an Leerzeichen oder Tabstopps auf.
- Funktioniert nur mit Textebene
Sind Online-Konverter ein Datenschutzrisiko?
Ja, sobald die PDF personenbezogene oder vertrauliche Daten enthält. Mit dem Hochladen geben Sie die Datei an einen fremden Anbieter; Speicherdauer, Serverstandort und Zugriffe liegen dann außerhalb Ihrer Kontrolle. Rechnungen, Kontoauszüge und Lohnlisten enthalten fast immer Namen, Bankverbindungen oder Beträge, die sich einer Person zuordnen lassen.
Verarbeitet ein Dienst solche Daten in Ihrem Auftrag, brauchen Sie einen Vertrag zur Auftragsverarbeitung nach Art. 28 DSGVO; was hineingehört, steht unter AV-Vertrag für KI-Werkzeuge. Für Kanzleien, Steuerbüros und Praxen kommt das Berufsgeheimnis nach § 203 StGB hinzu.
- Wer betreibt den Dienst, und in welchem Land stehen die Server?
- Wie lange bleibt die Datei gespeichert? Adobe etwa schreibt zu seinem kostenlosen Werkzeug, dass Dateien ohne Anmeldung nach der Umwandlung gelöscht und mit Anmeldung in der Adobe-Cloud gespeichert werden.
- Können Sie einen AV-Vertrag abschließen, und nutzt der Anbieter Inhalte, um seine Dienste zu verbessern?
- Muss die ganze Datei hoch? Oft genügt ein Auszug ohne Namen. Beim Schwärzen den Text wirklich entfernen; ein schwarzer Balken über der Textebene genügt nicht.
Für Dateien ohne Personenbezug und ohne Geschäftsgeheimnisse, etwa eine öffentliche Preisliste, ist ein Online-Konverter vertretbar.
Eigene Messung: Was kommt ohne Nacharbeit aus zwei Test-PDFs heraus?
Am 24. September 2026 haben wir zwei erfundene Test-PDFs mit Textebene durch vier regelbasierte Werkzeuge geschickt und gezählt, wie viele Tabellenzeilen ohne jede Nacharbeit fertig herauskommen: eine Bestellung mit sechs Positionen und Tabellenlinien und einen zweiseitigen Kontoauszug mit 16 Buchungen ohne Linien, bei dem jede Buchung über drei Zeilen läuft. Als fertig zählte eine Zeile nur, wenn alle sieben Werte eines Datensatzes darin als eigene Zelle standen. Ein Sprachmodell, Excel, Copilot oder Biwak haben wir dabei nicht gemessen.
| Werkzeug | Bestellung (mit Linien) | Kontoauszug (ohne Linien) |
|---|---|---|
| Tabellenerkennung über Linien (pdfplumber 0.11.6, PyMuPDF 1.26.1) | 6 von 6 | 0 von 16; keine Tabelle erkannt |
| Tabellenerkennung über die Ausrichtung des Texts (pdfplumber) | 5 von 6 | 0 von 16; Wörter mitten zerschnitten, 67 von 112 Werten als eigene Zelle |
| Text mit Layout (pdftotext 25.10), Spalten an Leerzeichen getrennt | 6 von 6 | 0 von 16; alle 112 Werte vorhanden, aber über drei Zeilen je Buchung verteilt |
| Eigenes Auswerteskript für genau dieses Layout, mit Saldoprobe | nicht gemessen | 16 von 16; alter Kontostand plus Buchungen ergibt den neuen |
- Linien und eine Zeile je Datensatz machen den Unterschied. Die Bestellung kam bei drei von vier Wegen vollständig heraus, der Kontoauszug bei keinem.
- Fertig wurde der Kontoauszug erst mit einer Regel für sein Layout: drei Zeilen zu einer Buchung zusammensetzen. Diese Arbeit leistet ein Mensch, ein Skript oder ein KI-Agent; an einem anderen Bankformat müsste die Regel neu entstehen.
- Die Saldoprobe schlägt an. Ließen wir die letzte Buchung weg, ging die Rechnung nicht mehr auf. Diese Probe kostet eine Formel und gehört in jede Umwandlung eines Kontoauszugs, egal mit welchem Werkzeug.
- Fachlogik bleibt bei Ihnen: Dass „5 VE à 100“ in der Bestellung 500 Stück bedeutet, erkennt kein Extraktor.
Viele Rechnungen, jede anders aufgebaut: Wann lohnt ein KI-Agent?
Wenn viele PDFs unterschiedlich aufgebaut sind und am Ende eine Tabelle mit immer denselben Spalten stehen soll, etwa die Positionen der Rechnungen von zwanzig Lieferanten. Der Ordner-Import von Excel setzt gleichen Aufbau voraus, und je Lieferant eine eigene Regel zu schreiben wie in unserer Messung lohnt sich selten. Ein KI-Agent liest jede Datei einzeln, ordnet die Werte Ihren Spalten zu und kann dieselbe Probe rechnen wie wir: Summe der Positionen gegen den Rechnungsbetrag.
Lies alle Rechnungen im Ordner „Eingangsrechnungen 2026-08“. Schreibe jede Rechnungsposition als eigene Zeile in positionen-2026-08.csv, mit den Spalten Datei, Seite, Lieferant, Rechnungsnummer, Rechnungsdatum, Bezeichnung, Menge, Einheit, Einzelpreis netto, Gesamtpreis netto und Steuersatz. Addiere je Rechnung die Positionen und vergleiche die Summe mit dem ausgewiesenen Nettobetrag; lege dazu pruefung-2026-08.csv mit einer Zeile je Rechnung an. Rate keine Werte, markiere, was du nicht lesen kannst, und ändere die Originale nicht.
- Eingabe
- PDF-Rechnungen mehrerer Lieferanten mit Textebene, jeder Lieferant mit eigenem Layout
- Ergebnis
- Zwei CSV-Dateien: alle Positionen in einheitlichen Spalten und eine Prüfliste je Rechnung mit Differenz. Unlesbare Stellen sollen darin markiert sein, nicht geschätzt; ob das gelungen ist, zeigt die Prüfung.
- Prüfung
- Stimmt die Zahl der Rechnungen in der Prüfliste mit der Zahl der PDFs überein? Jede Rechnung mit Differenz am Original nachsehen, dazu fünf ohne Differenz als Stichprobe.
So arbeitet auch Biwak, eine Desktop-App mit einem KI-Agenten für Büroaufgaben: Die PDFs liegen in einem Arbeitsordner, das Ergebnis entsteht als CSV-Datei daneben. Für diesen Fall gelten drei Grenzen. Gescannte Seiten ohne Textebene liest Biwak nur als Bild, ohne eigene Texterkennung, und ein Ergebnis sagen wir dafür nicht zu; fertige .xlsx-Dateien sagen wir für die Desktop-App nicht zu; und die verwendeten Inhalte gehen an das Sprachmodell; für Unternehmen gilt dabei Biwaks AV-Vertrag. Den Datenweg beschreibt die Sicherheitsseite, einen Einsatz in der Buchhaltung der Artikel KI in der Buchhaltung. Für Kontoauszüge gibt es eine eigene Seite mit Musterauszug: Kontoauszug in CSV und Excel umwandeln. Für eine einzelne saubere Tabelle ist der Excel-Import schneller.
Wie prüfen Sie die umgewandelte Tabelle?
Prüfen Sie jede umgewandelte Tabelle mindestens an Zeilenzahl, Summen sowie Datums- und Zahlenformat, bevor Sie mit ihr rechnen. Die Liste gilt für jeden der sechs Wege, auch für Copilot und KI-Agenten, die eine Tabelle selbst aufbauen.
- Zeilenzahl: Positionen in der PDF und in Excel zählen, etwa mit
=ANZAHL2(A:A)abzüglich der Kopfzeile. Fehlende Zeilen suchen Sie zuerst an Seitenumbrüchen und in mehrzeiligen Zellen. - Summen: Jede Betragsspalte summieren und mit Summe oder Übertrag in der PDF vergleichen, beim Kontoauszug alter Kontostand plus Buchungen gegen den neuen. In unserer Messung schlug diese Probe an, sobald eine einzige Buchung fehlte; zwei Fehler, die sich aufheben, schließt eine stimmende Summe allerdings nicht aus.
- Tausender- und Dezimaltrennzeichen: Steht 1.234,56 als Zahl in der Zelle, oder ist daraus Text, 1,234 oder ein Datum geworden? Excel liest Zahlen nach den Trennzeichen der Systemeinstellung; abweichende legen Sie unter Datei → Optionen → Erweitert fest.
- Datumsformat: Ein Datum mit einem Tag über 12 prüfen, etwa den 25. eines Monats. Daran sehen Sie, ob Tag und Monat vertauscht wurden.
- Negative Beträge: Gutschriften, Soll und Haben oder ein nachgestelltes Minus wie 120,00- werden leicht zu positiven Zahlen oder zu Text.
- Führende Nullen: Artikel-, Kunden- und Postleitzahlen wie 01067 verlieren die Null, wenn die Spalte als Zahl gelesen wird. Solche Spalten als Text einlesen.
- Kopf- und Fußzeilen: Seitenzahlen, Überträge und wiederholte Spaltenköpfe gehören nicht in die Daten.
Öffnen Sie eine CSV-Datei über Daten → Aus Text/CSV statt per Doppelklick. Beim Doppelklick wendet Excel laut Microsoft-Hilfe zum CSV-Import die aktuellen Standardeinstellungen auf jede Spalte an; im Importdialog wählen Sie Trennzeichen und Datentyp selbst. Wie Sie die fertige Tabelle anschließend auswerten, beschreibt Excel mit KI auswerten.
Häufige Fragen
Kann ich eine PDF kostenlos in Excel umwandeln?
Ja. Der PDF-Import ist in Excel für Windows im Microsoft-365-Abo ohne Zusatzkosten enthalten, und Adobe bietet ein kostenloses Online-Werkzeug an. Für vertrauliche Dateien ist ein kostenloser Online-Dienst aber keine gute Wahl, weil die Datei dafür hochgeladen wird.
Bleibt die Formatierung beim Umwandeln erhalten?
Meist nur teilweise. Eine PDF speichert die Position von Text und Linien, aber keine Tabellenstruktur, deshalb brauchen verbundene Zellen, Zeilenumbrüche in Zellen und Zahlenformate oft Nacharbeit. Für Auswertungen zählen ohnehin die Werte, nicht das Layout.
Wie wandle ich eine gescannte PDF in Excel um?
Der Scan braucht zuerst eine Texterkennung (OCR), zum Beispiel in Adobe Acrobat; danach lässt er sich wie eine digital erzeugte PDF umwandeln. Für einzelne Tabellen reicht in Excel mit Microsoft 365 auch ein Bildschirmfoto und die Funktion „Daten aus Bild“. Prüfen Sie jede Zahl, denn Texterkennung verwechselt einzelne Zeichen.
Warum findet ein Werkzeug in meinem Kontoauszug keine Tabelle?
Oft, weil der Auszug keine Tabellenlinien hat und eine Buchung über mehrere Zeilen läuft. In unserer Messung fanden zwei verbreitete Bibliotheken zur Tabellenerkennung in einem solchen Test-Auszug gar keine Tabelle, bei einer Bestellung mit Linien dagegen alle Positionen. Hilfreich sind dann eine Regel für genau dieses Layout, ein Umsatzexport aus dem Online-Banking statt der PDF, sofern Ihre Bank ihn anbietet, oder ein Werkzeug, das die Tabelle selbst aufbaut, jeweils mit Saldoprobe.
Kann ich mehrere PDFs auf einmal in eine Excel-Tabelle holen?
Ja, wenn alle Dateien gleich aufgebaut sind: Excel für Windows verbindet sie über Daten → Daten abrufen → Aus Datei → Aus Ordner zu einer Tabelle. Bei unterschiedlichen Layouts, etwa Rechnungen verschiedener Lieferanten, hilft ein KI-Agent, der jede Datei liest und in dieselben Spalten schreibt.
Wie kopiere ich eine Tabelle aus einer PDF nach Excel?
Markieren Sie die Tabelle im PDF-Programm, kopieren Sie sie und fügen Sie sie in Excel ein. Landet jede Zeile in einer einzigen Zelle, teilen Sie sie mit Daten → Text in Spalten auf, meist mit Leerzeichen oder Tabstopp als Trennzeichen. Bei mehrseitigen Tabellen sind der PDF-Import in Excel oder der Export aus Acrobat zuverlässiger.
Quellen
- Microsoft Excel Blog: So konvertieren Sie mithilfe von KI eine PDF-Datei in eine Excel-Tabelle, 12. August 2026
- Microsoft Support: Erste Schritte beim Schreiben von Prompts in Microsoft Copilot (Stand Februar 2026)
- Microsoft Support: Importieren von Daten aus Datenquellen (Power Query), Abschnitte PDF und Ordner
- Microsoft Support: Power Query-Datenquellen in Excel-Versionen (PDF nur in Microsoft 365 für Windows)
- Microsoft Learn: Power Query PDF-Konnektor (mehrere Dateien, große PDFs, mehrzeilige Zeilen)
- Microsoft Learn: Pdf.Tables (Option MultiPageTables fügt Tabellen aufeinanderfolgender Seiten standardmäßig zusammen)
- Microsoft Learn: Datentypen in Power Query (Gebietsschema verwenden)
- Microsoft Support: Einfügen von Daten aus einem Bild
- Microsoft Support: Öffnen von PDFs in Word (was bei der Umwandlung verloren geht)
- Adobe Hilfe: Convert PDFs to Microsoft Excel formats (Trennzeichen und Texterkennung beim Export)
- Adobe Hilfe: Recognize text in scanned documents (Texterkennung, auch für mehrere Dateien)
- Adobe: PDF in Excel umwandeln, Onlinetool (Angaben zur Speicherung hochgeladener Dateien)
- Adobe: Acrobat Reader (kostenloser Viewer; Acrobat Standard und Pro sind kostenpflichtig)
- Microsoft Support: Importieren oder Exportieren von Text- und CSV-Dateien
