Invoice Data Extraction Logo
Invoice Data Extraction
Start Extraction
Pricing
Extraction Guide
API
Sign inCreate account
Sign inCreate account
Start Extraction
Pricing
Extraction Guide
API
  1. Home
  2. Articles & Analysis
  3. Financial Documents
  4. Kassenbon digitalisieren: Daten für Excel auslesen

Kassenbon digitalisieren: Daten für Excel auslesen

So digitalisieren Sie Kassenbons für Excel. Der Leitfaden erklärt Felder, OCR-Prüfung und die Grenze zwischen Extraktion, Archivierung und Buchung.

Published
19. Juli 2026
Updated
19. Juli 2026
Reading Time
8 min
Author
David Harding
Topics:
Financial DocumentsReceiptsGermanyExcelOCRGoBD

On this page

Ein Scan bewahrt zunächst nur das Bild eines Kassenbons. Erst OCR oder KI-Extraktion überführt Händler, Datum, Steuerbeträge und Positionen in strukturierte Spalten für Excel. Archivierung und Buchung sind weitere, getrennte Arbeitsschritte.

Wer einen Kassenbon digitalisieren will, muss deshalb zuerst das gewünschte Ergebnis bestimmen. Ein lesbares Foto reicht aus, um den verblassenden Thermobon bildlich zu sichern. Für eine Summenabstimmung, einen Datenimport oder eine Auswertung braucht die Buchhaltung dagegen einzelne, eindeutig benannte Werte. Eine Tabellenzeile kann dann etwa Händler, Belegdatum, Bonnummer, Netto-, Steuer- und Bruttobetrag enthalten.

Im geschäftlichen Einsatz geht es damit um mehr als die Ablage eines Fotos. Private Bon-Apps konzentrieren sich häufig auf Garantien, Haushaltsausgaben oder Einkaufsanalysen. Buchhalter, Steuerkanzleien und Finanzteams benötigen dagegen prüfbare Daten, die sich dem jeweiligen Belegbild zuordnen lassen.

Der Gesamtprozess besteht aus drei Aufgaben:

  1. Belegbild sichern: Den Kassenbon vollständig und lesbar scannen oder fotografieren.
  2. Daten auslesen: Relevante Angaben in ein festgelegtes Tabellenformat überführen und kontrollieren.
  3. Archivieren oder buchen: Den Ursprungsbeleg ordnungsgemäß aufbewahren und den geprüften Geschäftsvorfall im dafür vorgesehenen System verarbeiten.

Eine Excel-Datei erfüllt nur die mittlere Aufgabe. Sie ersetzt weder den aufbewahrungspflichtigen Beleg noch erzeugt sie automatisch eine Buchung.

Die drei Arbeitsschritte sauber voneinander trennen

Beim ersten Arbeitsschritt entsteht eine digitale Abbildung. Wer einen Kassenzettel digitalisieren möchte, sollte den gesamten Bon erfassen, solange Datum, Händlerangaben und Steuerzeilen noch lesbar sind. Das Bild bleibt der Bezugspunkt für jede spätere Kontrolle. Eine Bilddatei enthält jedoch noch keine verlässlich benannten Spalten, selbst wenn die Schrift am Bildschirm gut zu erkennen ist.

Der zweite Arbeitsschritt macht den Inhalt maschinell nutzbar. OCR erkennt zunächst Zeichen; eine Datenextraktion ordnet die erkannten Angaben zusätzlich einem Schema zu. Aus einer gedruckten Zeile werden dann beispielsweise die Felder Belegdatum, Steuersatz und Steuerbetrag, nicht nur eine unstrukturierte Textfolge. Genau hier ist ein Werkzeug einzuordnen, mit dem sich Kassenbons in strukturierte Daten umwandeln lassen.

Invoice Data Extraction verarbeitet Kassenbons als PDF-, JPG- oder PNG-Dateien, auch in gemischten Stapeln. Die ausgelesenen Felder lassen sich als Excel-, CSV- oder JSON-Datei ausgeben. Diese Funktion ist für Teams relevant, die Quittungen digitalisieren und anschließend Daten abgleichen, importieren oder auswerten wollen. Sie ist keine digitale Belegablage und kein Buchhaltungssystem.

Im dritten Arbeitsschritt wird aus dem geprüften Datensatz ein ordnungsgemäß behandelter Geschäftsvorfall. Dazu können Aufbewahrung, Kontierung, Freigabe, Import und Buchung gehören. Welche Kontrollen und Systeme erforderlich sind, hängt vom jeweiligen Prozess ab. Eine Extraktionsdatei stellt weder automatisch GoBD-Konformität her noch überträgt sie Daten selbstständig an DATEV. Auch Belegkategorisierung und automatische Buchung sind eigenständige Funktionen, die nicht aus einem OCR-Ergebnis folgen.

Das Excel-Schema vor der OCR festlegen

Ein Extraktionslauf ist nur dann brauchbar, wenn vorher feststeht, welche Spalten das Zielsystem benötigt. Für ein Belegregister sind meist folgende Kopfdaten sinnvoll:

  • Händler oder Aussteller
  • Belegdatum und, falls relevant, Uhrzeit
  • Bonnummer
  • Währung und Zahlungsart
  • Bruttobetrag, Nettobetrag und Steuerbetrag je ausgewiesenem Steuersatz
  • Dateiname und Quellseite

Die Quellenfelder gehören bewusst in dieses Schema. Ein auffälliger Wert lässt sich nur zügig prüfen, wenn die zuständige Person direkt zum richtigen Belegbild zurückkehren kann. Bei mehrseitigen PDF-Dateien reicht der Dateiname allein nicht aus; die Seite muss ebenfalls erhalten bleiben.

Eine Zeile pro Bon passt zu Summenabstimmungen, Belegregistern und vielen vorbereitenden Buchhaltungsprozessen. Diese Struktur bleibt kompakt und vermeidet, dass derselbe Gesamtbetrag mehrfach erscheint. Sie reicht aber nicht aus, wenn einzelne gekaufte Artikel analysiert, Kostenarten zugeordnet oder Preisentwicklungen untersucht werden sollen.

Eine Zeile pro Position bildet Artikelbezeichnung, Menge, Einzelpreis, Positionsbetrag und gegebenenfalls den positionsbezogenen Steuersatz separat ab. Händler, Bonnummer, Belegdatum, Währung, Dateiname und Quellseite sollten auf jeder Positionszeile wiederholt werden. Sonst geht beim Sortieren oder Exportieren die Verbindung zwischen Position und Kassenbon verloren.

Mehrere Umsatzsteuersätze erfordern eine ausdrückliche Regel. Auf Belegebene können dafür getrennte Spalten je Steuersatz vorgesehen werden. Auf Positionsebene gehört der zutreffende Steuersatz zur jeweiligen Zeile. Retouren, Pfandrückgaben und andere negative Positionen sollten mit dem auf dem Bon ausgewiesenen Vorzeichen übernommen werden. Eine nachträgliche Vorzeichenkorrektur ohne Bezug zum Original birgt das Risiko, Rückzahlungen als Ausgaben zu behandeln.

Auch leere Felder brauchen eine Bedeutung. Nicht auf dem Bon vorhanden ist etwas anderes als ein tatsächlicher Wert von null. Diese Fälle sollten im Schema unterscheidbar bleiben. Datumsformat, Dezimaltrennzeichen, Währung und Spaltenreihenfolge werden ebenfalls vor dem Lauf festgelegt, damit Folgeprozesse nicht jeden Stapel erneut bereinigen müssen.

Invoice Data Extraction kann solche Vorgaben als benutzerdefinierte Extraktionsanweisung verarbeiten. Darin lassen sich Felder, Spaltennamen, Reihenfolge, eine Zeile pro Beleg oder Position sowie Datenformate festlegen. Excel-Ausgaben verwenden native Datentypen für Zahlen und Datumswerte, sodass Summenformeln und Pivot-Tabellen nicht erst nach einer Textkonvertierung funktionieren.

Das Schema muss außerdem zum Dokumenttyp passen. Rechnungen enthalten beispielsweise andere Identifikations- und Fälligkeitsfelder als Kassenbons. Bei Lieferscheinen verschiebt sich der Schwerpunkt auf Lieferdatum, Lieferscheinnummer, Bestellbezug, Artikel und Mengen; ein eigener Leitfaden erläutert, wie sich Lieferscheine strukturiert digitalisieren und prüfen lassen. Ein Bewirtungsbeleg verlangt zusätzliche Angaben zum geschäftlichen Anlass und zu den bewirteten Personen. Welche zusätzliche Datentiefe dabei erforderlich ist, zeigt der Beitrag „Bewirtungsbelege digitalisieren und auslesen“.

Schlechte Fotos und verblasste Thermobons vorbereiten

Thermopapier verliert mit der Zeit Kontrast. Geschäftliche Bons sollten deshalb erfasst werden, solange Händlername, Datum, Summen und Steuerangaben noch lesbar sind. Ist eine Zahl bereits verschwunden, kann auch eine Bildkorrektur ihren ursprünglichen Inhalt nicht verlässlich wiederherstellen.

Für ein Handyfoto oder einen Scan gelten wenige, aber entscheidende Kriterien:

  • Der Bon ist vom Kopf bis zum Fuß vollständig im Bild.
  • Die Aufnahme ist scharf, kontrastreich und gleichmäßig beleuchtet.
  • Finger, Falten, Reflexionen und Schatten verdecken keine Beträge oder Beschriftungen.
  • Die Kamera befindet sich möglichst parallel zum Papier, damit Zeilen und Spalten nicht stark verzerrt werden.
  • Bei langen Bons ist die Schrift groß genug, um einzelne Ziffern voneinander zu unterscheiden.

Abgeschnittene Ränder sind nicht nur ein optischer Mangel. Fehlt der obere Bereich, gehen womöglich Händler, Anschrift, Datum oder Bonnummer verloren. Im unteren Bereich stehen häufig Zahlungsart, Steuersummen oder der tatsächlich gezahlte Betrag. Beides erschwert die Plausibilitätsprüfung, selbst wenn die einzelnen Positionen gut lesbar sind.

Kontrastanhebung, Drehung und Zuschnitt können ein vorhandenes Zeichen klarer sichtbar machen. Sie sollten jedoch nicht dazu dienen, schwache Zeichen zu erraten oder einen fehlenden Bonteil zu ersetzen. Ist ein buchungsrelevanter Wert nicht eindeutig lesbar, braucht der Fall eine manuelle Klärung oder einen anderen Nachweis.

Wer regelmäßig Belege für die Buchhaltung scannen muss, sollte bereits bei der Dateibenennung an die spätere Kontrolle denken. Eine Kombination aus Eingangsdatum, Mandant oder Kostenstelle und laufender Nummer ist hilfreicher als Dateinamen wie IMG_4837. Zusammengehörige Vorder- und Rückseiten oder Teilaufnahmen eines langen Bons müssen eindeutig gruppiert bleiben. In gemischten Stapeln verhindert diese Ordnung, dass ein Extraktionsergebnis dem falschen Original zugeordnet wird.

OCR-Ergebnisse prüfen, bevor sie in die Buchhaltung gehen

Eine Kassenbon-OCR sollte nicht an einer einzigen Trefferquote beurteilt werden. Entscheidend ist, ob die für den konkreten Prozess relevanten Felder nachvollziehbar ausgelesen wurden und Ausnahmen sichtbar bleiben. Ein falscher Zeitstempel ist für manche Auswertungen unerheblich; ein falsches Vorzeichen oder ein vertauschter Steuerbetrag kann dagegen die Buchung verfälschen.

Die Prüfung beginnt auf Stapel- und Belegebene. Anzahl der Quelldateien, erkannte Kassenbons und ausgegebene Datensätze müssen zusammenpassen. Bei mehrseitigen Dateien oder mehreren Bons in einer PDF ist zusätzlich zu kontrollieren, ob jeder Datensatz auf die richtige Seite verweist. Fehlende oder doppelte Zeilen fallen so auf, bevor die Einzelwerte geprüft werden.

Danach folgen die Felder mit hoher finanzieller Wirkung:

  1. Entspricht der Bruttobetrag dem ausgewiesenen Zahlungsbetrag?
  2. Stimmen Nettobeträge und Steuerbeträge je Steuersatz mit der Gesamtsumme überein?
  3. Sind Datum, Währung und Zahlungsart dem richtigen Bon zugeordnet?
  4. Wurden Retouren, Pfandrückgaben oder Gutschriften mit dem richtigen Vorzeichen erfasst?
  5. Stimmen bei Positionsdaten die Summe der Zeilen und die Bon-Summe plausibel überein?

Mehrere Datumsangaben, schwach gedruckte Ziffern und uneindeutige Steuerzeilen sind keine Einladung zum stillen Schätzen. Der Wert wird gegen das Belegbild kontrolliert. Lässt er sich nicht eindeutig feststellen, bleibt er leer oder wird nach den Regeln des jeweiligen Prozesses als ungeklärt behandelt.

Invoice Data Extraction kann unsichere Einzelwerte mit Review Needed markieren. Die Warnung beschreibt, was zu prüfen ist; Quelldatei und Seitennummer führen zurück zum Originalkontext. In Excel können Warnzellen und auf Wunsch die betroffenen Datenzellen hervorgehoben werden. CSV- und JSON-Ausgaben enthalten den Warnhinweis als Text. Die fachliche Freigabe bleibt bei der zuständigen Person.

Für die Auswahl eines OCR-Werkzeugs zählen daher Feldabdeckung, Quellenbezug, Ausnahmebehandlung und ein prüfbarer Export mehr als ein pauschales Genauigkeitsversprechen. Verwandte Prüfkriterien behandelt der Beitrag „OCR-Software für Rechnungen bewerten“; das Feldschema unterscheidet sich jedoch: Rechnungen benötigen unter anderem Rechnungsnummer, Leistungs- oder Fälligkeitsangaben und Lieferantendaten, während Kassenbons meist Zahlungs- und Positionsdaten in den Vordergrund stellen.

Excel-Export, GoBD-Archiv und Buchung bleiben getrennt

Für OCR-angereicherte Belegbilder enthalten die GoBD eine ausdrückliche Kontrollpflicht. Nach den GoBD müssen per OCR aus Belegbildern gewonnene Informationen verifiziert, bei Bedarf korrigiert und ebenfalls aufbewahrt werden. Diese Anforderung ist in der GoBD-Änderung des Bundesfinanzministeriums vom 14. Juli 2025 festgehalten.

Ein strukturierter Excel-, CSV- oder JSON-Export kann die Kontrolle und Weiterverarbeitung unterstützen. Er ersetzt aber weder den aufbewahrungspflichtigen Ursprungsbeleg noch die Verfahrensdokumentation und den vorgesehenen Archivierungsprozess. Ob ein gesamter Prozess ordnungsgemäß ist, hängt von mehr ab als von der Qualität der Datenextraktion.

Auch die Kontierung und Buchungsfreigabe bleiben eigenständige fachliche Schritte. Dass ein Datensatz technisch in ein Buchhaltungssystem importiert werden kann, bedeutet nicht, dass das richtige Konto, der zutreffende Steuerschlüssel oder die betriebliche Veranlassung bereits geprüft wurden. Eine DATEV-Übergabe oder automatische Buchung setzt eine entsprechende nachgelagerte Lösung und die dort vorgesehenen Kontrollen voraus.

Strukturierte Bon-Daten sollten deshalb erst nach der Gegenkontrolle am Belegbild und der fachlichen Freigabe importiert oder gebucht werden. Ursprungsbeleg, Korrekturen und Prüfnachweis verbleiben im festgelegten Aufbewahrungsprozess.

Extract invoice data to Excel with natural language prompts

Upload your invoices, describe what you need in plain language, and download clean, structured spreadsheets. No templates, no complex configuration.

Exceptional accuracy on financial documents
Parallel processing — large batches complete in minutes
50 free pages every month — no subscription
Any document layout, language, or scan quality
Native Excel types — numbers, dates, currencies
Files encrypted and auto-deleted within 24 hours
Start Extracting FreeView Pricing
Continue Reading

Related Articles

Explore adjacent guides and reference articles on this topic.

Lieferschein digitalisieren: Daten auslesen und prüfen

Lieferscheine digitalisieren und strukturiert auslesen: Felder, Excel-Schema, OCR-Prüfung, Ausnahmen und Aufbewahrung verständlich erklärt.

Bewirtungsbeleg digitalisieren & automatisch auslesen

Bewirtungsbelege digitalisieren: welche Daten die Restaurantrechnung liefert, was der Eigenbeleg ergänzt und wie ein prüfbarer Excel-Export entsteht.

ZUGFeRD in Excel importieren: XML richtig auslesen

So lesen AP-Teams ZUGFeRD-XML aus und importieren Rechnungsnummern, Lieferanten, USt.-Sätze, Summen und Positionen sauber nach Excel.

Back to Articles & Analysis

Invoice Data Extraction

The AI-native automation platform for high-accuracy invoice extraction

Platform

  • Start Extraction
  • Home
  • Pricing
  • API
  • Python SDK
  • Node.js SDK

Solutions

  • Invoice to Excel
  • Invoice OCR Software
  • Bank Statement Converter
  • Receipt OCR
  • Utility Bill Extraction
  • Payroll Data Extraction
  • PDF Data Extraction

Resources

  • Articles
  • Contact

Trust & Security

  • Security
  • Subprocessors
  • AI Data Use

Legal

  • Terms of Service
  • Data Processing Addendum
  • Privacy Policy
  • Refund Policy
  • US State Privacy Rights
  • EEA/UK Privacy Rights
English
Sign inCreate account

© 2026 Invoice Data Extraction — DEH Technologies LLC

Secure by Design. Your data is never used for AI training.