28 Apr.

Document Information Extraction – Workflow


E-Rechnung in Deutschland: So setzen Sie die Pflicht mit SAP Business One um

Document Information Extraction (DIE, deutsch: Dokumenten-Informationsextraktion) bezeichnet den Workflow, strukturierte Daten aus unstrukturierten Belegen — vor allem eingehenden Rechnungen, Lieferscheinen, Verträgen — automatisiert zu gewinnen. Ziel ist, dass eine PDF- oder Bilddatei in SAP Business One nicht nur archiviert, sondern direkt zu Feldern einer Eingangsrechnung wird: Lieferant, Belegnummer, Belegdatum, Steuerbetrag, Nettosumme, Belegzeilen, Bestellreferenz.

Kontext

Ein typischer Workflow läuft in drei Schritten. (1) Erfassung: Belege kommen per Scan, E-Mail (über Outlook-Plugins), SFTP-Download oder Upload durch den Sachbearbeiter. (2) Extraktion: Ein OCR-Dienst liest den Text, ein Layout-Modell oder LLM-Pipeline extrahiert semantisch die Pflichtfelder; für ZUGFeRD-/Factur-X-/XRechnungen wird die eingebettete XML-Nutzlast direkt verwendet, OCR entfällt. (3) Verbuchung: Die extrahierten Daten werden gegen SAP-B1-Geschäftspartner, Bestellungen, Steuerkennzeichen gemappt; bei Abweichungen zwischen Bestellung und Rechnung erfolgt Prüfungsworkflow. Produktseitig stehen für SAP B1 mehrere Wege offen: SAP Document Information Extraction als BTP-Service, SAP Document and Reporting Compliance für E-Rechnung, Drittprodukte wie CKS.DIGITAL 4.0 mit integrierter OCR-Erkennung (die Schlagwörter extrahiert und über Referenzfelder Belege zuordnet), sowie AI-basierte Produkte wie der B1-Helpster mit FIBU-Helper-Komponente, die Kontierungsvorschläge auf Basis extrahierter Felder liefern.

Abgrenzung

Document Information Extraction ist mehr als klassisches OCR: Es liefert strukturierte Felder, nicht nur Rohtext. Es ist auch nicht identisch mit E-Rechnungsempfang — ZUGFeRD- und XRechnung-Belege werden direkt aus der XML-Nutzlast verarbeitet, ohne Extraktion aus einem Bild. Gegenüber einem reinen Dokumentenarchiv (CKS.DMS, d.velop) fokussiert DIE den Weg vom Dokument zum Buchungsbeleg; die reine Archivierung ist ein eigener, ergänzender Schritt. Die Workflow-Qualität hängt stark von Datenmodell, Lieferanten-Varianz und Freigabeprozessen ab — ein 95-%-Automatisierungsgrad ist realistisch erreichbar, aber niemals selbstverständlich.


ReAct und RLEF

ReAct und RLEF: Wie Künstliche Intelligenz aus echten Fehlern lernt — und was der automatische Bankabgleich in SAP Business One damit zu tun hat

Dies ist die vierte Folge einer Reihe auf diesem Blog, die sich mit KI-Grundlagen im Zusammenspiel mit SAP Business One ...
Service Layer KI als transaktionalen Schicht

SAP B1 10.0 FP2608: Service Layer KI als transaktionalen Schicht

Der Service Layer von SAP Business One diente bisher überwiegend als passiver Datenlieferant: Anwendungen fragten Daten über OData ab, jede ...
Process Reward Model

Process Reward Models: Warum ein richtiges Ergebnis noch keinen richtigen Weg beweist

Diese Reihe nimmt fortlaufend einzelne KI-Grundbegriffe und Methoden wie die Process Reward Model unter die Lupe .Die vorige Folge hat ...
Test-Time-Compute-Scaling

Test-Time Compute Scaling: Warum ein kleineres KI-Modell am Ende gewinnen kann — und was der Lieferantenvergleich in SAP Business One damit zu tun hat

Dies ist eine Fortsetzung der Reihe auf diesem Blog, die sich mit Künstlicher Intelligenz im Zusammenspiel mit SAP Business One ...
RLHF

RLHF und Reward-Modelle: KI-Hype oder was der Genehmigungsprozess in SAP Business One damit zu tun hat

Key Takeaways Der Beitrag behandelt die Anwendung von Künstlicher Intelligenz im Zusammenhang mit SAP Business One und grundlegenden KI-Themen. Dank ...
AI WEBINAR

KI – Antworten aus SAP Business One – ohne SQL, ohne IT-Ticket

Live-Webinar am 30. Juli 2026, 14:00–14:30 Uhr | Live-Demo über Microsoft Teams | Dauer: 30 Minuten „Wie war der Umsatz ...
Wird geladen …