Dokumente werden zu strukturierten, prüfbaren Daten
OCR, Extraktion, Klassifikation und Validierung in einem durchgängigen Workflow.
Rechnungen, Belege und weitere Dokumente werden per OCR erfasst, in strukturierte Informationen überführt und anschließend klassifiziert, interpretiert und auf Plausibilität geprüft. Unsichere Ergebnisse können gezielt zur manuellen Prüfung weitergegeben werden.
OCR, Extraktion, Klassifikation und Validierung werden in einem durchgängigen Dokumenten-Workflow zusammengeführt.
Ein Dokument enthält mehr als nur Text.
Entscheidend sind strukturierte Informationen wie Rechnungsnummer, Datum, Aussteller, Währung, Beträge oder Dokumenttyp.
Der Document Agent kombiniert OCR mit strukturierter Extraktion und nachgelagerten Prüfungen. So entsteht aus einer Datei ein maschinenlesbares Ergebnis, das in weitere Workflows übernommen werden kann.
Nummer, Datum, Aussteller, Beträge und Währung
Bruttobetrag, Währung und Beleginformationen
Tankstelle, Betrag, Währung und Belegdaten
Hotel-, Reise- und Spesenbelege
Vom Dokument zum verwertbaren Ergebnis
Die Verarbeitung erfolgt in mehreren klar getrennten Stufen. Jede Stufe liefert ein nachvollziehbares Ergebnis für den nächsten Schritt.
Was wird aus dem Dokument gewonnen?
OCR-Text
Inhalte aus PDF-, PNG-, JPEG- und WebP-Dateien werden seitenweise erkannt und normalisiert.
Strukturierte Felder
Relevante Angaben werden anhand des gewählten Dokumentprofils in definierte Felder überführt.
Land & Kontext
Länderinformationen und Dokumentkontext können für nachgelagerte Regeln und Prüfungen herangezogen werden.
Plausibilität
Ergebnisse können auf rechnerische Konsistenz und konfigurierte VAT-Regeln geprüft werden.
Analyse in mehreren Stufen
Dokument erfassen
PDF oder Bild wird hochgeladen und der Dateityp sowie Größenlimits werden geprüft.
Text erkennen
Ein konfigurierter OCR-Provider erkennt den Inhalt und liefert einen normalisierten Text.
Daten interpretieren
Dokumentprofile definieren, welche Felder erwartet und strukturiert extrahiert werden.
Prüfen & weitergeben
Das Ergebnis wird klassifiziert, validiert und abhängig vom Status automatisch weiterverarbeitet oder zur Prüfung markiert.
Ein Ergebnis mit nachvollziehbarem Status
Die Analyse liefert nicht nur Daten, sondern auch einen nachvollziehbaren Verarbeitungsstatus für jede Stufe.
Dadurch kann ein nachgelagerter Workflow unterscheiden, ob ein Dokument automatisch verarbeitet werden kann oder menschliche Prüfung erforderlich ist.
Vom Dokument zum Buchungsentwurf
Erkennen, zuordnen, vorbereitenOCR-Provider werden über eine versionierte Konfiguration angebunden. Dadurch kann die Verarbeitung erweitert werden, ohne dass der eigentliche Workflow neu aufgebaut werden muss.
Rechnung, Beleg oder anderes Geschäftsdokument wird zentral erfasst und für die weitere Verarbeitung bereitgestellt.
OCR liest den Inhalt aus, das Sprachmodell interpretiert Zusammenhänge und bereitet die erkannten Informationen strukturiert auf.
Der Dokumenttyp wird erkannt und beispielsweise als Eingangsrechnung, Gutschrift oder sonstiger Beleg klassifiziert.
Vorhandene Stammdaten werden abgeglichen und der passende Lieferant oder Kunde vorgeschlagen.
Auf Basis von Inhalt, Geschäftspartner und bestehenden Regeln wird eine passende Kostenstelle vorgeschlagen.
Das passende Finanzbuchhaltungskonto wird aus den erkannten Daten und den vorhandenen Zuordnungsregeln abgeleitet.
Die erkannten und zugeordneten Daten werden als vorbereiteter Buchungsentwurf an die integrierte Anwendung übergeben.
Vor der endgültigen Verbuchung prüft und bestätigt ein berechtigter Benutzer den vorgeschlagenen Buchungsvorgang.
Vorteile
OCR, Extraktion und Validierung werden als zusammenhängender Ablauf behandelt.
Statt reinem OCR-Text entstehen definierte, maschinenlesbare Daten.
Unsichere oder unvollständige Ergebnisse können bewusst zur Prüfung weitergegeben werden.
Ergebnisse können direkt weitere Buchhaltungs-, Freigabe- oder Integrationsprozesse anstoßen.
Temporäre Verarbeitung
Hochgeladene Dateien werden temporär verarbeitet und nach der Anfrage wieder entfernt. Dokumentinhalte werden nicht in Logs geschrieben.
Nachvollziehbare Requests
Request-IDs ermöglichen die technische Korrelation von Verarbeitungsschritten, ohne Dokumentinhalte zu protokollieren.
Vom Scan direkt in den Workflow
Ziel ist ein Dokumentenprozess, der Dateien nicht nur liest, sondern daraus belastbare Daten für Folgeprozesse erzeugt – von der Klassifikation bis zur Freigabe oder Übergabe an Buchhaltung und weitere Anwendungen.