EMIL - Embedded Machine Intelligence for linewise
Document Intelligence

Dokumente werden zu strukturierten, prüfbaren Daten

OCR, Extraktion, Klassifikation und Validierung in einem durchgängigen Workflow.

Rechnungen, Belege und weitere Dokumente werden per OCR erfasst, in strukturierte Informationen überführt und anschließend klassifiziert, interpretiert und auf Plausibilität geprüft. Unsichere Ergebnisse können gezielt zur manuellen Prüfung weitergegeben werden.

Coming Soon

OCR, Extraktion, Klassifikation und Validierung werden in einem durchgängigen Dokumenten-Workflow zusammengeführt.

Grundidee

Ein Dokument enthält mehr als nur Text.

Entscheidend sind strukturierte Informationen wie Rechnungsnummer, Datum, Aussteller, Währung, Beträge oder Dokumenttyp.

Der Document Agent kombiniert OCR mit strukturierter Extraktion und nachgelagerten Prüfungen. So entsteht aus einer Datei ein maschinenlesbares Ergebnis, das in weitere Workflows übernommen werden kann.

Rechnungen

Nummer, Datum, Aussteller, Beträge und Währung

Ausgabenbelege

Bruttobetrag, Währung und Beleginformationen

Tankbelege

Tankstelle, Betrag, Währung und Belegdaten

Hotel & Reise

Hotel-, Reise- und Spesenbelege

Verarbeitung

Vom Dokument zum verwertbaren Ergebnis

Die Verarbeitung erfolgt in mehreren klar getrennten Stufen. Jede Stufe liefert ein nachvollziehbares Ergebnis für den nächsten Schritt.

Upload PDF oder Bild
OCR Text erkennen
Extraktion Daten strukturieren
Klassifikation Dokument einordnen
Validierung Plausibilität prüfen
Ergebnis Workflow-ready
Ergebnis

Was wird aus dem Dokument gewonnen?

OCR-Text

Inhalte aus PDF-, PNG-, JPEG- und WebP-Dateien werden seitenweise erkannt und normalisiert.

Strukturierte Felder

Relevante Angaben werden anhand des gewählten Dokumentprofils in definierte Felder überführt.

Land & Kontext

Länderinformationen und Dokumentkontext können für nachgelagerte Regeln und Prüfungen herangezogen werden.

Plausibilität

Ergebnisse können auf rechnerische Konsistenz und konfigurierte VAT-Regeln geprüft werden.

Analyse

Analyse in mehreren Stufen

1

Dokument erfassen

PDF oder Bild wird hochgeladen und der Dateityp sowie Größenlimits werden geprüft.

2

Text erkennen

Ein konfigurierter OCR-Provider erkennt den Inhalt und liefert einen normalisierten Text.

3

Daten interpretieren

Dokumentprofile definieren, welche Felder erwartet und strukturiert extrahiert werden.

4

Prüfen & weitergeben

Das Ergebnis wird klassifiziert, validiert und abhängig vom Status automatisch weiterverarbeitet oder zur Prüfung markiert.

Status

Ein Ergebnis mit nachvollziehbarem Status

Die Analyse liefert nicht nur Daten, sondern auch einen nachvollziehbaren Verarbeitungsstatus für jede Stufe.

OCR ok
Extraction ok
Classification ok
VAT needs_review
Status completed_with_warnings

Dadurch kann ein nachgelagerter Workflow unterscheiden, ob ein Dokument automatisch verarbeitet werden kann oder menschliche Prüfung erforderlich ist.

Vom Dokument zum Buchungsentwurf

Erkennen, zuordnen, vorbereiten

OCR-Provider werden über eine versionierte Konfiguration angebunden. Dadurch kann die Verarbeitung erweitert werden, ohne dass der eigentliche Workflow neu aufgebaut werden muss.

Dokument hochladen

Rechnung, Beleg oder anderes Geschäftsdokument wird zentral erfasst und für die weitere Verarbeitung bereitgestellt.

OCR & LLM-Analyse

OCR liest den Inhalt aus, das Sprachmodell interpretiert Zusammenhänge und bereitet die erkannten Informationen strukturiert auf.

Belegart zuordnen

Der Dokumenttyp wird erkannt und beispielsweise als Eingangsrechnung, Gutschrift oder sonstiger Beleg klassifiziert.

Lieferant oder Kunde

Vorhandene Stammdaten werden abgeglichen und der passende Lieferant oder Kunde vorgeschlagen.

Kostenstelle bestimmen

Auf Basis von Inhalt, Geschäftspartner und bestehenden Regeln wird eine passende Kostenstelle vorgeschlagen.

FiBu-Konto vorschlagen

Das passende Finanzbuchhaltungskonto wird aus den erkannten Daten und den vorhandenen Zuordnungsregeln abgeleitet.

Buchungsentwurf erstellen

Die erkannten und zugeordneten Daten werden als vorbereiteter Buchungsentwurf an die integrierte Anwendung übergeben.

Menschliche Freigabe

Vor der endgültigen Verbuchung prüft und bestätigt ein berechtigter Benutzer den vorgeschlagenen Buchungsvorgang.

Benefits des Ansatzes

Vorteile

Ein durchgängiger Prozess

OCR, Extraktion und Validierung werden als zusammenhängender Ablauf behandelt.

Strukturierte Ergebnisse

Statt reinem OCR-Text entstehen definierte, maschinenlesbare Daten.

Gezielte manuelle Prüfung

Unsichere oder unvollständige Ergebnisse können bewusst zur Prüfung weitergegeben werden.

Workflow-ready

Ergebnisse können direkt weitere Buchhaltungs-, Freigabe- oder Integrationsprozesse anstoßen.

Datenschutz

Temporäre Verarbeitung

Hochgeladene Dateien werden temporär verarbeitet und nach der Anfrage wieder entfernt. Dokumentinhalte werden nicht in Logs geschrieben.

Nachvollziehbarkeit

Nachvollziehbare Requests

Request-IDs ermöglichen die technische Korrelation von Verarbeitungsschritten, ohne Dokumentinhalte zu protokollieren.

Document Workflow

Vom Scan direkt in den Workflow

Ziel ist ein Dokumentenprozess, der Dateien nicht nur liest, sondern daraus belastbare Daten für Folgeprozesse erzeugt – von der Klassifikation bis zur Freigabe oder Übergabe an Buchhaltung und weitere Anwendungen.