KI Lösung

KI Dokumentenverarbeitung

KI Dokumentenverarbeitung ist ein Ablauf, der die Angaben in Rechnungen, Lieferscheinen, Verträgen, Antragsformularen und E-Mail Anhängen liest, in Felder zerlegt und in das richtige System schreibt. Wir richten sie nicht als einzelnes OCR Werkzeug ein, sondern als Prozess mit Auslesen, Prüfung, Freigabe durch Menschen und lückenlosem Protokoll.

Rechnungen und Lieferscheine erfassenDokumente klassifizierenKonfidenzwert je FeldPrüfung durch MenschenAnbindung an ERP und Buchhaltung
  • Google Partner
  • Talha Aslan und Team
  • Deutsch, Englisch, Türkisch

Kurz gesagt

KI Dokumentenverarbeitung macht aus gescannten, fotografierten oder als PDF eingehenden Dokumenten Einträge in Buchhaltung, ERP oder CRM, indem sie Datum, Betrag, Lieferant, Positionen und weitere Felder ausliest. Ein gut gebauter Ablauf vergibt für jedes Feld einen Konfidenzwert, gleicht Werte mit Regeln ab, gibt unsichere Belege an einen Menschen weiter und lässt die Originaldatei unverändert. Strukturierte elektronische Rechnungen werden direkt eingelesen, ganz ohne KI.

Talha Aslan und TeamZuletzt aktualisiert:

Wann sie sinnvoll ist

Ab wann braucht Papierkram Automatisierung?

Für ein Team, das nur einige Belege im Monat bearbeitet, kostet ein KI Ablauf mehr Aufwand, als er spart. Kommen Ihre Rechnungen größtenteils schon strukturiert als XRechnung oder ZUGFeRD an, werden zuerst diese Daten direkt übernommen. Kommen Ihnen die folgenden Situationen bekannt vor, lohnt sich ein Blick auf die Automatisierung.

Die Datenerfassung bremst den Monatsabschluss

Eingangsrechnungen, Quittungen und Lieferscheine werden aus dem Postfach geladen, einzeln geöffnet und von Hand in die Buchhaltung getippt. Die Abschlusswoche geht dafür drauf, für Kontrolle und Auswertung bleibt kaum Zeit.

Dieselben Daten werden doppelt getippt und doppelt falsch

Der Betrag aus dem Angebot wandert in den Auftrag, die Adresse aus dem Auftrag in die Versandpapiere. Verrutscht eine Zahl, bemerkt es oft zuerst der Kunde oder der Lieferant.

Vorlagenbasierte OCR scheitert an neuen Layouts

Werkzeuge, die feste Koordinaten auslesen, funktionieren nur bei bekannten Layouts. Ein neuer Lieferant, ein anderes Rechnungsbild oder ein schief fotografierter Beleg bringt die Felder durcheinander, und korrigiert wird wieder von Hand.

Dokumente sind nicht auffindbar, wenn man sie braucht

Verträge, Anträge und Schriftverkehr liegen verstreut in Ordnern und Postfächern. Fragt jemand nach einer Verlängerungsfrist oder einer bestimmten Klausel, wird jede Datei von vorn gelesen.

Unser Ansatz

Ein Belegablauf, der liest, gegenprüft und bei Unsicherheit nachfragt

Wir beginnen mit Ihrem Dokumentenbestand, nicht mit Software. Anhand echter Belege der letzten Monate halten wir fest, welche Dokumenttypen über welchen Kanal eingehen, welche Felder jeweils gebraucht werden und in welches System sie gehören. Dieselben Belege bilden den Testsatz, mit dem wir die Genauigkeit messen.

Der Ablauf erkennt zuerst den Dokumenttyp und liest die Felder dann mit einem Modell aus, das Bild und Text gemeinsam versteht, oder mit einem Lesedienst wie Google Document AI oder Azure AI Document Intelligence. Anschließend werden die Werte gegen Regeln geprüft: Stimmen die Summen, hat die Umsatzsteuer ID ein gültiges Format, wurde diese Rechnung schon verarbeitet. Belege mit niedriger Konfidenz oder verletzter Regel landen in der Freigabeansicht, saubere gehen direkt in Buchhaltung, ERP oder CRM. Aufbau und Pflege laufen im Rahmen unserer KI Automatisierung.

Dokumente kommen oft über ein Formular oder Portal, in das Kunden Dateien hochladen. Brauchen Ihre Kunden einen Bereich zum Hochladen, bauen wir auf einer Website mit Mitgliederbereich auf; braucht Ihr Team ein eigenes internes Dashboard, setzen wir das über die individuelle Softwareentwicklung um.

  • Der Dokumenttyp wird vor dem Auslesen erkannt
  • Konfidenzwert und Regelprüfung für jedes Feld
  • Belege unter der Schwelle kommen in die Freigabeliste
  • Strukturierte Daten wie XRechnung werden direkt übernommen
  • Originale bleiben unverändert, jeder Schritt wird protokolliert
Aufbau eines Ablaufs zur Dokumentenverarbeitung
  1. BelegeingangE-Mail Anhang, Scan, Foto oder Upload Formular
  2. KlassifizierungRechnung, Lieferschein, Vertrag, Antrag
  3. FeldextraktionDatum, Betrag, Lieferant, Positionen, mit Konfidenz
  4. RegelprüfungSummen, Steuernummern, Dubletten
  5. FreigabelisteBelege unter der Schwelle gehen an einen Menschen
  6. Übergabe an Ihre SystemeBuchung in Buchhaltung, ERP oder CRM mit Protokoll

Jeder Schritt hinterlässt eine Spur: Mit welcher Modellversion ein Beleg gelesen wurde, wer ihn freigegeben hat und zu welcher Buchung er wurde, lässt sich später nachvollziehen.

Welcher Ablauf?

Dokumenttyp und Ziel bestimmen den Aufbau

Rechnungen auslesen und Verträge prüfen sind verschiedene Aufgaben; deshalb wählen wir zuerst den Dokumenttyp, der Ihr Team am meisten Zeit kostet.

Buchhaltung und Einkauf

Erfassung von Rechnungen, Quittungen und Lieferscheinen

Liest Felder aus Eingangsrechnungen und Spesenbelegen, gleicht sie mit Bestellungen ab und bereitet die Buchung vor.

  • XRechnung direkt, PDF und Fotos über das Modell
  • Abgleich mit Bestellung und Lieferschein
  • Freigabeliste bei abweichenden Beträgen

Betrieb und Kundenaufnahme

Anträge und zugehörige Unterlagen

Ordnet Anträge, Erklärungen und Anhänge, die Kunden hochladen, erkennt fehlende Unterlagen und sorgt für eine vollständige Akte.

  • Liste fehlender Unterlagen je Dokumenttyp
  • Entwurf für die Nachforderung
  • Engerer Zugriff bei besonderen Datenkategorien

Recht und Verwaltung

Zusammenfassung von Verträgen und Schriftverkehr

Liest Vertragsparteien, Laufzeit, Verlängerungs und Kündigungsfristen aus und trägt sie in Kalender und Vertragsliste ein.

  • Zusammenfassung je Klausel mit Quelle
  • Erinnerung vor Ablauf der Kündigungsfrist
  • Nur Extraktion; die Bewertung bleibt bei der Rechtsberatung

Das gehört dazu

Die Bausteine eines verlässlichen Belegablaufs

Diese Punkte legen fest, wo der Ablauf Fehler abfängt und wie er die personenbezogenen Daten in Ihren Dokumenten schützt.

Zuerst strukturierte Daten

Nach den Angaben des Bundesfinanzministeriums müssen inländische Unternehmen seit dem 1. Januar 2025 elektronische Rechnungen empfangen können, und ein einfaches PDF gilt nicht als solche, weil es kein strukturiertes Format hat. XRechnung und ZUGFeRD lesen wir deshalb direkt ein; KI setzen wir nur für Papier, Scans und einfache PDF ein.

Konfidenzschwelle und Regelprüfung

Das Modell liefert für jedes Feld einen Wert, kann aber nicht beweisen, dass er stimmt. Regeln wie stimmige Summen, Datums und Steuernummernformate sowie die Prüfung auf doppelte Rechnungen laufen bei jedem Beleg; was die Schwelle nicht erreicht, wird nicht ohne Freigabe gebucht.

Eigener Weg für besondere Datenkategorien

Artikel 9 DSGVO zählt Gesundheitsdaten, genetische und biometrische Daten zu den besonderen Kategorien, Artikel 10 regelt Daten über strafrechtliche Verurteilungen. Dokumente mit solchen Angaben laufen in einem eigenen Ablauf mit engerem Zugriff; bei Bedarf arbeitet das Modell auf Ihrem eigenen Server.

Keine rein automatisierten Entscheidungen

Artikel 22 DSGVO gibt Betroffenen das Recht, keiner ausschließlich automatisierten Entscheidung mit erheblicher Wirkung unterworfen zu werden, und die KI Verordnung der EU führt KI für Personalauswahl und Kreditwürdigkeitsprüfung in Anhang III als hochriskant. Ablehnung eines Antrags oder Stopp einer Zahlung bleiben deshalb immer bei einem Menschen.

Übermittlung in Drittländer

Sitzt der Lesedienst außerhalb von EU und EWR, verlassen die Dokumentinhalte diesen Raum. Kapitel V der DSGVO verlangt dann einen Angemessenheitsbeschluss oder geeignete Schutzmaßnahmen wie Standardvertragsklauseln, und der Anbieter schließt einen Auftragsverarbeitungsvertrag nach Artikel 28. Die abschließende Bewertung trifft Ihre Rechtsberatung.

Originaldatei und Protokoll

Der Quellbeleg wird nie überschrieben; die ausgelesenen Daten werden getrennt gespeichert, zusammen mit Modellversion und freigebender Person. Wird eine Buchung hinterfragt, lässt sich zeigen, aus welchem Beleg sie stammt und wie sie entstand, und sie kann zurückgenommen werden.

Quellen: Bundesfinanzministerium: FAQ zur E-Rechnung · Datenschutz Grundverordnung (2016/679), Artikel 9, 10, 22 und 28, EUR-Lex · KI Verordnung der EU (2024/1689), Anhang III, EUR-Lex

Vergleich

Vorlagenbasierte OCR oder KI Dokumentenverarbeitung?

ThemaVorlagenbasierte OCRKI gestützter Ablauf
Neue LayoutsFür jedes Layout eine neue VorlageWird mit Beispielen angelernt, ohne Vorlage
Was gelesen wirdDer Text auf der SeiteText, Tabellen und die Bedeutung jedes Feldes
Fehler erkennenLesefehler landen in der BuchungKonfidenzwerte und Regelprüfung
Unklare BelegeFelder bleiben stillschweigend leerGehen in die Freigabeliste
Kosten je BelegNiedrig und festAbhängig von der Modellnutzung
EinrichtungSchnell, für ein LayoutBestandsaufnahme, Testsatz und Pilot

Schnellcheck

Funktionen der Dokumentenverarbeitung

Unverzichtbar: Ist Ihr Ablauf bereit?

0 von 6 vorhanden Haken Sie ab, was vorhanden ist, und sehen Sie, wie bereit Sie für Automatisierung sind.

Nach Bedarf

  • Einlesen von XRechnung und ZUGFeRD
  • Abgleich mit Bestellungen und Lieferscheinen
  • Handschrift und schwache Scans
  • Dokumente in mehreren Sprachen
  • Modell auf Ihrem eigenen Server
  • Wöchentlicher Genauigkeitsbericht

Welche dieser Punkte Sie brauchen, legen wir im Erstgespräch gemeinsam fest.

Beginnen wir mit dem Dokumenttyp, der Sie am meisten Zeit kostet

Schicken Sie uns zehn bis zwanzig anonymisierte Beispiele eines Dokumenttyps und nennen Sie das Zielsystem; wir legen Felder, Freigaberegeln und ein schriftliches Angebot fest.

Ablauf

Von der Analyse zum Livebetrieb in vier Schritten

  1. Erstgespräch und Analyse

    In einem kostenlosen Gespräch von 15 Minuten hören wir uns Ihre Abläufe an. Danach erfasst die Analyse Tools und Aufgaben, bewertet die Chancen und endet mit Umfang und Honorar zur schriftlichen Freigabe.

  2. Aufbau und Tests

    Den ersten Workflow bauen wir in Ihren Konten und testen ihn mit echten, aber maskierten Beispielen. Freigabeschritte, Fehlerszenarien und Alarme stehen, bevor irgendetwas einen Kunden erreicht.

  3. Start und Feinschliff

    Wir schalten den Workflow schrittweise live, beobachten die Logs und stimmen Schwellenwerte mit Ihrem Team ab. Sie erhalten Dokumentation und eine kurze Schulung.

  4. Monitoring und Ausbau

    Im Monatsplan überwachen wir laufende Workflows, passen sie an Änderungen bei Modellen und APIs an und ergänzen neue Abläufe aus der Prioritätenliste, mit Monatsbericht.

Kostenlose Tools

Bereiten Sie Ihren Belegablauf mit kostenlosen Tools vor

Prüfen Sie die Umsatzsteuer in Rechnungsbeträgen, rechnen Sie Fremdwährungsrechnungen um, ermitteln Sie Fälligkeiten, erzeugen Sie Hashwerte gegen doppelte Dateien, messen Sie die Stunden für manuelle Erfassung und erstellen Sie sichere Passwörter für neue Konten.

Finanzen

MwSt.-Rechner

MwSt. aufschlagen und korrekt herausrechnen; 19%, 7% + eigener Satz.

Währung

Währungsrechner

Rechnen Sie Euro und 30 Währungen mit den offiziellen EZB Referenzkursen um, auch für jedes vergangene Datum seit 1999.

Rechner

Tage Rechner

Tage, Wochen und Arbeitstage zwischen Daten; zu Datum addieren/subtrahieren.

Sicherheit

Hash Generator

Berechnet MD5, SHA1, SHA256 und SHA512 Hashwerte von Texten und Dateien direkt im Browser und prüft Downloads anhand der Prüfsumme. Es wird nichts hochgeladen.

Arbeit

Arbeitszeitrechner

Berechnen Sie Ihre Arbeitszeit mit Pause pro Tag und Woche, auch in Dezimalstunden, und prüfen Sie Pausen nach dem Arbeitszeitgesetz.

Sicherheit

Passwort Generator

Kryptografisch zufällige starke Passwörter + Stärkeanzeige + Knackzeit.

Alle kostenlosen Tools

So arbeiten wir

Wir starten mit einem Dokumenttyp und erweitern auf Grundlage von Messwerten

Ein veröffentlichtes Kundenprojekt zur KI Dokumentenverarbeitung, das wir als Referenz zeigen können, haben wir noch nicht; deshalb beschreiben wir statt Ergebnissen unsere Methode. Unsere Projekte in Automatisierung, Software und Web finden Sie auf der Referenzseite.

Zuerst echte Belege

Vor dem Aufbau stellen wir aus Ihren jüngsten Dokumenten einen anonymisierten Beispielsatz zusammen; an ihm wird die Genauigkeit gemessen.

Schattenbetrieb

In den ersten Wochen läuft der Ablauf parallel zu Ihrem Team, bucht nichts und zeigt nur seine Ergebnisse. Live geht er, sobald die Liste der Abweichungen geklärt ist.

Austauschbare Leseschicht

Wechselt das Modell oder der Lesedienst, bleiben Regeln, Freigabeansicht und Anbindungen bestehen; die neue Schicht wird mit demselben Testsatz erneut gemessen.

Konten und Regeln bleiben bei Ihnen

Konten für Modell, Lesedienst und Automatisierung laufen auf Ihr Unternehmen; Felddefinitionen, Regeln und Dokumentation werden Ihnen übergeben.

Alle Referenzen

Häufige Fragen

Häufige Fragen zur KI Dokumentenverarbeitung

Ihre Frage ist nicht dabei? Schreiben Sie uns; Sie erhalten eine Antwort und ein schriftliches Angebot.

Nächster Schritt

Planen wir Ihren ersten Belegablauf

Nennen Sie uns die Dokumente, mit denen Sie arbeiten, das ungefähre Monatsvolumen und das Zielsystem; nach einem kostenlosen 15 Minuten Gespräch senden wir Umfang und schriftliches Angebot.

Ausführlicher Ratgeber

KI Dokumentenverarbeitung: vom Belegbestand zur freigegebenen Buchung

Talha Aslan und TeamZuletzt aktualisiert: 14 Min. Lesezeit

Ob ein Projekt zur Belegautomatisierung trägt, entscheidet sich meist lange vor der Wahl des Modells: an der Frage, mit welchem Dokumenttyp man beginnt, welche Felder Pflicht sind, welche Regel eine Buchung anhält und wer auf die Freigabeansicht schaut. Dieser Leitfaden ordnet diese Entscheidungen in der Reihenfolge, in der sie bei der Planung einer KI Dokumentenverarbeitung anfallen.

Er ist als Arbeitsliste gedacht, nicht als Prospekt: mit Kriterien, die Sie jedem Anbieter vorlegen können, Vorbereitungen mit Ihren eigenen Belegen und den Fällen, in denen sich Automatisierung schlicht nicht lohnt. Fachbegriffe werden beim ersten Auftreten kurz erklärt.

Eignung mit einer Bestandsaufnahme prüfen

Ob sich Automatisierung für Sie lohnt, zeigt erst eine Zählung der Belege, die in den letzten drei Monaten tatsächlich eingegangen sind; Entscheidungen aus dem Bauch enden oft in einem überflüssigen oder halbfertigen Projekt. Gehen Sie eine Woche lang Ordner, Postfächer und Scannerausgaben durch und füllen Sie eine einfache Tabelle.

  • Typ und Herkunft: Eingangsrechnung, Spesenbeleg, Lieferschein, Vertrag oder Antrag, jeweils mit Kanal und Absender.
  • Menge und Verteilung: Kommen die Belege gleichmäßig über den Monat oder stauen sie sich in der Abschlusswoche.
  • Vielfalt der Layouts: Wie viele Lieferanten oder Vorlagen es pro Typ gibt; ein großer Lieferant oder Hunderte kleiner Absender.
  • Manueller Aufwand: Wie viele Minuten Öffnen, Prüfen und Erfassen eines Belegs im Schnitt dauern.
  • Folgen eines Fehlers: Wann ein falscher Betrag auffällt, wem und wie aufwendig die Korrektur ist.

Gegen Automatisierung spricht die Tabelle in drei Fällen: bei geringer Menge, wenn die meisten Rechnungen bereits strukturiert als XRechnung oder ZUGFeRD eingehen, oder wenn jeder Dokumenttyp nur wenige Male im Jahr auftaucht. Dann bringen die Importfunktion Ihrer Buchhaltungssoftware und eine saubere Ordnerstruktur dieselbe Entlastung mit weniger Aufwand. Bremst dagegen ein Dokumenttyp mit ständig wechselnden Layouts jeden Abschluss, haben Sie den Kandidaten für den ersten Ablauf gefunden.

Der erste Ablauf je nach Unternehmensart

Beginnen Sie mit dem Dokumenttyp, der Ihr Team am meisten Zeit kostet und dessen Fehler am teuersten sind; alles gleichzeitig zu automatisieren macht jede Messung unmöglich. In der Praxis sieht der Kandidat oft so aus:

  • Großhandel und Vertrieb: Eingangsrechnungen und Lieferscheine vieler Lieferanten; erstes Ziel ist der Abgleich mit den Bestellpositionen.
  • Spedition und Logistik: Abliefernachweise, Fotos unterschriebener Lieferscheine und Zollunterlagen; erstes Ziel ist die Zuordnung zu Sendung und Kunde.
  • Steuerkanzlei und Buchhaltungsbüro: Quittungen, Rechnungen und Kontoauszüge, die Mandanten ungeordnet schicken; erstes Ziel ist die Sortierung nach Mandant und Zeitraum.
  • Versicherungsmakler und Schadenregulierung: Gutachten, Fahrzeugpapiere und Werkstattrechnungen zu einem Schadenfall; erstes Ziel ist eine Liste fehlender Unterlagen.
  • Projekt und Dienstleistungsgeschäft: Kunden und Lieferantenverträge; erstes Ziel ist ein Register mit Parteien, Laufzeit, Verlängerung und Kündigungsfristen.

Eine Kanzlei, die Belege von Mandanten sammelt, sollte vor der KI Dokumentenverarbeitung dafür sorgen, dass alles über einen Kanal eingeht; ein geschützter Uploadbereich auf einer Website für Steuerkanzleien ist dafür ein guter Anfang. Der zuerst gewählte Typ wird zur Vorlage: Freigabeansicht, Protokoll und Messtabelle werden beim zweiten Typ wiederverwendet.

Die Architektur in sieben Schichten

Ein belastbarer Belegablauf besteht aus getrennten Schichten, die sich jeweils einzeln testen lassen. Bitten Sie jeden Anbieter, sie der Reihe nach zu erklären; der Satz „die KI liest und bucht“ beschreibt ein System, in dem sich Fehler nicht zurückverfolgen lassen.

  • Eingang: Postfach, Netzlaufwerk, Scanner oder Upload Formular werden überwacht; jede Datei erhält eine eindeutige Kennung, das Original wird in einen unveränderlichen Speicher kopiert.
  • Vorbereitung: Mehrseitige Scans werden in einzelne Belege getrennt, schiefe Bilder gerade gerückt, Leerseiten entfernt.
  • Klassifizierung: Der Dokumenttyp wird bestimmt, denn Rechnung, Lieferschein und Vertrag folgen unterschiedlichen Feldschemata.
  • Extraktion: OCR (optische Zeichenerkennung, also die Umwandlung von Bildzeichen in Text) und das Modell darüber benennen die Felder und vergeben je Feld einen Konfidenzwert.
  • Prüfung: Regeln zu Summen, Formaten, Dubletten und Bestellabgleich laufen.
  • Freigabe: Ein Beleg mit verletzter Regel oder zu niedrigem Wert landet bei einem Menschen.
  • Übergabe: Die freigegebene Buchung geht ins Zielsystem und bleibt mit ihrer Quelldatei verknüpft.

Der größte Nutzen dieser Trennung ist Austauschbarkeit: Wechselt der Lesedienst, wird nur die Extraktion neu gemessen, während Regeln, Freigabeansicht und Anbindung bestehen bleiben.

Strukturierte Rechnungen nicht als Bild lesen

Strukturierte Belege durch ein KI Modell zu schicken, kostet Geld und schafft Fehlerquellen ohne jeden Gewinn. XRechnung, ZUGFeRD und andere Rechnungen nach der europäischen Norm EN 16931 enthalten Beträge, Steuer und Positionen bereits als getrennte Felder, die Ihre Buchhaltungssoftware direkt übernehmen kann.

Nach den Angaben des Bundesfinanzministeriums müssen inländische Unternehmen seit dem 1. Januar 2025 elektronische Rechnungen empfangen können, und ein einfaches PDF gilt nicht als solche. Verwirrung entsteht, wenn ein Lieferant zusätzlich eine PDF Ansicht mailt und das Team sie als eigenen Beleg bearbeitet. Jedes eingehende PDF sollte deshalb diesen Weg nehmen:

  • Zuerst nach der strukturierten Datei suchen: Liegt dieselbe Rechnungsnummer als XML im Rechnungseingang, gilt das PDF als Sichtkopie und wird nicht gelesen.
  • Dann verknüpfen: Gehören PDF und XML zur selben Rechnung, entsteht die Buchung aus dem XML, das PDF wird archiviert.
  • Erst zuletzt ans Modell: Nur Papier, Scans, Fotos und einfache PDF ohne strukturiertes Gegenstück gehen in die Leseschicht.

Diese Trennung wirkt doppelt. Das Modell liest weniger Belege, die Nutzungskosten sinken, und dieselbe Rechnung kann nicht zweimal gebucht werden, einmal aus dem XML und einmal aus dem PDF. Für das Modell bleiben vor allem Belege ausländischer Lieferanten, Quittungen und Papierpost.

Feldschema und Plausibilitätsregeln

Das Feldschema ist die schriftliche Liste, welche Angaben aus welchem Dokumenttyp in welchem Format ausgelesen werden; es ist der Vertrag des gesamten Ablaufs. Fehlt es, liefert das Modell jedes Mal eine leicht andere Ausgabe, und das Zielsystem nimmt die Abweichung stillschweigend hin. Für jedes Feld werden Name, Datentyp, Pflicht oder optional und Standardformat festgelegt: ein Datumsformat, ein Dezimaltrennzeichen, die Währung als internationaler Code aus drei Buchstaben.

Danach folgen die Plausibilitätsregeln je Dokumenttyp. Ein typischer Startsatz für Rechnungen:

  • Rechnerische Prüfung: Die Positionen ergeben den Nettobetrag, Nettobetrag mal Steuersatz ergibt die Umsatzsteuer, beides zusammen den Bruttobetrag.
  • Format der Kennungen: Eine deutsche Umsatzsteuer Identifikationsnummer besteht aus DE und neun Ziffern, eine Schweizer UID aus CHE und neun Ziffern; EU Nummern lassen sich zusätzlich über den VIES Dienst der Europäischen Kommission prüfen.
  • Datumslogik: Ein Rechnungsdatum liegt nicht in der Zukunft, ein Fälligkeitsdatum nicht vor dem Rechnungsdatum.
  • Dubletten: Wurden Absender, Rechnungsnummer und Betrag schon einmal gebucht, wird der Beleg angehalten.
  • Dreiwegeabgleich: Menge und Preis werden mit Bestellung und Lieferschein verglichen; Abweichungen über Ihrer Toleranz gehen in die Freigabe.

Um dieselbe Datei unter anderem Namen zu erkennen, vergleichen Sie Hashwerte, also Fingerabdrücke fester Länge, die aus dem Dateiinhalt berechnet werden; ausprobieren lässt sich das mit unserem Hash Generator.

Eingangskanäle und Anbindung der Zielsysteme

Eingang und Ausgang eines Belegablaufs sind so wichtig wie die Leseschicht; kann das Zielsystem keine Buchungen annehmen, hilft auch ein genaues Modell wenig. Legen Sie für jeden Eingangskanal fest, wer Belege senden darf, welche Dateitypen angenommen werden und wie groß eine Datei sein darf.

Auf der Ausgangsseite lautet die erste Frage, wie das Zielsystem Daten aufnimmt. Buchhaltungssoftware, ERP und CRM werden meist auf einem von drei Wegen beliefert:

  • Dokumentierte API: Die Buchung entsteht sofort, Fehlermeldungen fließen in die Freigabeliste zurück.
  • Importdatei: Freigegebene Buchungen werden in festen Abständen als Datei übergeben, etwa im Buchungsstapelformat Ihrer Kanzleisoftware; langsamer, aber oft der sicherste Weg.
  • Zwischentabelle: Der Ablauf schreibt in eine eigene Datenbank, das Zielsystem liest sie aus; der letzte Ausweg bei geschlossenen Altsystemen.

Zwei Regeln gelten immer. Erstens darf ein erneut gesendeter Datensatz keine zweite Buchung erzeugen; ein Wiederholungsversuch nach einem Netzausfall darf keine doppelte Rechnung hervorbringen. Zweitens darf der Ablauf ein Sachkonto vorschlagen, es in den ersten Monaten aber nicht festschreiben; der Vorschlag erscheint in der Freigabeansicht, entscheiden wird in der Buchhaltung. Hat das Zielsystem gar keine Schnittstelle, wird ein kleiner Vermittlungsdienst im Rahmen der individuellen Softwareentwicklung geplant.

Modellwahl und Betrieb der Leseschicht

Für die Leseschicht gibt es drei Hauptoptionen, und entscheiden sollte Ihr eigener Testsatz, nicht die Produktseite des Anbieters. Fertige Lesedienste bieten einen schnellen Start bei verbreiteten Typen wie Rechnungen und Quittungen; allgemeine Modelle, die Bild und Text gemeinsam verstehen, kommen mit wechselnden Layouts und Freitext besser zurecht; offene Modelle auf Ihrem eigenen Server halten die Daten im Haus.

Vergleichen Sie sie auf demselben Testsatz nach diesen Kriterien:

  • Zeichengenauigkeit: Werden Umlaute, ß und Sonderzeichen in Firmennamen und Anschriften korrekt gelesen.
  • Tabellen über Seitenumbrüche: Wird eine durch einen Umbruch geteilte Positionstabelle wieder zu einer Tabelle zusammengeführt.
  • Aussagekraft der Konfidenz: Enthalten hoch bewertete Felder wirklich weniger Fehler; ohne diesen Zusammenhang ist jede Schwelle wertlos.
  • Feste Modellversion: Lässt sich eine Version festschreiben, und wie früh kündigt der Anbieter ihre Abschaltung an.
  • Datenbedingungen: Werden Belege zum Training genutzt, wie lange gespeichert und in welcher Region verarbeitet.

Für Unternehmen mit ärztlichen Bescheinigungen oder Ausweisdokumenten ist eine lokale LLM Installation eine ernsthafte Option, wobei Hardware, Updates und Sicherheit dann bei Ihnen liegen. Viele Unternehmen wählen eine Mischform: sensible Typen lokal, alles andere bei einem Clouddienst mit geprüftem Vertrag.

Freigabeansicht, Schwellenwerte und Protokoll

In der Freigabeansicht verbringen Menschen bei der KI Dokumentenverarbeitung die meiste Zeit; ist sie schlecht gestaltet, geht die gewonnene Zeit hier wieder verloren. Eine gute Ansicht zeigt Belegbild und ausgelesene Felder nebeneinander, markiert die Stelle, an der jeder Wert gelesen wurde, und hebt nur zweifelhafte Felder farbig hervor. Geprüft werden die markierten Felder, nicht der ganze Beleg.

Schwellenwerte werden je Feld festgelegt, nicht als eine einzige Zahl. Ein kleiner Lesefehler im Lieferantennamen korrigiert sich beim Abgleich mit den Stammdaten meist von selbst, eine falsche Ziffer im Bruttobetrag dagegen kostet Geld. Beträge und Steuerkennungen erhalten deshalb strenge, Beschreibungsfelder lockerere Schwellen. Ab einem bestimmten Rechnungsbetrag kann unabhängig vom Wert eine zweite Freigabe nach dem Vieraugenprinzip verlangt werden.

Das Protokoll je Beleg enthält mindestens:

  • Eingangszeit, Kanal und Hashwert der Datei.
  • Den verwendeten Lesedienst oder das Modell samt Version.
  • Für jedes Feld den ersten Wert, den Konfidenzwert und gegebenenfalls die Korrektur.
  • Wer freigegeben oder abgelehnt hat, wann und mit welcher Begründung.
  • Die im Zielsystem entstandene Buchungsnummer und eine etwaige Stornierung.

Die GoBD des Bundesfinanzministeriums enthalten Vorgaben zur Nachvollziehbarkeit, Unveränderbarkeit und zum Digitalisieren von Papierbelegen; welche davon Ihren Ablauf betreffen, klären Sie mit Ihrer Steuerberatung.

DSGVO, besondere Kategorien und Drittlandübermittlung

Belege enthalten oft personenbezogene Daten: den Namen eines Einzelunternehmers auf der Rechnung, eine Ausweisnummer im Antrag, eine Diagnose auf der Arbeitsunfähigkeitsbescheinigung. Vor dem Aufbau steht deshalb ein Datenflussplan: welche personenbezogenen Daten jeder Dokumenttyp enthält, wohin sie in jedem Schritt fließen und wie lange sie gespeichert werden.

  • Besondere Kategorien: Artikel 9 DSGVO erfasst Gesundheitsdaten, genetische und biometrische Daten, Artikel 10 Daten über strafrechtliche Verurteilungen. Belege mit solchen Angaben laufen in einem eigenen Ablauf mit engerem Zugriff und, wo möglich, mit Schwärzung.
  • Auftragsverarbeitung und Drittländer: Der Lesedienst schließt einen Vertrag nach Artikel 28. Sitzt er außerhalb von EU und EWR, verlangt Kapitel V einen Angemessenheitsbeschluss oder Garantien wie Standardvertragsklauseln.
  • Automatisierte Entscheidungen: Artikel 22 schützt Betroffene vor ausschließlich automatisierten Entscheidungen mit erheblicher Wirkung. Der Ablauf liest eine Akte und listet Fehlendes auf; einen Antrag lehnt er nicht ab.
  • Schweiz: Für Unternehmen dort gilt das revidierte Datenschutzgesetz; ob ein Lesedienst im Ausland zulässig ist, prüft Ihre Rechtsberatung nach diesen Regeln.

Die KI Verordnung der EU führt KI für Personalauswahl und Kreditwürdigkeitsprüfung in Anhang III als hochriskant. Ein Ablauf, der Lebensläufe vorsortiert oder Kreditakten bewertet, trägt damit ganz andere Pflichten als die einfache Rechnungserfassung. Die rechtliche Bewertung trifft Ihre Rechtsberatung; das technische Team dokumentiert Datenfluss, Anbieterverträge und Einstellungen.

Vom Pilot zum Vollbetrieb

Ein Ablauf geht stufenweise live, und jede Stufe stützt sich auf die Messwerte der vorigen. Das folgende Gerüst passt für einen einzelnen Dokumenttyp in den meisten Unternehmen.

  1. Beispielsatz zusammenstellen: Anonymisierte Belege des gewählten Typs aus den letzten Monaten, mit verschiedenen Absendern und schlechten Scans.
  2. Richtige Werte erfassen: Für jedes Beispiel werden die korrekten Feldwerte von Hand eingetragen; diese Tabelle ist die Grundlage jeder späteren Messung.
  3. Prototyp messen: Lese und Regelschicht laufen nur auf diesem Satz, das Ergebnis ist eine Fehlerliste je Feld.
  4. Schattenbetrieb starten: Der Ablauf liest echte Belege, bucht aber nichts; das Team arbeitet wie gewohnt, beide Ergebnisse werden täglich verglichen.
  5. Eng begrenzt live gehen: Zunächst dürfen nur eine Absendergruppe oder Belege unter einem festgelegten Betrag ohne Freigabe durch; der Rest bleibt in der Freigabeansicht.
  6. Umfang erweitern: Solange die Fehlerliste im vereinbarten Rahmen bleibt, kommen weitere Absender und danach ein zweiter Dokumenttyp hinzu.

Der Schattenbetrieb wird aus Ungeduld am häufigsten verkürzt, dabei zeigt nur er das Verhalten an echten Belegen. Lassen Sie ihn mindestens über einen Monatsabschluss laufen; hastig gescannte Belege der Abschlusswoche bringen Fehler zutage, die ruhige Tage nie zeigen.

Zeitgewinn und Genauigkeit messen

Der Nutzen zeigt sich in mehreren Kennzahlen, die sich gegenseitig ausbalancieren; steigt die Dunkelverarbeitungsquote, also der Anteil ohne menschliche Freigabe gebuchter Belege, während auch die Korrekturen zunehmen, ist der Ablauf schneller und schlechter geworden. Halten Sie den Ausgangspunkt fest, bevor sich etwas ändert: Die Zeit je Beleg einige Wochen lang mit unserem Arbeitszeitrechner zu erfassen, ist die einzige solide Basis für spätere Vergleiche.

  • Fehler je Feld: In einer wöchentlichen Zufallsstichprobe der Anteil richtiger, korrigierter und leer gebliebener Werte je Feld.
  • Wartezeit in der Freigabeliste: Von der Einreihung bis zur Freigabe; staut sich die Liste, wird die Personalplanung angepasst, nicht die Schwelle.
  • Abschlusskalender: An welchem Arbeitstag der Monatsabschluss fertig ist, verglichen mit den Monaten vor der Automatisierung.
  • Spät entdeckte Fehler: Fehler, die nach der Buchung von Lieferanten, Kunden oder bei einer Prüfung gefunden werden.
  • Nutzungskosten je Beleg: Die Rechnung von Modell und Lesedienst, geteilt durch die verarbeiteten Belege, monatlich verfolgt.

Berücksichtigen Sie Saisoneffekte: Jahresende, Ferienzeiten oder Aktionsphasen lassen die Wirkung der KI Dokumentenverarbeitung größer oder kleiner erscheinen, als sie ist.

Grenzen und übersehene Risiken

KI Dokumentenverarbeitung senkt Lesefehler, beseitigt sie aber nicht, und manche Risiken gab es bei klassischer OCR gar nicht. Für jede Grenze gehört vor dem Aufbau eine Gegenmaßnahme ins Konzept.

  • Erfundene Werte: Sprachmodelle füllen ein unlesbares Feld unter Umständen mit einem plausiblen Wert, statt es leer zu lassen. Die Anweisung muss leere Ausgabe für unlesbare Felder verlangen, und Regeln müssen diese Lücken abfangen.
  • Versteckte Anweisungen im Beleg: In ein PDF lässt sich für Menschen unsichtbarer Text einbetten, der das Modell steuern soll. Die Leseschicht darf nur Felder extrahieren; kein Belegtext kann dem Ablauf Befehle erteilen.
  • Stille Versionswechsel: Aktualisiert der Anbieter sein Modell, wird derselbe Beleg womöglich anders gelesen. Die Version wird festgeschrieben, bei jedem Wechsel läuft der Testsatz erneut.
  • Stempel, Unterschriften und Randnotizen: Ein Stempel über dem Betrag oder eine handschriftliche Korrektur machen unklar, welcher Wert gilt; solche Belege gehen mit strenger Schwelle in die Freigabe.
  • Lange Dokumente: In Verträgen mit Dutzenden Seiten kann das Modell die maßgebliche Klausel übersehen; jede ausgelesene Angabe muss Seite und Klausel nennen.

Diese Maßnahmen machen das Risiko beherrschbar, nicht null. Deshalb wird die Freigabeliste nie abgeschaltet, wie ausgereift der Ablauf auch ist; sie wird nur schmaler.

Häufige Fehler bei der Belegautomatisierung

Die meisten Probleme entstehen bei Vorbereitung und Einführungsreihenfolge, nicht beim Modell. Für jeden der folgenden Fehler gibt es einen besseren Weg.

  • Entscheidung anhand einer Demorechnung: Was auf dem sauberen Musterbeleg des Anbieters fehlerfrei wirkt, verhält sich bei Ihren unscharfen Quittungsfotos anders; entscheiden Sie mit Ihrem eigenen Beispielsatz.
  • XRechnung durch das Modell schicken: Die PDF Ansicht zu lesen, obwohl das XML vorliegt, verursacht Kosten und Doppelbuchungen; trennen Sie strukturierte Daten zuerst ab.
  • Eine Schwelle für alles: Derselbe Konfidenzwert für alle Felder erzeugt entweder unnötige Prüfarbeit oder riskante Durchläufe; legen Sie ihn je Feld und Betrag fest.
  • Freigabeansicht als Nebensache: Wer nur die Extraktion poliert und die Ansicht als schlichte Tabelle baut, verliert die gewonnene Zeit in der Warteschlange; gestalten Sie sie mit dem ersten Prototyp.
  • Schattenbetrieb überspringen: Einen Ablauf direkt an die Buchhaltung anzuschließen, weil der Testsatz gut aussah, trägt Praxisfehler in die Bücher; laufen Sie mindestens einen Abschluss parallel.
  • Korrekturen verlieren: Werden Änderungen in der Freigabeansicht nicht erfasst, wiederholt der Ablauf dieselben Fehler; verknüpfen Sie jede Korrektur mit Protokoll und Testsatz.

Oft kommt ein siebter Punkt hinzu: die Buchhaltung zu spät einzubinden. Wer später mit der Freigabeansicht arbeitet, sollte Feldschema und Regeln vom ersten Tag an sehen.

Partnerwahl und nächster Schritt

Ein guter Partner fragt nach Ihren Beispielbelegen, Ihrem Zielsystem und Ihrem Abschlusskalender, bevor er eine Demo zeigt. Bitten Sie bei Angeboten zur KI Dokumentenverarbeitung um schriftliche Antworten auf diese Punkte:

  • Auf welchem Beispielsatz wird die Genauigkeit gemessen, und zwar je Feld oder je Beleg?
  • Wie werden XRechnung und ZUGFeRD aus der Leseschicht herausgehalten?
  • Müssen Regeln, Freigabeansicht und Anbindung neu gebaut werden, wenn der Lesedienst wechselt?
  • Auf wessen Namen laufen die Konten für Modell, Lesedienst und Automatisierung, und wer erhält Feldschema und Regeln bei der Übergabe?
  • Gehören Datenflussplan und eine Checkliste für Anbieterverträge zum Umfang?

Wir setzen diese Arbeit im Rahmen unserer KI Automatisierung um. Ein veröffentlichtes Kundenprojekt zur KI Dokumentenverarbeitung, das wir als Referenz zeigen können, haben wir noch nicht; deshalb beschreiben wir unsere Methode statt Ergebnisse zu versprechen. Unsere Arbeiten in Automatisierung, Software und Web finden Sie auf der Referenzseite.

Die Kosten hängen von Zahl der Dokumenttypen, Volumen, angebundenen Systemen und Pflegeumfang ab; Festpreise für Analyse und ersten Ablauf stehen auf unserer Preisseite. Nennen Sie uns über das Kontaktformular den Dokumenttyp, der am meisten Zeit kostet, das ungefähre Monatsvolumen und das Zielsystem, dann legen wir Feldschema, Freigaberegeln und ein schriftliches Angebot gemeinsam fest.