Dunkelverarbeitung steht in vielen Angeboten und wird selten erklärt. Gemeint ist Folgendes: Ein Vorgang läuft vom Eingang bis zum Abschluss durch, ohne dass ein Sachbearbeiter eingreift. Wie groß der Anteil solcher Vorgänge ist, gibt die Dunkelverarbeitungsquote an. Sie zählt allerdings nur, wie viele Vorgänge durchlaufen, und nicht, wie viele davon richtig entschieden wurden. Erst zusammen mit der Fehlerquote wird aus ihr eine belastbare Aussage.
Kurzfassung
Ein dunkel verarbeiteter Vorgang wird fallabschließend ohne Sachbearbeiter erledigt. Die Dunkelverarbeitungsquote allein sagt aber wenig aus, solange du nicht auch weißt, wie viele Fehler dabei unentdeckt bleiben.
Woher Dunkelverarbeitung kommt und was der Begriff genau bezeichnet
Das Gabler Versicherungslexikon definiert Dunkelverarbeitung als den fallabschließenden Teil eines Geschäftsprozesses, den das IT-System nach dem Scannen und Klassifizieren ohne Eingriff eines Mitarbeiters erledigt. Das System nimmt den Vorgang an, erkennt ihn, prüft ihn und schließt ihn ab, ohne dass währenddessen ein Mensch etwas liest oder entscheidet.
Geprägt haben den Begriff die Versicherungswirtschaft und das Dokumentenmanagement, in denen er seit Jahrzehnten für Schadensmeldungen, Vertragsänderungen und Antragsprozesse steht. Die englische Entsprechung STP stammt aus dem Wertpapierhandel. Dasselbe Prinzip gilt heute für eine Eingangsrechnung, eine Standardbestellung oder eine Terminbestätigung, sofern der Vorgang klar genug strukturiert ist, um maschinell fallabschließend bearbeitet zu werden.
Wichtig ist die Abgrenzung zum bloßen Erfassen. Ein System, das ein Dokument einliest und die Felder anzeigt, hat den Vorgang erfasst. Dunkel wird er erst, wenn am Ende eine fallabschließende Entscheidung steht, die niemand bestätigen musste.
Die Dunkelverarbeitungsquote misst, wie viele Vorgänge ohne Eingriff durchlaufen
Die Dunkelverarbeitungsquote ist der Anteil der Vorgänge, die ohne Eingriff durchlaufen. Der GDV, der Gesamtverband der Deutschen Versicherungswirtschaft, formuliert es so: „Sie gibt den Anteil der Geschäftsvorfälle an, die mittels automatisierter Prüfmechanismen und Prozessabfolgen fallabschließend bearbeitet werden, ohne Eingriff eines Sachbearbeiters.“
Damit die Zahl vergleichbar wird, brauchst du drei Festlegungen vorab. Erstens den Zähler: Was zählt als dunkel durch? Nur der fallabschließend erledigte Vorgang zählt; das erfolgreiche Einlesen reicht nicht. Zweitens den Nenner: alle Vorgänge derselben Art im selben Zeitfenster, einschließlich derer, die das System gar nicht erst angenommen hat. Drittens die Definition von Eingriff: Zählt eine automatische Benachrichtigung an einen Sachbearbeiter, die er nur zur Kenntnis nimmt, als Eingriff? Bei uns nicht; ein bewusstes Bestätigen oder Korrigieren dagegen schon.
Ein gerechnetes Beispiel, keine Messung aus einem Kundenprojekt: In einer Buchhaltung kommen im Monat 1.200 Eingangsrechnungen an. 940 davon erledigt das System ohne Eingriff. 180 legt es zur Prüfung vor, weil ein Feld unter der Konfidenzschwelle liegt, und 80 weist es zurück, weil der Lieferant unbekannt ist oder die Datei unlesbar ist. Der Zähler ist damit 940, der Nenner 1.200, die Dunkelverarbeitungsquote liegt bei 78,3 Prozent.
Die beiden anderen Ausgänge verschwinden dabei nicht; sie stehen mit im Nenner. Rechnest du nur mit den 1.120 Vorgängen, die das System angenommen hat, liegt die Quote bei 83,9 Prozent, obwohl im Unternehmen exakt dieselbe Arbeit anfällt. Denselben Effekt hat es, wenn du den Eingriff zu großzügig definierst. Zählen zu den 940 auch die Fälle, in denen jemand eine Benachrichtigung nur zur Kenntnis genommen hat, fällt die Quote zu hoch aus. Dabei ist kein einziger Vorgang anders gelaufen.
Dazu kommt das Zeitfenster. Eine Quote über einen vollen Monat und eine Quote über die einzelne Woche, in der der Monatsabschluss lag, sind zwei verschiedene Kennzahlen, weil sich die Mischung der Vorgangsarten unterscheidet. Wir messen deshalb je Vorgangsart und immer über volle Kalendermonate, und wir halten die Definition fest, bevor die erste Zahl in einem Bericht auftaucht.
Fehlt eine dieser Festlegungen, steht am Ende eine Zahl da, die niemand nachrechnen kann. Der Vergleich mit dem Vormonat oder mit einer Anbieterangabe ist dann wertlos, weil beide Seiten etwas anderes gezählt haben.
Eine veröffentlichte Quote sagt vor allem etwas über die Schwelle
Eine hohe Dunkelverarbeitungsquote lässt sich beliebig erzeugen. Du musst nur die Konfidenzschwelle senken, also den Punkt, ab dem das System einen Vorgang selbst abschließt statt ihn vorzulegen. Je niedriger die Schwelle, desto mehr Vorgänge laufen dunkel durch, und desto mehr davon sind falsch.
Eine veröffentlichte Quote von 80 Prozent ist deshalb vor allem eine Auskunft darüber, wo jemand seine Schwelle gesetzt hat. Wirbt ein Anbieter damit, erfährst du etwas über seine Schwelle, aber nicht, wie oft bei dieser Einstellung ein falscher Wert durchläuft. Zwei Anbieter mit identischer Quote können deshalb sehr unterschiedliche Risiken bergen.
Aus einer Anbieterzahl wird erst dann eine Aussage, wenn drei Angaben danebenstehen. Über welche Vorgangsart wurde gemessen, über einen eng abgegrenzten Ausschnitt bei einem Bestandskunden oder über den kompletten Posteingang? Wie hoch war die Fehlerquote bei genau dieser Einstellung, und wie wurde sie ermittelt? Und was passiert mit den Vorgängen, die das System anhält: Landen sie an einer definierten Stelle oder in einem allgemeinen Sammelpostfach? Bleibt eine der drei Antworten offen, eignet sich die Quote kaum als Vergleichswert.
Dieselbe Prüfung gilt für die eigene Kennzahl, sobald sie in einem Statusbericht auftaucht. Steigt sie von einem Monat auf den nächsten sprunghaft, liegt das fast immer an einer geänderten Schwelle oder einer geänderten Zählweise und selten an einem besseren Modell.
Quote und Fehlerquote gehören zusammen
Belastbar ist die Kennzahl deshalb nur im Paar aus Dunkelverarbeitungsquote und Fehlerquote, gemessen an der Baseline, also an der Fehlerquote der manuellen Bearbeitung vor dem Projekt. Wer stattdessen die Fehlerquote nach dem Projekt als Maßstab nimmt, vergleicht das System mit sich selbst.
Diese Baseline erhebst du vor dem Start. Welche vier Zahlen dazugehören, wie du sie in zwei Wochen zusammenbekommst und warum eine grobe Schätzung dafür nicht reicht, steht im Beitrag Geschäftsprozesse automatisieren.
Vor der Schwelle kommt aber noch etwas anderes: der Weg für die Ausnahmen, also der Ablauf, über den ein zurückgestellter Vorgang in die manuelle Bearbeitung kommt. Er muss stehen, bevor die Quote steigt. Konkret heißt das, dass jeder angehaltene Vorgang an einer festgelegten Stelle bei einer benannten Person ankommt, und zwar mit genügend Kontext, damit diese Person schnell entscheiden kann. Fehlt dieser Weg, wird jede Erhöhung der Quote zum Risiko, weil falsch entschiedene Fälle nirgends auffallen.
Nach unserer Erfahrung aus Projekten wächst eine Quote deshalb in Stufen. Auf eine Erhöhung folgt eine Phase, in der wir die Ausnahmen beobachten und die Konfidenzschwellen pro Feld nachjustieren. Erst danach steigt die Quote weiter. Wer diese Phasen überspringt und direkt eine hohe Quote anstrebt, verschiebt das Risiko nur nach hinten, bis die ersten übersehenen Fehler im Jahresabschluss auftauchen.
Welche Vorgänge realistisch dunkel laufen
Was geeignete Vorgänge verbindet, ist die Wiederholung, nicht das Format. Ein Vorgang, der hundertmal im Monat in fast identischer Form auftaucht, lässt sich beschreiben und damit auch prüfen. In dokumentenlastigen Backoffices sind das vor allem Eingangsrechnungen in bekanntem Format, Standardbestellungen innerhalb vereinbarter Konditionen und Terminbestätigungen. Dazu kommen Stammdatenänderungen mit Prüfziffer, etwa die Umstellung auf eine neue Bankverbindung mit gültiger IBAN. Wie du solche Kandidaten nach Priorität ordnest, beschreibt der Beitrag zur KI-Prozessautomatisierung.
Wo Dunkelverarbeitung an ihre Grenzen stößt, ist ebenso vorhersehbar: bei neuen Geschäftspartnern ohne Historie, bei Abweichungen von vereinbarten Konditionen, bei handschriftlichen Ergänzungen und immer dann, wenn eine fachliche Abwägung nötig ist, die sich nicht als Regel formulieren lässt. Diese Grenze verläuft zwischen dem, was ein System sicher erkennt, und dem, was ein Mensch bewerten muss. Sie ist das eigentliche Thema der intelligenten Dokumentenverarbeitung.
Ein Vorgang, der jedes Mal anders aussieht, eignet sich dagegen kaum für Dunkelverarbeitung, und zwar unabhängig davon, wie leistungsfähig das zugrunde liegende Modell ist. Deshalb lohnt sich vor jeder technischen Entscheidung die einfache Frage, wie oft ein Vorgang in den letzten Monaten in derselben Grundform vorkam.
Was ein Benchmark aus einer anderen Branche aussagt
Der GDV veröffentlicht die Dunkelverarbeitungsquote in der Sach- und Unfallversicherung regelmäßig, und die Werte sind über Jahre gestiegen, nicht auf einen Schlag. Über alle Prozesse hinweg lag sie 2023 bei 33,5 Prozent, gegenüber 23 Prozent im Jahr 2019. Bei Kfz-Vertragsabschlüssen waren es 24,1 Prozent, bei Vertragsabschlüssen allgemein 19,1 Prozent. Bei der Kommunikation über Kundenportale stieg die Quote von 10 Prozent (2019) auf 22 Prozent (2023). Das ist ein Benchmark aus einer anderen Branche, aus einem stark standardisierten Segment mit sehr großen Fallzahlen. Als Zielwert für ein Unternehmen außerhalb dieser Branche eignen sich die Zahlen nicht. Als Beleg dafür, dass eine Quote mit sauberer Vorarbeit über Jahre wächst, schon.
Was jetzt zu tun ist
Miss zwei Wochen lang deine aktuelle Baseline: Wie viele Vorgänge laufen durch, wie viele Fehler stecken darin, und wie werden diese Fehler heute gefunden? Baue den Weg für die Ausnahmen, bevor du die erste Schwelle setzt, denn ohne ihn hat das System keine Stelle, an die es unsichere Vorgänge abgeben kann. Erst danach legst du die Konfidenzschwelle fest und beginnst, Vorgänge automatisch abzuschließen.
Wenn du wissen willst, welche deiner Vorgänge sich für Dunkelverarbeitung eignen und wo die Grenze bei dir konkret liegt, sprich das im Kennenlerngespräch an. Wir gehen deine Vorgangsarten durch und sagen dir, wo sich eine Automatisierung lohnt und wo nicht.