Was Agenten im Büroalltag heute wirklich schaffen

Was Agenten im Büroalltag heute wirklich schaffen

September 16, 2026
2
Agenten im Realitätscheck

Vergangene Woche haben wir sortiert, was ein Agent überhaupt ist und Dir vier Fragen mitgegeben, mit denen Du den Grad der Selbstständigkeit eines Systems bestimmen kannst. Heute die Anschlussfrage. Wo arbeiten diese Systeme verlässlich und wo eben noch nicht?

Die Antwort fällt anders aus, als die meisten erwarten. Sie hängt weniger davon ab, in welcher Abteilung ein Agent eingesetzt wird und sehr stark davon, wie lang die Kette der Arbeitsschritte ist.

Teil 2 unserer Serie: „Agenten im Realitätscheck".

Der Aha-Effekt: Die Länge der Kette entscheidet

In der Forschung gibt es dazu inzwischen belastbare Messungen. Bei kurzen, klar überprüfbaren Aufgaben erreichen Agenten Erfolgsquoten nahe hundert Prozent. Sobald sich die Aufgabe über viele Schritte und mehrere Stunden zieht, brechen die Werte deutlich ein. Im Benchmark "TheAgentCompany", der realistische Büroaufgaben nachstellt, bewältigten die besten Systeme rund dreißig Prozent der Aufgaben eigenständig. Für die Einordnung im eigenen Unternehmen heißt das: Frag nicht, ob ein Agent die gesamte Buchhaltung erledigen kann, sondern wie viele Schritte er ohne Zwischenprüfung gehen soll.

Drei Einsatzfelder, drei Reifegrade

Verlässlich: Der erste Draht zum Kunden. Der am besten belegte Einsatz ist der First-Level-Support. Ein Agent beantwortet wiederkehrende Anfragen rund um die Uhr, schlägt Antworten vor und reicht alles weiter, was er nicht sicher einordnen kann. Das Fraunhofer IAIS führt dieses Feld ausdrücklich als Anwendungsgebiet. Der Grund für die gute Bilanz liegt in der Struktur der Arbeit, denn jede Anfrage ist eine kurze, abgeschlossene Aufgabe mit einem Ergebnis, das sich sofort überprüfen lässt. Unter diesen Bedingungen liegen die Erfolgsquoten hoch.

Verlässlich nach Einarbeitung: Wiederkehrende Sachbearbeitung. Buchungen zuordnen, Rechnungen prüfen, Stammdaten abgleichen. Solche Aufgaben lassen sich gut übertragen. Sie brauchen allerdings eine Einarbeitungsphase, in der ein Mensch jedes einzelne Ergebnis gegenliest, bis die Trefferquote über mehrere Wochen stabil bleibt und niemand mehr Überraschungen erlebt. In der Praxis wird diese Phase oft übersprungen, weil sie sich nach Doppelarbeit anfühlt. Sie ist trotzdem der Teil, der später darüber entscheidet, ob jemand den Zahlen vertraut.

Noch nicht so weit ist die durchgehende Prozesskette: Der Wunsch, einen ganzen Vorgang vom Eingang bis zum Abschluss zu übergeben, ist verständlich. Hier liegen die schwächsten Ergebnisse. Je mehr Schritte aufeinander folgen, desto größer die Wahrscheinlichkeit, dass ein früher Fehler alle späteren mitreißt. Wer heute schon so etwas bauen will, sollte die Kette bewusst an zwei oder drei Stellen unterbrechen und dort einen Menschen bestätigen lassen.

Drei Fehlerarten, die es vorher nicht gab

Mit mehrstufigen Abläufen entstehen Fehlermuster, die aus klassischer Software niemand kennt.

Diese drei Muster erklären, warum eine Prüfung am Ende einer langen Kette wenig bringt, denn zu diesem Zeitpunkt ist der ursprüngliche Fehler längst durch ein Dutzend Folgeschritte gewandert und kaum noch auffindbar. Nötig sind Kontrollpunkte unterwegs.

Warum kurze Ketten die bessere Bauweise sind

Die Verlockung liegt darin, möglichst viel an einem Stück zu automatisieren, weil das nach dem größten Sprung aussieht. Aus den Messwerten folgt das Gegenteil: Mehrere kurze, klar abgegrenzte Agenten mit definierten Übergabepunkten kommen weiter als ein einziger, der alles macht. Solche Bausteine lassen sich einzeln prüfen und einzeln abschalten. Wenn Ihr also über einen Einsatz nachdenkt, zerlegt den Vorgang zuerst und fragt bei jedem Teilstück, ob das Ergebnis in unter einer Minute überprüfbar ist. Wo die Antwort ja lautet, steht Ihr auf sicherem Boden.

Rober Iuga Portrait

Robert

Digital Transformation Manager

Du hast Interesse KI in Deinem Unternehmen erlebbar zu machen? Ich freue mich auf Deine Nachricht!