Leitfaden · KI und Automatisierung

KI-Agenten im Unternehmen:Wo sie helfen – und wo nicht.

Ein KI-Agent ist nützlich, wenn der Weg zur Antwort von Fall zu Fall anders aussieht. Wegen derselben Flexibilität kann er sich jedes Mal anders irren. Die sinnvolle Frage lautet nicht, ob dein Unternehmen „Agenten einsetzen“ sollte, sondern welche kleine Entscheidung Interpretation braucht und was weiterhin Regeln oder menschlicher Kontrolle unterliegt.

Beginne mit der Aufgabe, nicht mit dem Agenten

Eine klassische Automatisierung folgt einem vorgegebenen Weg: Wenn eine bezahlte Rechnung eingeht, hängt sie diese an den passenden Auftrag und schließt die Aufgabe. Ein Agent erhält ein Ziel und einen begrenzten Satz Werkzeuge und wählt einige Schritte selbst: eine ungewöhnliche Anfrage lesen, den relevanten Datensatz finden, fehlende Angaben erfragen oder eine Antwort vorbereiten.

Dieser Unterschied zählt mehr als der Name des Modells. Kannst du die richtigen Schritte und Ausnahmen aufschreiben, ist ein fester Ablauf meist günstiger, schneller und leichter zu testen. Nutze einen Agenten für den mehrdeutigen Teil – nicht als Dekoration um einen Prozess, der bereits Regeln hat.

Immer gleiche Eingabe und Schritte
Regeln oder eine Integration verwenden.
Nur die Bedienoberfläche ist zugänglich
RPA erwägen und einen Ausweg für UI-Änderungen einplanen.
Eingaben variieren, Ergebnis ist prüfbar
Ein Agent kann in einem begrenzten Ablauf helfen.
Entscheidung ist folgenreich oder schwer prüfbar
Eine qualifizierte Person bleibt verantwortlich.
Wähle den am wenigsten flexiblen Mechanismus, der die tatsächliche Variation der Aufgabe bewältigt.

Aufgaben, die sich als erster Agent eignen

Gute Kandidaten kommen als uneinheitlicher Text oder als Dokument herein, enden aber in einem engen, prüfbaren Ergebnis. Dazu gehören eingehende Anfragen in eine bestehende Warteschlange einzuordnen, vor der Antwort einer Kollegin die passende Richtlinie zu finden, ein Lieferantendokument mit der Bestellung abzugleichen oder einen Entwurf vorzubereiten, den ohnehin jemand prüft.

Die Aufgabe sollte oft genug vorkommen, um sie messen zu können, eine kurze Verzögerung vertragen und Beispiele guter Ergebnisse besitzen. Außerdem braucht sie einen klaren Ausgang: Widersprechen sich Belege, fehlt ein Feld oder ist die Unsicherheit zu groß, stoppt der Agent und gibt den Fall an einen Menschen ab, statt zu improvisieren.

  • Eine Person kann das Ergebnis schnell prüfen, ohne die gesamte Arbeit zu wiederholen.
  • Die vorhandenen Unterlagen enthalten genug Belege für die Entscheidung.
  • Ein Fehler lässt sich auffangen, bevor er Geld, Zugänge oder ein Kundenversprechen berührt.
  • Die Werkzeuge bieten enge Aktionen statt eines Kontos mit Vollzugriff.
  • Es gibt genug echte Beispiele – auch schwierige – für Tests vor dem Start.

Konkretes Beispiel: Ein gemeinsames Postfach vorsortieren

Nehmen wir ein fiktives Wartungsunternehmen mit einem Postfach für Störungen, Angebotsanfragen und Lieferantennachrichten. Heute liest eine Koordinatorin jede E-Mail, sucht den Kunden im Auftragssystem, legt eine Aufgabe an und leitet Dringendes weiter. Der nützliche Agent „übernimmt“ nicht den Kundendienst. Er liest einige Felder aus, sucht genau einen Kunden, schlägt Kategorie und Dringlichkeit vor und bereitet eine Aufgabe zur Prüfung vor.

Der feste Ablauf prüft weiterhin Pflichtfelder, schreibt die freigegebene Aufgabe und verschickt die Standardbestätigung. Eine Person genehmigt dringende Fälle und alles, was der Agent nicht zuordnen kann. So übernimmt das Modell das flexible Lesen, während Kundenversprechen und Datenbankänderungen deterministisch bleiben.

Der Pilot lässt sich an den Nachrichten eines vergangenen Monats messen: richtige Kategorie, richtige Kundenzuordnung, übersehene Notfälle, unnötige Übergaben und Prüfzeit. „Die Antworten sehen gut aus“ ist kein Freigabekriterium.

  1. 01 Anfrage kommt an E-Mail und Anhänge bleiben erhalten
  2. 02 Agent schlägt vor Kategorie, Zuordnung und Aufgabenentwurf
  3. 03 Regeln prüfen Pflichtfelder, Grenzen und bekannte Ausnahmen
  4. 04 Mensch gibt frei Dringende, unsichere und folgenreiche Fälle
Ein begrenzter Agent sitzt innerhalb eines Ablaufs; er besitzt nicht den gesamten Prozess.
Drei Ablagen mit schlichten Anfragekarten; eine unsichere Karte liegt neben einer grünen Prüfmarke.
Eine unsichere Anfrage wartet auf die Prüfung durch einen Menschen.

Was vorhersehbar bleiben sollte

Lass ein Modell keinen Preis berechnen, für den es bereits eine Formel gibt, keine Berechtigung bestimmen, für die eine Richtlinie existiert, und kein Geld bewegen, weil eine Nachricht überzeugend klingt. Exakte Berechnungen, Zugriffskontrolle, gesetzliche Aufbewahrung, Bestandsbuchungen und endgültige Zahlungen gehören in Code und ausdrückliche Regeln. Der Agent darf Belege sammeln oder eine Ausnahme erklären; das System setzt die Grenze durch.

Dasselbe gilt, wenn die Antwort kaum zuverlässig beurteilt werden kann. Ein flüssiger Absatz kann eine schwache Entscheidung verbergen. Muss die prüfende Person jeden Fall von Grund auf recherchieren, spart der Agent wenig und schafft womöglich unverdientes Vertrauen.

Entwirf die Übergabe an Menschen vor dem Idealfall

Menschliche Prüfung ist kein Knopf, den man am Ende ergänzt. Lege fest, was die prüfende Person sieht: Ursprungsmaterial, vorgeschlagene Aktion, verwendete Belege und Änderungen. Freigabe und Korrektur müssen so einfach sein, dass Menschen den Ablauf nutzen, statt ihn zu umgehen.

Bestimme Auslöser, die immer geprüft werden – hohe Beträge, neue Kunden, sensible Daten oder widersprüchliche Dokumente. Gewöhnliche Fälle mit geringen Folgen dürfen erst automatisch weiterlaufen, wenn die gemessene Fehlerquote das rechtfertigt. Bewahre Eingabe und Prüfspur auf, damit eine Entscheidung später nachvollziehbar bleibt.

Der KI-Risikoleitfaden des NIST behandelt Steuerung, Tests, Beobachtung und klar zugewiesene menschliche Rollen als laufende Aufgabe, nicht als einmalige Checkliste vor dem Start. In einem KMU darf die Umsetzung schlank sein; die Verantwortlichen brauchen trotzdem Namen.

Baue den kleinsten Pilotversuch, der die Idee widerlegen kann

Wähle einen Eingangskanal, eine Fallart und ein Ergebnis. Lass den Agenten zuerst mit vergangenen Beispielen laufen, danach im Schatten des bestehenden Prozesses. Erfasse, wann er richtig liegt, wann er abgibt, was er kostet und wie lange die Prüfung dauert. Nimm bewusst schwierige Fälle auf, statt eine Demo um die zehn einfachsten herum zu polieren.

Lege vor dem Versuch eine Abbruchbedingung fest: zum Beispiel keinen übersehenen Notfall im Testbestand, eine spürbar kürzere Prüfzeit und eine klare Kostengrenze pro Fall. Scheitert der Versuch daran, wird die Aufgabe enger oder mit Regeln gelöst. Auch ein Pilot, der einen Agenten als falsches Werkzeug entlarvt, hat einen größeren Fehler verhindert.

MesswertBeantwortete Frage
AufgabentreueRichtige Felder und AktionenErledigt er die festgelegte Aufgabe?
AbgabeAn Menschen übergebene FälleWeiß er, wann er stoppen muss?
PrüfzeitMinuten zum Prüfen oder KorrigierenSpart er wirklich Aufmerksamkeit?
Kosten und DauerPro Fall einschließlich WiederholungenBleibt der Ablauf bei größerer Menge sinnvoll?
Ein Pilot ist nützlich, wenn er den echten Betrieb misst – nicht nur die Modellausgabe für sich.

Begrenze, was der Agent sehen und tun darf

Gib dem Agenten Werkzeuge für genau einen Zweck: eine Bestellung lesen, eine Aufgabe entwerfen, eine Änderung vorschlagen. Übergib ihm keinen allgemeinen Datenbankzugang und keine unbeschränkte Browser-Sitzung. Prüfe jedes Werkzeugargument in normalem Code, begrenze Wiederholungen und Ausgaben und verlange eine Freigabe für unumkehrbare Aktionen.

Behandle eingehende Dokumente, Webseiten und E-Mails als nicht vertrauenswürdige Daten. Sie können Anweisungen enthalten, die sich an das Modell richten statt an den Geschäftsprozess. Trenne diesen Inhalt von Systemanweisungen, beschränke Werkzeugrechte und protokolliere Aufrufe und Ergebnisse. OWASP bezeichnet zu viele Funktionen, Rechte oder Autonomie als „Excessive Agency“ – ein zentrales Risiko agentischer Systeme.

Plane zuletzt Veränderungen ein. Modelle, Anweisungen und Quelldokumente entwickeln sich weiter. Bewahre einen kleinen Regressionstest mit echten Fällen auf, führe ihn vor Änderungen erneut aus und beobachte die Ergebnisse in Produktion, statt die Trefferquote von gestern für dauerhaft zu halten.

Quellen und weiterführende Hinweise

Fragen vor dem Start

Was unterscheidet einen KI-Agenten von Automatisierung?

Eine feste Automatisierung folgt vorher festgelegten Schritten. Ein Agent interpretiert variable Eingaben und wählt begrenzte Werkzeuge für ein Ziel. Zuverlässige Systeme verbinden oft beides: Der Agent schlägt vor, normaler Code prüft und führt die kontrollierte Aktion aus.

Brauche ich für E-Mails oder Dokumente einen KI-Agenten?

Nicht immer. Decken Vorlagen und Regeln die Fälle ab, sind klassische Auswertung und Integrationen vorhersehbarer. Ein Agent wird interessant, wenn Sprache und Formate so stark variieren, dass die Interpretation den Engpass bildet.

Darf ein Agent ohne Freigabe handeln?

Erst bei folgenarmen, umkehrbaren Aktionen und nachdem der Ablauf gemessen wurde. Geld, Berechtigungen, Kundenzusagen und unsichere Fälle brauchen klare Regeln oder eine verantwortliche Person.

Wie testet man einen KI-Agenten vor dem Start?

Mit repräsentativen vergangenen Fällen einschließlich Fehlern und Randfällen, genauen Aufgabenmaßen, einem Schattenbetrieb, erfassten Übergaben, Prüfzeiten, Kosten und Laufzeiten sowie Freigabe- und Abbruchkriterien, die schon vor dem Versuch feststehen.

SPRECHEN WIR

Sprechen wir über dein Projekt.

EINE KLEINE STARTHILFE

Eine klarere Idee. Ein besseres Erstgespräch.

Beschreibe, was du entwickeln oder verbessern möchtest. Ich helfe dir mit einer kurzen Übersicht für Artur.

Meine Idee beschreiben
Projektassistent

Projektassistent

ARTUR PUIG

Welche variable Aufgabe möchtest du verbessern?

Ein oder zwei Sätze reichen zum Start. Ich helfe dir, die Idee für ein Gespräch mit Artur zu konkretisieren.

Mit dem Senden bestätigst du, dass du mindestens 18 bist und Google deine Idee verarbeiten darf. Artur speichert den Chat 14 Tage und erhält eine Zusammenfassung über Telegram. Keine sensiblen Daten senden. Google ↗

EIN KOSTENLOSES ERSTGESPRÄCH

Buche ein kostenloses Erstgespräch.

Ein 30-minütiges Videogespräch über deine Idee oder ein Problem, das du lösen möchtest. Wenn eine Basisdemo hilfreich ist, legen wir gemeinsam fest, was sie zeigen soll.

Kostenlos · 30 Min. · Google Meet

Kostenloses Erstgespräch buchen

ARTUR PUIG · Kostenlos · 30 Min. · Google Meet

Finden wir einen Termin.

Sprechen wir über dein Projekt

Schreib mir hier.

Du schreibst lieber? Schick eine kurze Zusammenfassung und ich antworte per E-Mail.

Deine Nachricht landet direkt bei mir. Kein Newsletter, keine Verkaufsanrufe.

Weitere Angaben (optional)

Ich nutze deine Angaben, um auf deine Anfrage zu antworten. Das Formular verwendet Cloudflare-Spamschutz und übermittelt mir deine Nachricht über Telegram.

Auf LinkedIn vernetzen

In Barcelona · Zusammenarbeit remote