Produkt15. März 20263 Min. Lesezeit

Leitplanken im Agent Canvas: Strukturelle Kontrollen für KI-Agenten

Leitplanken im Agent Canvas sind keine Eingabeaufforderungen – es handelt sich um harte Einschränkungen im Konversationsdiagramm, die das LLM nicht umgehen kann. So funktionieren sie.

Wenn Sie einem LLM sagen, dass er niemals medizinische Ratschläge erteilen soll, verlassen Sie sich auf probabilistische Compliance. Wenn Sie im Agent Canvas einen Leitplankenknoten hinzufügen, der medizinische Themen erkennt und zu einem Eskalationsfluss weiterleitet, erzwingen Sie eine strukturelle Einschränkung. Der Unterschied: Manchmal scheitert man. Der andere kann vom Modell nicht umgangen werden.

Arten von Leitplanken

  • Themenblöcke – verhindern, dass sich der Agent mit bestimmten Themen befasst (Preise der Konkurrenz, medizinische Diagnose, Rechtsberatung). Die Erkennung erfolgt auf der Orchestrierungsebene, nicht an der Eingabeaufforderung.
  • Obligatorische Offenlegungen – fügen Sie an bestimmten Stellen die erforderliche Sprache ein: Offenlegung der KI-Identität zu Beginn des Anrufs, Compliance-Sprache vor Finanztransaktionen, Aufzeichnung von Einwilligungsbenachrichtigungen.
  • Eskalationsauslöser – automatische menschliche Übergabe, wenn Bedingungen erfüllt sind: Kundenanfragen menschlich, Stimmung fällt unter den Schwellenwert, Konversation überschreitet die Komplexitätsgrenze.
  • Regeln für die Datenverarbeitung: Entfernen Sie vertrauliche Informationen aus Protokollen, verhindern Sie die Speicherung von Zahlungsdaten und erzwingen Sie die Verschlüsselung personenbezogener Daten auf Feldebene.
  • Aktionsgrenzen – schränken ein, welche Tools der Agent unter welchen Bedingungen verwenden kann (z. B. kann er Rückerstattungen unter 50 $ autonom verarbeiten, muss über 50 $ eskalieren).

Leitplanken sind auf der Leinwand sichtbar

Jede Leitplanke ist ein sichtbarer Knoten oder eine sichtbare Kante im Konversationsdiagramm. Compliance-Teams können den Ablauf überprüfen, indem sie den Canvas inspizieren – sie können sehen, wo Offenlegungen eingefügt werden, wo Eskalation stattfindet und welche Themenfilter aktiv sind. Diese Überprüfbarkeit ist bei reinen Eingabeaufforderungssystemen nicht möglich, bei denen Leitplanken in Absätzen natürlichsprachlicher Anweisungen verborgen sind, die befolgt werden können oder nicht.

Bereit loszulegen?

Erleben Sie, wie Mazeds multimodale KI-Agenten für Ihren Use Case arbeiten.

Leitplanken im Agent Canvas: Strukturelle Kontrollen für KI-Agenten | Mazed Blog | Mazed