Assistenten, Agenten und Berechtigungen
AbgeschlossenUnterscheiden Sie Antworten von Aktionen. Erkennen Sie, welche Werkzeuge und Berechtigungen die Folgen eines Fehlers verändern.
Veröffentlicht von TaigaWie wir schreiben
Verständnis prüfenEin Agent kann einen Branch bearbeiten und Tests ausführen. Sollte er deshalb auch Deployments ausführen dürfen?Übung bearbeiten
Das lernen Sie
- Den Unterschied zwischen einem Assistenten und einem Agenten mit Werkzeugzugriff erklären.
- Aktionen erkennen, die ausdrückliche Berechtigungsgrenzen brauchen.
- Eine sinnvolle Stoppbedingung festlegen.
Ermitteln Sie, wie das System handelt
Ein Assistent kann Code erklären, einen Plan vorschlagen oder eine Implementierung empfehlen. Ein Agent kann zusätzlich Werkzeuge nutzen und auf die Umgebung einwirken. Produktnamen bieten keine verlässliche Abgrenzung. Manche Chatoberflächen können Befehle ausführen. Manche Coding-Werkzeuge schlagen nur Text vor.
Prüfen Sie die verfügbaren Werkzeuge. Eine nützliche Beschreibung nennt, was das System lesen, ändern, ausführen und veröffentlichen kann. Sie hält auch fest, welche Zugangsdaten und welche Umgebung jede Aktion nutzt.
Anthropic unterscheidet vorgegebene Workflows von Agenten, die die Reihenfolge ihrer Werkzeugnutzung selbst wählen. Diese Unterscheidung erklärt, wie die Arbeit abläuft. Sie entscheidet nicht, ob eine bestimmte Aktion sicher ist. Beide Ansätze brauchen ausdrückliche Berechtigungsgrenzen.
Trennen Sie Ziel und Berechtigung
Betrachten Sie einen fiktiven Auftrag: „Reparieren Sie den Rechnungsexport.“ Ein Agent kann das Repository untersuchen, den Fehler reproduzieren, einen Branch bearbeiten und Prüfungen ausführen. Möglicherweise findet er in seiner Umgebung auch Zugangsdaten für die Produktionsdatenbank.
Das Ziel erlaubt nicht jede verfügbare Aktion. Das Lesen einer Produktionstabelle, Änderungen an Rechnungsdatensätzen und die Bereitstellung einer neuen Version haben unterschiedliche Folgen. Eine allgemeine Anweisung wie „Schließen Sie die Aufgabe ab“ erklärt nicht, welche dieser Aktionen die Organisation erlaubt.
Legen Sie die Grenze vor Arbeitsbeginn fest. In diesem Beispiel darf der Agent erfundene Daten und eine lokale Datenbank verwenden. Er darf einen Pull Request erstellen. Er darf weder auf Produktionsdatensätze zugreifen noch die Änderung bereitstellen. Ein eigener Freigabeprozess übernimmt diese Aktionen.
Setzen Sie Befugnisse technisch durch
Anweisungen helfen dem Agenten, die Aufgabe zu verstehen. Zugangsdaten und Zugriffskontrollen bestimmen, was er tatsächlich tun kann. Nutzen Sie beides.
| Aufgabenbedarf | Geeignete Grenze für dieses Beispiel |
|---|---|
| Relevanten Code untersuchen | Lesezugriff auf das ausgewählte Repository |
| Eine Korrektur vorschlagen | Schreibzugriff auf einen Feature-Branch |
| Verhalten prüfen | Eine Testumgebung mit erfundenen Daten |
| Review anfordern | Berechtigung, einen Pull Request zu öffnen |
| Software veröffentlichen | Eine eigene Deployment-Rolle und Freigaberichtlinie |
Eine reine Leseaufgabe sollte keine Schreibzugangsdaten erhalten, nur weil sie praktisch sind. Eine Testumgebung sollte nicht unbemerkt Produktionszugriff erben. Prüfen Sie die Verbindungen zwischen Werkzeugen, Identitäten und Ressourcen. Ein harmlos wirkender Befehl kann weitreichende Folgen haben, wenn er eine mächtige Identität nutzt.
Legen Sie fest, wann die Arbeit stoppen muss
Ein Agent braucht eine Stoppbedingung, wenn die nächste Aktion seine Befugnisse überschreitet. Er braucht sie auch, wenn die Nachweise nicht ausreichen.
Stoppen Sie im Rechnungsbeispiel, wenn der Fehler eine Korrektur von Produktionsdaten erfordert. Stoppen Sie, wenn das gewünschte Verhalten der dokumentierten Buchhaltungsregel widerspricht. Melden Sie den Konflikt mit den relevanten Nachweisen und der Entscheidung, die eine verantwortliche Person treffen muss.
Ein Zeit- oder Kostenlimit ist bei wiederholten Versuchen sinnvoll. Es ersetzt keine Berechtigungsgrenze. Zehn erlaubte Versuche und ein unerlaubtes Deployment sind unterschiedliche Probleme.
Bewerten Sie Ergebnis und Aktionsprotokoll
Prüfen Sie nach Abschluss mehr als die letzte Antwort. Sehen Sie sich die geänderten Dateien, ausgeführten Prüfungen und verbleibenden Unsicherheiten an. Prüfen Sie, ob alle Aktionen innerhalb des vereinbarten Umfangs blieben.
Ein leistungsfähiger Agent kann manuelle Arbeit verringern. Die Organisation muss weiterhin erlaubte Aktionen festlegen, wichtige Ergebnisse prüfen und die Verantwortung für die Freigabeentscheidung übernehmen. Mehr Autonomie macht diese Aufgaben noch wichtiger.
Übung bearbeiten
Wählen Sie ein KI-Werkzeug, das Ihrem Team zur Verfügung steht. Listen Sie auf, was es lesen, ändern, ausführen und veröffentlichen kann. Benennen Sie die Stellen, an denen eine Person zustimmen muss. Prüfen Sie eine Grenze in der tatsächlichen Konfiguration.
Arbeitsblatt herunterladen (Markdown)Wenn Sie diese Auswahl aufheben, wird der gesamte in diesem Browser gespeicherte Fortschritt gelöscht.
Ihr Fortschritt bleibt in diesem Browser. Ohne Konto und Tracking.