Modul · Wenn Software in Ihrem Namen handelt
The Agentic AI Readiness Check
Ein Agent ist kein Chatbot: Er antwortet nicht, er handelt. Er verschickt die E-Mail, bewegt das Geld, bucht die Reise, ändert den Datensatz, alles mit Ihren Zugangsdaten und ohne zweimal zu fragen. Die Fähigkeit ist real, die Leitplanken sind es meist nicht. Dieses Modul prüft die fünf, die entscheiden, ob Autonomie ein Asset oder ein Risiko ist: Berechtigungsgrenzen, Ausgabenlimits, Audit-Trails, menschliche Kontrollpunkte und ein Kill Switch, der funktioniert.
So sehen die fünf Stufen aus
Jede Dimension von The Agentic AI Readiness Check wird von 1 bis 5 bewertet. Das bedeuten die Stufen, Dimension für Dimension. Der benotete Report diagnostiziert, wo Ihre eigenen Antworten landen und was daraus folgt.
Grenzen sind explizit
- 1Keine Grenzen
- 2Nur Prompt-Anweisungen
- 3Teilweise begrenzt
- 4Begrenzte Berechtigungen
- 5Least Privilege, durchgesetzt
Am unteren Ende: Ein Agent ohne durchgesetzte Grenze ist eine absichtlich gebaute Insider-Bedrohung. Beschränken Sie seine Berechtigungen auf das Minimum, das die Aufgabe braucht, in den Systemen, die er berührt, bevor er wieder läuft. So sieht gut aus: Least-Privilege-Berechtigungen, von der Plattform durchgesetzt, sind genau richtig. Überprüfen Sie die Freigaben, wenn der Agent neue Aufgaben übernimmt; Scope Creep macht aus einem sicheren Agenten einen gefährlichen.
Ausgaben sind hart gedeckelt
- 1Keine Limits
- 2Vertrauen in den Prompt
- 3Weiche Deckel
- 4Harte Deckel, weit
- 5Harte Deckel, eng
Am unteren Ende: Ein Agent, der ohne harte Obergrenze Geld ausgeben kann, ist einen Bug von einer sehr schlechten Rechnung entfernt. Setzen Sie ein durchgesetztes Limit auf Zahlungs- oder API-Ebene, bevor er wieder Transaktionen ausführt. So sieht gut aus: Enge, durchgesetzte Ausgabenlimits bedeuten: Ein außer Kontrolle geratener Agent scheitert billig. Bemessen Sie die Deckel an der Aufgabe, nicht an der Bequemlichkeit; ein weites Limit ist ein langsames Leck, das auf einen Bug wartet.
Jede Aktion wird protokolliert
- 1Kein Logging
- 2Teilweise Logs
- 3Aktionen protokolliert
- 4Aktionen plus Begründung
- 5Voller unveränderlicher Trail
Am unteren Ende: Einen unprotokollierten Agenten können Sie weder debuggen noch verteidigen noch ihm vertrauen. Protokollieren Sie ab sofort jede Aktion mit Auslöser und Ergebnis; Sie werden es beim ersten Zwischenfall brauchen. So sieht gut aus: Ein vollständiger, unveränderlicher Trail ist das, was Agenten in regulierter und kritischer Arbeit überhaupt erst möglich macht. Halten Sie ihn manipulationssicher; ein Log, das der Agent bearbeiten kann, ist kein Beweis.
Menschen sichern Schlüsselaktionen
- 1Voll autonom
- 2Keine Kontrollpunkte
- 3Ad-hoc-Freigaben
- 4Kontrollpunkte bei Schlüsselaktionen
- 5Risikogestufte Kontrollpunkte
Am unteren Ende: Volle Autonomie über unumkehrbare Aktionen ist eine Wette, die Sie nur einmal verlieren. Entscheiden Sie, welche Aktionen zu teuer zum Rückgängigmachen sind, und stellen Sie noch diese Woche eine menschliche Freigabe davor. So sieht gut aus: Risikogestufte Kontrollpunkte lassen risikoarme Arbeit frei laufen, während die gefährlichen Aktionen auf einen Menschen warten. Überprüfen Sie die Stufen, wenn der Agent sich Vertrauen erarbeitet und sein Aufgabenbereich wächst.
Kill Switch ist getestet
- 1Kein Kill Switch
- 2Existiert, ungetestet
- 3Einmal getestet
- 4Getestet, langsam
- 5Getestet, sofort
Am unteren Ende: Ein Agent, den Sie nicht schnell stoppen können, ist ein Feuer ohne Löscher. Bauen Sie einen zentralen Schalter, der alle Agenten sofort anhält, unabhängig vom normalen Deployment-Weg. So sieht gut aus: Ein Kill Switch, den Sie getestet haben und in Sekunden ziehen können, macht echte Autonomie verteidigbar. Üben Sie nach Änderungen erneut; der Weg, der letztes Quartal funktionierte, kann inzwischen unbemerkt ausgefallen sein.