Agentic Control Sandbox
Konfigurieren Sie einen Agenten, wählen Sie eine Bedrohung aus und schalten Sie die achtzehn Kontrollen ein und aus. Alles auf dem Bildschirm wird aus der Taxonomie und der Kontrollmatrix abgeleitet – einschließlich der Zahl, die Ihnen dieses Labor bewusst vorenthält.
Die meisten Demos zur Agenten-Sicherheit enden mit einer beruhigenden Zahl: einer Resilienz-Marge, einem Schutz-Score oder einer Anzeige, die grün wird, wenn man genügend Funktionen einschaltet. Diese hier tut das nicht, und dieses Weglassen ist der entscheidende Punkt. Die achtzehn Kontrollen sind real und ihre Framework-Zuordnungen sind real, aber keine einzige davon wurde jemals an einer Modellgenerierung gemessen – ein Wert für das Restrisiko würde also einen Koeffizienten erfordern, den es gar nicht gibt. Was Sie stattdessen erhalten, ist die Abdeckung: welche Quadranten Sie ausgefüllt haben, welche Sie leer gelassen haben und welche Bedrohungszuordnungen Sie berührt haben. Die Abdeckung ist eine Tatsache über Ihre Auswahl. Das Restrisiko wäre eine Behauptung über die Welt.
01Der Agent
Warum es hier klassifiziert ist: Terminal-nativ. Bearbeitet direkt vor Ort (in-place), liefert PRs über Git.
Wer löst die Aktion aus?
Delegiert: führt die gesamte Aufgabe aus, der Mensch überprüft
Wie lange lebt es?
Task: Minuten bis Stunden, stirbt bei Erledigung
Was deckt es ab?
Vertikal: eine Domäne (Coding, CX, Recht…)
Woran erinnert es sich und wie verändert es sich?
Benutzer-/Projektspeicher (erinnert sich, verändert sich nicht)
An ein Labor gebunden?
Mono-Modell, an den Anbieter gebunden
Mit welchen Anmeldedaten agiert es?
Anmeldedaten des Benutzers (im Audit nicht unterscheidbar)
02Die Bedrohung
Direkt von den Controls abgelesen: Jeder Eintrag unten ist ein OWASP LLM Top 10-Punkt, den mindestens ein Control zu adressieren beansprucht. Die Zahl gibt an, wie viele es beanspruchen.
03Die Abwehrmaßnahmen
Berechtigungen und Reichweite
- Feedforwardinferenziell
- Feedforwarddeterministisch
- Feedforwarddeterministisch
Egress und Exposition
- Feedforwarddeterministisch
- Feedbackdeterministisch
- Feedforwarddeterministisch
Ausführung
- Feedforwarddeterministisch
- Feedbackdeterministisch
- Feedbackinferenziell
Menschliche Aufsicht
- Feedforwardinferenziell
- Feedbackinferenziell
Nachweise
- Feedbackdeterministisch
- Feedbackinferenziell
Lebenszyklus und Inputs
- Feedforwarddeterministisch
- Feedforwarddeterministisch
- Feedbackinferenziell
- Feedforwarddeterministisch
- Feedbackinferenziell