Neue API für gezielte Sicherheitsprüfungen in agentischen KI-Anwendungen.
Amazon Web Services hat die InvokeGuardrailChecks API für Amazon Bedrock Guardrails angekündigt. Sie ermöglicht es, einzelne Safeguards ohne das vorherige Erstellen von Guardrail-Ressourcen anzuwenden.
Warum agentische Systeme andere Sicherheitskontrollen benötigen
Im Gegensatz zu klassischen Prompt-Response-Anwendungen arbeiten AI Agents in mehrstufigen Loops. Jeder Turn – vor der Modell-Eingabe und nach der Modell-Ausgabe – birgt ein eigenes Risikoprofil. Die neue API erlaubt es, Safeguards gezielt an jedem Punkt des Agenten-Loops zu aktivieren, ohne operative Overhead durch permanente Guardrail-Ressourcen.
Funktionsweise der InvokeGuardrailChecks API
Die API arbeitet ausschließlich im Detect-Only-Modus. Sie liefert numerische Scores für konfigurierte Checks und überlässt die Entscheidungslogik vollständig der Anwendung.
Unterstützte Safeguards:
- Content Filters: Erkennt schädliche Inhalte (HATE, VIOLENCE, SEXUAL, INSULTS, MISCONDUCT) mit Severity-Scores (0.0–1.0, diskret).
- Prompt Attack Detection: Eigenständige Erkennung von Jailbreaks, Prompt Injection und Prompt Leakage (ebenfalls Severity-Scores).
- Sensitive Information Filters: Erkennt 31 PII-Typen mit Confidence-Scores und exakten Zeichen-Offsets.
Die API nutzt ein strukturiertes Messages-Schema mit Rollen (system, user, assistant), das für Multi-Turn-Agenten optimiert ist. Sie ist resourceless, symmetrisch in Request und Response und erlaubt die unabhängige Ausführung einzelner Checks.
Quelle: AWS AI Blog
FAQ
Welcher Unterschied besteht zur bestehenden ApplyGuardrail API?
InvokeGuardrailChecks ist resourceless, detect-only und liefert Scores für eigene Schwellenwerte. ApplyGuardrail arbeitet mit vorkonfigurierten Ressourcen und führt automatische Aktionen (Block, Mask) aus. Erstere eignet sich speziell für agentische Multi-Turn-Workflows.
Muss ich Guardrails vorher anlegen?
Nein. Die API ist resourceless. Safeguards werden direkt im API-Aufruf spezifiziert.
Welche IAM-Berechtigung wird benötigt?
Die Aktion bedrock:InvokeGuardrailChecks mit Resource * und optionaler Regions-Einschränkung.
Kann ich mehrere Checks in einem Aufruf kombinieren?
Ja. Die API führt angeforderte Checks parallel aus und gibt nur die entsprechenden Ergebnisse zurück.