Was ist Amazon Bedrock Guardrails?
Amazon Bedrock Guardrails ist ein KI-Sicherheitsdienst, der eine konfigurierbare Schutzschicht zwischen Benutzereingaben und Foundation-Modell-Ausgaben implementiert. Unternehmen, die generative KI-Anwendungen betreiben, müssen das Verhalten von Sprachmodellen zuverlässig kontrollieren und sicherstellen, dass Ausgaben internen Richtlinien, regulatorischen Anforderungen und Markenwerten entsprechen. Guardrails adressiert diese Anforderungen, ohne in das zugrundeliegende Modell einzugreifen, und lässt sich sowohl während der Inferenz als auch unabhängig davon über die ApplyGuardrail-API nutzen.
Kernfunktionen
- Content Filter: Erkennen und blockieren schädliche Text- oder Bildinhalte in den Kategorien Hate, Insults, Sexual, Violence, Misconduct und Prompt Attack, mit separat einstellbaren Schwellenwerten je Kategorie.
- Denied Topics: Themenbereiche werden in natürlicher Sprache beschrieben und in Anfragen sowie Antworten blockiert, unabhängig vom Foundation-Modell.
- Word Filters: Blockieren exakte, selbst definierte Begriffe und Phrasen, etwa Konkurrenznamen oder Schimpfwörter.
- Sensitive Information Filter: Erkennt personenbezogene Daten wie Namen, Adressen oder Sozialversicherungsnummern probabilistisch und über eigene Regex-Muster, mit Optionen zur Maskierung oder Blockierung.
- Contextual Grounding und Automated Reasoning Checks: Prüfen Modellantworten auf Übereinstimmung mit bereitgestelltem Quellkontext beziehungsweise gegen ein Regelwerk aus logischen Regeln, um Halluzinationen und unbelegte Annahmen zu erkennen.
Typische Anwendungsfälle
Chatbots und Kundenservice: Schädliche Nutzereingaben und toxische Modellantworten werden gefiltert, bevor sie den Endnutzer erreichen.
Regulierte Branchen: Eine Bankanwendung kann Anfragen oder Antworten blockieren, die unzulässige Anlageberatung enthalten, etwa über Denied Topics.
Callcenter-Zusammenfassungen: Personenbezogene Daten in Gesprächsprotokollen werden automatisch maskiert, um die Privatsphäre der Kunden zu schützen.
RAG-Anwendungen: Contextual Grounding Checks stellen sicher, dass Antworten nur auf Basis der abgerufenen Quellen erfolgen und keine erfundenen Informationen enthalten.
Vorteile
- Modellunabhängig einsetzbar mit allen in Amazon Bedrock verfügbaren Foundation-Modellen.
- Mehrere unabhängig konfigurierbare Schutzebenen statt einer starren Blockliste.
- Nutzung sowohl während der Inferenz als auch eigenständig über die ApplyGuardrail-API möglich.
- Eingebautes Testfenster zum iterativen Verfeinern der Konfiguration vor dem produktiven Einsatz.
Integration mit innFactory
Als AWS Reseller mit Fokus auf generative KI hilft innFactory Ihnen, eine unternehmensgerechte AI-Governance-Strategie mit Amazon Bedrock Guardrails umzusetzen, von der Richtlinienentwicklung über die technische Konfiguration bis zur Integration in bestehende CI/CD-Pipelines.
Typische Anwendungsfälle
Häufig gestellte Fragen
Was sind Amazon Bedrock Guardrails?
Bedrock Guardrails ist eine konfigurierbare Sicherheitsschicht, die zwischen Benutzeranfragen und Foundation-Modell-Antworten geprüft wird. Sie filtert unerwünschte Inhalte, erkennt sensible Daten, beschränkt Themenbereiche und schützt vor Prompt-Angriffen, ohne das zugrundeliegende Modell zu verändern.
Welche Content-Filter-Kategorien gibt es?
Content Filter erkennen und blockieren schädliche Inhalte in den Kategorien Hate, Insults, Sexual, Violence, Misconduct und Prompt Attack. Jede Kategorie lässt sich separat mit unterschiedlichen Schwellenwerten konfigurieren. Im Standard-Tier wird die Erkennung zusätzlich auf schädliche Inhalte in Code-Elementen wie Kommentaren, Variablennamen und String-Literalen ausgeweitet.
Wie funktioniert der Schutz sensibler Daten in Guardrails?
Der Sensitive-Information-Filter erkennt personenbezogene Daten (PII) wie Namen, Adressen, Sozialversicherungsnummern oder Geburtsdaten probabilistisch in Ein- und Ausgaben und kann zusätzlich eigene Muster per regulärem Ausdruck erkennen. Erkannte Daten können maskiert oder vollständig blockiert werden.
Was sind Denied Topics und Word Filters?
Denied Topics erlauben es, in natürlicher Sprache Themen zu definieren, über die ein KI-Assistent nicht sprechen soll, unabhängig vom verwendeten Modell. Word Filters blockieren exakte, selbst definierte Begriffe oder Phrasen, etwa Konkurrenznamen oder Schimpfwörter.
Wie erkennt Bedrock Guardrails Halluzinationen?
Contextual Grounding Checks prüfen, ob eine Modellantwort durch bereitgestellten Quellkontext gedeckt ist, etwa bei RAG-Anwendungen. Automated Reasoning Checks gehen weiter und validieren Antworten gegen ein Regelwerk aus logischen Regeln, um Halluzinationen, unbelegte Annahmen und Widersprüche zu erkennen.
Was kostet Amazon Bedrock Guardrails?
Guardrails wird nutzungsbasiert abgerechnet, je nach Filtertyp pro geprüfter Texteinheit oder Bild. Es fallen keine Vorabkosten an. Aktuelle Preise finden Sie auf der offiziellen Bedrock-Pricing-Seite.
Hinweis: Alle Produktinformationen auf dieser Seite wurden sorgfältig zusammengestellt, sind jedoch ohne Gewähr und können veraltet oder unvollständig sein. Cloud-Services entwickeln sich schnell weiter — Funktionen, Preise, SLAs und Verfügbarkeit ändern sich laufend. Verbindliche und aktuelle Informationen finden Sie ausschließlich auf der offiziellen Produktseite von AWS (offizielle Dokumentation). Diese Seite stellt kein Angebot von AWS dar.