Guardrails umfassen Regeln, Filter und Kontrollmechanismen, mit denen Eingaben und Ausgaben eines KI-Systems überwacht werden. Sie sollen verhindern, dass die KI schädliche, unzulässige oder problematische Inhalte erzeugt oder weitergibt.
Dazu gehören etwa Inhaltsfilter, Sicherheitsprüfungen, Zugriffsbeschränkungen oder Vorgaben zur Einhaltung interner Richtlinien. Guardrails können sowohl technisch im System als auch organisatorisch im Prozess verankert sein.
Ohne Guardrails steigt das Risiko von Fehlverhalten, Datenlecks oder problematischen Ausgaben. Sie sind deshalb ein wichtiger Bestandteil von KI-Governance, Compliance und sicherem produktivem Einsatz.