Kurz gesagt: Nvidia kombiniert in seiner Open Agent Safety Platform die Software-Runtime OpenShell mit dem neuen hardwaregestützten Sentry-System. Damit sollen autonome KI-Agenten nicht nur innerhalb ihrer Laufzeitumgebung begrenzt, sondern zusätzlich unabhängig vom Hostsystem überwacht und bei Regelverstößen isoliert werden.
Autonome KI-Agenten können Programme bedienen, Dateien verändern, Netzwerkdienste aufrufen und Aufgaben über längere Zeit selbstständig ausführen. Genau diese Fähigkeiten erhöhen jedoch auch das Sicherheitsrisiko. Wie lassen sich Grenzen zuverlässig durchsetzen, wenn ein Agent oder sogar das Hostsystem selbst kompromittiert wird?
Mit der Open Agent Safety Platform setzt Nvidia deshalb auf mehrere voneinander getrennte Schutzebenen. Nach Angaben des Konzerns nutzen bereits mehr als 100 Unternehmen und Organisationen Komponenten der Plattform.
OpenShell kontrolliert Agenten außerhalb ihres Prozesses
Die bereits im März vorgestellte Open-Source-Runtime OpenShell führt KI-Agenten in isolierten Sandboxes aus. Dort lassen sich Zugriffe auf Dateien, Netzwerke, Prozesse, Tools und Zugangsdaten beschränken.
Entscheidend ist dabei, dass OpenShell diese Regeln außerhalb des eigentlichen Agentenprozesses in der Laufzeitumgebung durchsetzt. Nach Nvidias Konzept kann ein Agent die für ihn festgelegten Beschränkungen dadurch nicht selbst überschreiben.
Mit Sentry ergänzt Nvidia diesen Ansatz nun um eine weitere Sicherheitsebene. Das System läuft auf BlueField-4-DPUs und damit getrennt vom Hostsystem, auf dem der Agent arbeitet. Diese spezialisierten Prozessoren übernehmen in Rechenzentren unter anderem Netzwerk-, Speicher- und Sicherheitsaufgaben.
Sentry soll Agenten in Millisekunden isolieren
Nvidia gibt an, dass Sentry einen Agenten innerhalb von Millisekunden isolieren könne, sobald dieser vorgegebene Grenzen überschreitet. Selbst wenn das Hostsystem kompromittiert wurde, soll die getrennte BlueField-Hardware Zugriffe weiterhin überwachen und Sicherheitsrichtlinien durchsetzen.
Der Ansatz folgt einer grundlegenden Annahme: Bei zunehmend autonomen Agenten reicht es nicht aus, allein darauf zu vertrauen, dass Modelle vorgegebene Sicherheitsregeln einhalten. Schutzmechanismen sollen deshalb zusätzlich technisch außerhalb des Agenten verankert werden.
Nvidia verweist dabei auf jüngste Vorfälle, bei denen Agenten auf Systeme oder Dienste zugriffen, die nicht für sie vorgesehen waren. Das Risiko entsteht nicht zwingend durch neue Angriffsmethoden. Problematisch ist vielmehr, dass autonome Systeme bekannte Schwachstellen schnell, über längere Zeit und weitgehend selbstständig ausnutzen können.
Zusätzliche Sicherheit schafft auch Hardwareabhängigkeit
OpenShell kann unabhängig von spezieller Nvidia-Hardware eingesetzt werden. Für Sentry sind dagegen BlueField-4-DPUs erforderlich, die seit 2026 produziert werden. Unternehmen, die diese zusätzliche Sicherheitsebene nutzen möchten, binden sie damit unmittelbar an Nvidias Hardware.
Die Open Agent Safety Platform ersetzt zugleich weder klassische IT-Sicherheitsmaßnahmen noch Verfahren, mit denen KI-Modelle selbst sicherer und zuverlässiger gemacht werden sollen. Nvidia ergänzt diese Ansätze vielmehr um eine technische Kontrollschicht außerhalb des Agenten.
Ob Sentry den versprochenen Schutz im praktischen Einsatz tatsächlich zuverlässig liefert, ist derzeit noch offen. Unabhängige Tests oder Benchmarks zur Wirksamkeit liegen bislang nicht vor.
Wer Entwicklungen rund um KI-Agenten, deren Sicherheitsarchitekturen und den praktischen Unternehmenseinsatz im Blick behalten möchte, findet im Newsletter „Beratung-KI“ regelmäßig kompakte Einordnungen aktueller KI-Themen.
Effizienz durch Innovation: Teile der textlichen und visuellen Ausgestaltung dieser Seite wurden durch generative KI-Systeme unterstützt.
