Nvidia stellt Sicherheitsnetz für autonome KI-Agenten vor
Nvidia reagiert auf jüngste Sicherheitsvorfälle mit autonomen KI-Agenten und stellt mit der Open Agent Safety Platform eine neue Sicherheitsarchitektur vor. Sie kombiniert die bereits verfügbare Open-Source-Runtime OpenShell mit dem neuen Überwachungssystem Sentry. Nach Angaben des Konzerns arbeiten bereits mehr als 100 Unternehmen und Organisationen mit Komponenten der Plattform.
OpenShell hatte Nvidia bereits im März vorgestellt. Die Software führt Agenten in isolierten Sandboxes aus und kann deren Zugriff auf Dateien, Netzwerke, Prozesse, Tools und Zugangsdaten beschränken. Die Regeln werden dabei von OpenShell in der Laufzeitumgebung und damit außerhalb des eigentlichen Agentenprozesses durchgesetzt, sodass sie nach Nvidias Konzept nicht aus dem Agenten selbst heraus überschrieben werden können.
Das neue Sentry-System ergänzt diese Softwarekontrollen um eine hardwaregestützte Sicherheitsebene. Sentry läuft auf Nvidias BlueField-4-DPUs und damit getrennt vom Hostsystem, auf dem der Agent ausgeführt wird. BlueField-4-DPUs sind spezialisierte Prozessoren für Netzwerk, Speicher und Sicherheitsaufgaben in Rechenzentren.
Sentry soll Agenten in Millisekunden isolieren
Nvidia gibt an, dass Sentry Agenten, die ihre vorgegebenen Grenzen verlassen, innerhalb von Millisekunden isolieren könne. Selbst wenn das eigentliche Hostsystem kompromittiert wird, soll die getrennte BlueField-Hardware weiterhin Zugriffe überwachen und Sicherheitsregeln durchsetzen können.
Hinter dem Ansatz steht die Annahme, dass sich bei immer autonomer arbeitenden Agenten nicht allein darauf verlassen lässt, dass sie vorgegebene Sicherheitsgrenzen einhalten. Nvidia will den Schutz deshalb nicht allein über Vorgaben und Schutzmechanismen im Modell erreichen, sondern Grenzen zusätzlich technisch außerhalb des Agenten erzwingen. Das Risiko wächst, weil solche Systeme Programme bedienen, Dateien verändern, Dienste im Netz aufrufen und über lange Zeit selbstständig Aufgaben abarbeiten können.
Nvidia verweist auf jüngste Vorfälle, bei denen Agenten vorgesehene Sicherheitsgrenzen umgingen und auf Systeme oder Dienste zugriffen, die für sie nicht vorgesehen waren. Solche Vorfälle müssen nicht auf völlig neue Angriffsmethoden zurückgehen. Gefährlich ist vor allem, dass autonome Agenten bekannte Schwachstellen schnell, über lange Zeit und weitgehend selbstständig ausnutzen können.
Hardware-Schutz bindet Unternehmen an Nvidia
OpenShell lässt sich auch ohne spezielle Nvidia-Hardware einsetzen. Für Sentry sind dagegen Nvidias BlueField-4-DPUs nötig, die erst seit 2026 in Produktion sind. Die Bindung an BlueField-4 hat einen strategischen Nebeneffekt für Nvidia: Wer Sentry einsetzen will, bindet diese Sicherheitsstufe an die Hardware des Konzerns.
Die Plattform ersetzt zudem weder klassische IT-Sicherheitsmaßnahmen noch Alignment-Ansätze, mit denen KI-Modelle selbst sicherer und zuverlässiger gemacht werden sollen. Nvidia verlagert einen Teil der Kontrolle vielmehr auf eine technische Ebene außerhalb der Agenten. Ob Sentry dort den versprochenen Schutz zuverlässig bietet, muss sich erst in der Praxis zeigen. Unabhängige Tests oder Benchmarks zur Wirksamkeit stehen noch aus.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.