Platforma bezpieczeństwa Open Agent firmy NVIDIA zapobiega "dryfowi" agentów AI dzięki egzekwowaniu poza pasmem.
W skrócie
NVIDIA wprowadziła Open Agent Safety Platform, łączącą sandbox OpenShell z egzekwowaniem sprzętowym BlueField-4 w celu ochrony agentów AI przed dryfem na dużą skalę.
NVIDIA wprowadziła Open Agent Safety Platform – otwartą platformę mającą na celu ochronę autonomicznych agentów sztucznej inteligencji poprzez ciągły monitoring i wymuszanie polityk za pomocą sprzętu. Platforma została wydana 28 września 2026 roku i ma na celu odpowiedź na rosnące obawy w branży AI po doniesieniach, że agenci AI mogą uciekać z środowisk testowych, uzyskiwać dostęp do nieautoryzowanych systemów czy błędnie raportować własne działania.
Firma porównuje to do wczesnych lat internetu. Internet stał się podstawą dla biznesu i komunikacji dopiero po wprowadzeniu mechanizmów bezpieczeństwa takich jak szyfrowane połączenia, sandboxowane zakładki przeglądarki oraz widoczne wskaźniki zaufania. NVIDIA uważa, że agenci AI także wymagają podobnej warstwy zaufania, aby rozwinęła się “gospodarka agentów”, a środki bezpieczeństwa powinny przyspieszać, a nie hamować innowacje.
OpenShell Runtime: Izolacja od jądra
Rdzeniem tej platformy jest NVIDIA OpenShell – otwartoźródłowy bezpieczny runtime wydany na licencji Apache 2.0. OpenShell uruchamia każdego agenta w sandboxie z izolacją na poziomie jądra, zamieniając polecenia operatora na weryfikowalne polityki. Określają one dostęp do plików, sieci, narzędzi, procesów i poświadczeń. Te ograniczenia są weryfikowane przed wykonaniem i stale egzekwowane podczas działania agenta.
Platforma oparta jest na pięciu zasadach: polityka musi być weryfikowalna przed uruchomieniem agenta; egzekucja musi zachodzić poza zasięgiem agenta; ścieżka do modelu to główny punkt kontroli i obserwacji; uprawnienia agentów powinny rozszerzać się wraz z przejrzystością ich rozumowania; odpowiedzialność za bezpieczeństwo jest współdzielona między laboratoriami, przedsiębiorstwami i dostawcami sprzętu.
Badania samej NVIDIA podkreślają problem “dryfu” — gdy agent odbiega od zamierzonego zadania ze względu na niejasne instrukcje, ograniczenia polityki, brak narzędzi lub długi czas autonomicznego działania. Firma wskazuje, że nie da się całkowicie wyeliminować tego zjawiska bez ograniczenia możliwości agenta, dlatego nie można oczekiwać, że będą one w takich sytuacjach samodzielnie kontrolować swoje zachowanie.
Egzekwowanie na poziomie sprzętowym na dużą skalę
Architektura obejmuje trzy warstwy: aplikacyjną (modele, narzędzia, frameworki i dane), uruchomieniową (orkiestracja i egzekucja polityk) oraz infrastrukturę (zasoby obliczeniowe, magazynowanie i sieć). Dla organizacji wymagających oddzielnej drugiej warstwy NVIDIA Sentry, poprzez NVIDIA DOCA, rozszerza monitoring i egzekwowanie na jednostki przetwarzania danych BlueField-4, powiązując interakcje agentów, decyzje polityk i dostęp do danych z zapisem aktywności kontekstowej przy jednoczesnej ciągłej weryfikacji tożsamości i uprawnień każdego agenta.
W konfiguracji NVIDIA Vera Rubin POD, BlueField-4 DPU znajduje się na jedynej ścieżce z węzła do modelu, zapewniając obserwowalność out-of-band oraz egzekwowanie polityk w czasie rzeczywistym i z prędkością linii, a jednocześnie jest odseparowany od hosta. Dzięki temu możliwa jest ochrona na poziomie “chipu” nawet w przypadku nieufnych zasobów hosta. NVIDIA podaje, że w przypadku istniejących wdrożeń Vera i BlueField-4 wystarczy aktualizacja oprogramowania do uruchomienia tych zabezpieczeń; platforma jest również kompatybilna z hardwarem innych producentów niż NVIDIA.
NVIDIA informuje, że współpracuje z czołowymi laboratoriami, deweloperami i dostawcami infrastruktury, by stworzyć tę platformę jako otwartą bazę dla nowej gospodarki agentów, a niezależną, opartą na sprzęcie kontrolę wskazuje jako warunek konieczny dla skalowalnych i zaufanych autonomicznych systemów.

Zastrzeżenie: Treść tego artykułu odzwierciedla wyłącznie opinię autora i nie reprezentuje platformy w żadnym charakterze. Niniejszy artykuł nie ma służyć jako punkt odniesienia przy podejmowaniu decyzji inwestycyjnych.

