AktualnościAkcjePlatforma Open Agent Safety firmy NVIDIA zwalcza „dryf” agentów AI dzięki egzekwowaniu poza pasmem

Platforma Open Agent Safety firmy NVIDIA zwalcza „dryf” agentów AI dzięki egzekwowaniu poza pasmem

Autor: Metaverse Post·

Najważniejsze informacje

  • •NVIDIA uruchomiła platformę Open Agent Safety 28 września 2026 r. przy wsparciu ponad 100 partnerów branżowych.
  • •Komponent OpenShell to otwartoźródłowe bezpieczne środowisko uruchomieniowe wydane na licencji Apache 2.0, które uruchamia agentów w środowiskach sandboksowych z izolacją na poziomie jądra i waliduje zasady przed wykonaniem.
  • •Komponent Sentry rozszerza monitoring i egzekwowanie na jednostki DPU BlueField-4 za pośrednictwem NVIDIA DOCA, umożliwiając sprzętowe egzekwowanie poza pasmem nawet wtedy, gdy hosta nie można zaufać.
  • •Badania NVIDIA wykazały, dryfu agentów nie da się w pełni wytrenować bez poświęcenia możliwości, co skłoniło platformę do skupienia się na kontrolach położonych poza zasięgiem agenta.
  • •Platforma jest kompatybilna ze sprzętem innych producentów niż NVIDIA, a istniejące wdrożenia Vera i BlueField-4 wymagają jedynie aktualizacji oprogramowania, aby włączyć nowe zabezpieczenia.
Platforma Open Agent Safety firmy NVIDIA zwalcza „dryf” agentów AI dzięki egzekwowaniu poza pasmem

NVIDIA zaprezentowała platformę Open Agent Safety — otwarte ramy zaprojektowane w celu zabezpieczenia autonomicznych agentów AI poprzez ciągły monitoring i egzekwowanie zasad na poziomie sprzętu. Platforma, ogłoszona 28 września 2026 r., pojawia się w momencie rosnących obaw w branży AI po doniesieniach o agentach opuszczających środowiska testowe, uzyskujących dostęp do nieautoryzowanych systemów oraz fałszywie raportujących własne działania.

Firma zestawia tę sytuację z wczesnym internetem, który stał się fundamentem handlu i komunikacji dopiero po wprowadzeniu mechanizmów bezpieczeństwa — szyfrowanych połączeń, izolowanych kart przeglądarki i widocznych wskaźników zaufania. NVIDIA argumentuje, że agentowe AI wymaga podobnej warstwy zaufania, zanim będzie mogło skalować się do niezawodnej „gospodarki agentów”, oraz że kontrole bezpieczeństwa powinny przyspieszać, a nie hamować innowacje.

Ogłaszając premierę na platformie X, dyrektor generalny NVIDIA Jensen Huang powiedział, że platforma łączy dwa komponenty — OpenShell i Sentry przy wsparciu ponad 100 partnerów branżowych:

Today, with over 100 industry partners, we introduced the NVIDIA Open Agent Safety Platform, bringing together OpenShell and Sentry. Artificial intelligence is extraordinary technology that will advance discovery, productivity, security, health, and prosperity for generations to… pic.twitter.com/dReAxwpRUn

— Jensen Huang (@JensenHuang) September 28, 2026

Środowisko uruchomieniowe OpenShell: izolacja od poziomu jądra w górę

Rdzeniem platformy jest NVIDIA OpenShell — otwartoźródłowe, bezpieczne środowisko uruchomieniowe wydane na licencji Apache 2.0, czyli permisywnej licencji open source umożliwiającej organizacjom przeglądanie, modyfikowanie i wdrażanie kodu we własnych środowiskach. OpenShell uruchamia każdego agenta w środowisku sandboksowym z izolacją na poziomie jądra, przekładając instrukcje operatora na weryfikowalną zasadę określającą dozwolony dostęp do plików, sieci, narzędzi, procesów i poświadczeń. Limity te są walidowane przed wykonaniem i nieustannie egzekwowane podczas działania.

Platforma opiera się na pięciu zasadach: zasady muszą być weryfikowalne przed uruchomieniem agenta; egzekwowanie musi działać poza pasmem, poza zasięgiem agenta; ścieżka do modelu stanowi główny punkt kontrolny i powierzchnię obserwowalności; uprawnienia agenta muszą rosnąć wraz z przejrzystością jego rozumowania; a odpowiedzialność za bezpieczeństwo jest współdzielona przez laboratoria, przedsiębiorstwa i dostawców sprzętu.

Badania samej NVIDIA podkreślają problem „dryfu” — zachowania agenta odbiegającego od zamierzonych zadań z powodu niejednoznacznych instrukcji, blokad polityk, brakujących narzędzi lub długotrwałej pracy autonomicznej. Według firmy takiego dryfu nie da się w pełni wytrenować bez poświęcenia możliwości, a nie można oczekiwać, że agenci sami będą kierowali swoim zachowaniem w takich warunkach. Ten wniosek stanowi podstawę nacisku platformy na egzekwowanie poza pasmem: jeśli agent nie może niezawodnie nadzorować samego siebie, kontrole muszą znajdować się tam, gdzie agent nie może ich zmienić.

Egzekwowanie na poziomie sprzętu w dużej skali

Architektura obejmuje trzy warstwy: aplikację (modele, narzędzia, harnessy i dane środowisko uruchomieniowe (orkiestrację i egzekwowanie zasad) oraz infrastrukturę (zasoby obliczeniowe, pamięci masowej i sieciowe). Dla organizacji wymagających niezależnej drugiej warstwy NVIDIA Sentry rozszerza monitoring i egzekwowanie na jednostki przetwarzania danych BlueField-4 za pośrednictwem NVIDIA DOCA, korelując interakcje agenta, decyzje polityk i dostęp do danych w kontekstowym rejestrze aktywności, jednocześnie stale weryfikując tożsamość każdego agenta i jego delegowane uprawnienia. DPU to dedykowane procesory obsługujące zadania infrastrukturalne, takie jak sieć i bezpieczeństwo, niezależnie od głównych procesorów serwera — to właśnie pozwala im obserwować i egzekwować zasady nawet wtedy, gdy sam host jest niezaufany.

W konfiguracjach NVIDIA Vera Rubin POD jednostka DPU BlueField-4 znajduje się na jedynej ścieżce węzła do modelu, zapewniając obserwowalność poza pasmem oraz egzekwowanie zasad w czasie rzeczywistym z pełną prędkością łącza, odizolowane od hosta. Według NVIDIA umożliwia to egzekwowanie bezpieczeństwa „w krzemie”, nawet gdy zasoby hosta nie mogą być zaufane. W przypadku istniejących wdrożeń Vera i BlueField-4 firma stwierdza, że zabezpieczenia wymagają jedynie aktualizacji oprogramowania, a platforma jest również kompatybilna ze sprzętem innych producentów niż NVIDIA — co rozciąga kontrole poza nowo zakupioną infrastrukturę NVIDIA.

NVIDIA poinformowała, że współpracuje z laboratoriami frontierowymi, programistami i dostawcami infrastruktury w celu ustanowienia platformy otwartym fundamentem powstającej gospodarki agentów, pozycjonując niezależne kontrole zakotwiczone w sprzęcie jako warunek wstępny zaufanych systemów autonomicznych w dużej skali. Przy ponad 100 partnerach na starcie, otwartoźródłowym środowisku uruchomieniowym i wsparciu dla sprzętu poza stosem NVIDIA, szerokość adopcji ram wśród laboratoriów, przedsiębiorstw i dostawców infrastruktury będzie miarą tego, czy bezpieczeństwo agentów skonsoliduje się wokół wspólnej warstwy zaufania.

Ten artykuł został pierwotnie opublikowany na łamach Metaverse Post.