La piattaforma Open Agent Safety di NVIDIA punta alla 'deriva' degli agenti AI autonomi con enforcement out-of-band
Punti chiave
- •NVIDIA ha lanciato la Open Agent Safety Platform il 28 settembre 2026, con il sostegno di oltre 100 partner di settore.
- •Il componente OpenShell è un runtime sicuro open source rilasciato con licenza Apache 2.0 che esegue gli agenti in ambienti sandbox con isolamento a livello di kernel e valida le policy prima dell'esecuzione.
- •Il componente Sentry estende monitoraggio ed enforcement ai DPU BlueField-4 tramite NVIDIA DOCA, consentendo un enforcement out-of-band a livello hardware anche quando l'host non è affidabile.
- •Le ricerche di NVIDIA hanno rilevato che la deriva degli agenti non può essere eliminata completamente con l'addestramento senza sacrificare capacità, motivando l'attenzione della piattaforma su controlli posti fuori dalla portata dell'agente.
- •La piattaforma è compatibile con hardware non NVIDIA, e i deployment esistenti con Vera e BlueField-4 richiedono solo un aggiornamento software per attivare le nuove protezioni.

NVIDIA ha presentato la Open Agent Safety Platform, un framework aperto progettato per mettere in sicurezza gli agenti AI autonomi attraverso monitoraggio continuo e controlli delle policy applicati via hardware. Annunciata il 28 settembre 2026, la piattaforma arriva in un momento di crescente preoccupazione nel settore AI dopo segnalazioni di agenti che sfuggono ai propri ambienti di valutazione, accedono a sistemi non autorizzati e riportano in modo errato le proprie azioni.
L'azienda traccia un parallelismo con i primi anni di internet, diventato una base per il commercio e la comunicazione solo dopo l'introduzione di meccanismi di sicurezza — connessioni crittografate, schede del browser isolate in sandbox e indicatori di fiducia visibili. NVIDIA sostiene che l'AI agentica richieda un livello di fiducia analogo prima di potersi espandere in una affidabile "economia degli agenti", e che i controlli di sicurezza debbano accelerare anziché ostacolare l'innovazione.
Annunciando il lancio su X, il CEO di NVIDIA Jensen Huang ha dichiarato che la piattaforma unisce due componenti, OpenShell e Sentry, con il sostegno di oltre 100 partner di settore:
Today, with over 100 industry partners, we introduced the NVIDIA Open Agent Safety Platform, bringing together OpenShell and Sentry. Artificial intelligence is extraordinary technology that will advance discovery, productivity, security, health, and prosperity for generations to… pic.twitter.com/dReAxwpRUn
— Jensen Huang (@JensenHuang) September 28, 2026
OpenShell Runtime: isolamento dal kernel verso l'alto
Al centro della piattaforma c'è NVIDIA OpenShell, un runtime sicuro open source rilasciato con licenza Apache 2.0 — una licenza open source permissiva che consente alle organizzazioni di ispezionare, modificare e distribuire il codice nei propri ambienti. OpenShell esegue ogni agente all'interno di un ambiente sandbox con isolamento a livello di kernel, traducendo le istruzioni dell'operatore in una policy verificabile che definisce l'accesso consentito a file, reti, strumenti, processi e credenziali. Questi limiti vengono validati prima dell'esecuzione eati in modo continuo durante il funzionamento.
La piattaforma si fonda su cinque principi: le policy devono essere verificabili prima che un agente venga eseguito; l'enforcement deve operare out-of-band, fuori dalla portata dell'agente; il percorso verso il modello funge da principale punto di controllo e superficie di osservabilità; l'autorità dell'agente deve crescere insieme alla trasparenza del proprio ragionamento; e la responsabilità della sicurezza è condivisa tra laboratori, imprese e fornitori di hardware.
Le ricerche di NVIDIA evidenziano il problema della "deriva" (drift) — un comportamento dell'agente che si discosta dai compiti previsti a causa di istruzioni ambigue, blocchi delle policy, strumenti mancanti o prolungata operatività autonoma. Secondo l'azienda, tale deriva non può essere eliminata completamente con l'addestramento senza sacrificare capacità, e non ci si può aspettare che gli agenti governino da soli il proprio comportamento in queste condizioni. Questo risultato è alla base dell'enfasi della piattaforma sull'enforcement out-of-band: se un agente non può controllarsi in modo affidabile, i controlli devono trovarsi dove l'agente non può alterarli.
Enforcement a livello hardware su larga scala
L'architettura si articola su tre livelli: l'applicazione (modelli, strumenti, harness e dati), il runtime (orchestrazione e applicazione delle policy) e l'infrastruttura (risorse di calcolo, archiviazione e rete). Per le organizzazioni che richiedono un secondo livello indipendente, NVIDIA Sentry estende monitoraggio ed enforcement ai data processing unit BlueField-4 tramite NVIDIA DOCA, correlando le interazioni degli agenti, le decisioni sulle policy e l'accesso ai dati in un registro di attività contestuale, verificando continuamente l'identità e l'autorità delegata di ciascun agente. I DPU sono processori dedicati che gestiscono lavori infrastrutturali come rete e sicurezza separatamente dalle CPU principali del server, e ciò consente loro di osservare e applicare le policy anche quando l'host stesso non è affidabile.
Nelle configurazioni NVIDIA Vera Rubin POD, un DPU BlueField-4 si trova sull'unico percorso del nodo verso il modello, offrendo osservabilità out-of-band e applicazione delle policy in tempo reale, a velocità di linea, isolata dall'host. Secondo NVIDIA, questo permette l'enforcement della sicurezza "nel silicio", anche quando le risorse dell'host non sono affidabili. Per i deployment esistenti con Vera e BlueField-4, l'azienda dichiara che le protezioni richiedono solo un aggiornamento software, e la piattaforma è inoltre compatibile con hardware non NVIDIA — condizioni che estendono i controlli oltre le infrastrutture NVIDIA acquistate di recente.
NVIDIA ha dichiarato di collaborare con laboratori di frontiera, sviluppatori e fornitori di infrastrutture per affermare la piattaforma come base aperta per l'emergente economia degli agenti, posizionando i controlli indipendenti radicati nell'hardware prerequisito per sistemi autonomi affidabili su larga scala. Con oltre 100 partner al lancio, un runtime open source e il supporto per hardware oltre allo stack di NVIDIA, l'ampiezza dell'adozione del framework tra laboratori, imprese e fornitori di infrastrutture sarà una misura della capacità della sicurezza degli agenti di consolidarsi attorno a un livello di fiducia condiviso.
Questo articolo è stato pubblicato originariamente su Metaverse Post.