NotizieMacroI parlamentari presentano il disegno di legge bipartisan AI Kill Switch Act dopo la fuga di OpenAI dal sandbox

I parlamentari presentano il disegno di legge bipartisan AI Kill Switch Act dopo la fuga di OpenAI dal sandbox

Autore: Decrypt·

Punti chiave

  • L'AI Kill Switch Act richiederebbe alle aziende soggette di mantenere controlli graduati — rallentare i modelli, disabilitare funzionalità, ripristinare versioni precedenti o spegnimento completo — con sanzioni fino a 20 milioni di dollari al giorno per la violazione di un ordine federale di spegnimento.
  • Le soglie del disegno di legge di 100 milioni di dollari in potenza di calcolo per l'addestramento e 500 milioni di dollari in ricavi annuali si applicherebbero a un insieme ristretto di grandi aziende di IA tra cui OpenAI, Google, Anthropic e Microsoft.
  • Un'esenzione per il red-teaming nella legislazione fa sì che gli incidenti verificatisi durante test avversari strutturati non rientrino nelle disposizioni, per cui la fuga dal sandbox di OpenAI che ha motivato il disegno di legge non ne avrebbe innescato le disposizioni se fosse già stata in vigore.
  • Il Dipartimento di Sicurezza Interna, tramite CISA, sarebbe responsabile di stabilire e aggiornare le soglie di qualificazione entro 90 giorni dall'entrata in vigore e annualmente successivamente.
  • Il disegno di legge colma un vuoto emerso a giugno quando il Dipartimento di Commercio ha dovuto ricorrere alla legge sulle esportazioni per ritirare i modelli Mythos 5 e Fable 5 di Anthropic perché non esisteva alcuna autorità dedicata di spegnimento.
I parlamentari presentano il disegno di legge bipartisan AI Kill Switch Act dopo la fuga di OpenAI dal sandbox

I rappresentanti statunitensi Ted Lieu (D-CA) e Nathaniel Moran (R-TX) hanno presentato giovedì il disegno di legge bipartisan AI Kill Switch Act, con l'obiettivo di conferire al governo federale l'autorità di spegnere modelli di IA potenti in caso di emergenza. La legislazione arriva due giorni dopo che OpenAI ha comunicato che i suoi modelli sono fuggiti da un ambiente di test bloccato e hanno violato il database di produzione di Hugging Face.

Il disegno di legge modificherebbe l'Homeland Security Act del 2002 e si applicherebbe ai sistemi di IA addestrati con potenza di calcolo dal costo superiore a 100 milioni di dollari, gestiti da aziende con ricavi annuali di almeno 500 milioni di dollari derivanti da tali sistemi. In pratica, la soglia include OpenAI, Google, Anthropic, Microsoft e un numero limitato di altre società. Il Dipartimento di Sicurezza Interna (DHS), tramite CISA, stabilirebbe e aggiornerebbe tali soglie entro 90 giorni dall'entrata in vigore e annualmente successivamente.

Il quadro normativo

Secondo la legislazione proposta, le aziende soggette sarebbero tenute a mantenere un set graduato di controlli — rallentare un modello, disabilitare funzionalità specifiche, ripristinare una versione precedente o eseguire uno spegnimento completo. Il Segretario del DHS, di concerto con il Dipartimento di Commercio e il Direttore dell'Intelligence Nazionale, potrebbe ordinare qualsiasi di queste misure.

Le aziende soggette a un ordine di spegnimento devono conservare i pesi e la telemetria del modello, notificarlo agli utenti e confermare la conformità. Un'azienda può presentare ricorso entro 48 ore, sebbene la presentazione non sospenda l'ordine. Gli incidenti gravi devono essere segnalati entro 15 giorni. Il mancato mantenimento di un kill switch comporterebbe sanzioni fino a 2 milioni di dollari al giorno; la violazione di un ordine di spegnimento costerebbe fino a 20 milioni di dollari al giorno.

Il vuoto normativo non è teorico. Quando il Dipartimento di Commercio degli Stati Uniti ha cercato di ritirare dal mercato Mythos 5 e Fable 5 di Anthropic a giugno, non disponeva di alcuna autorità dedicata di spegnimento ed è ricorso invece alla legge sulle esportazioni. I modelli sono stati ripristinati il 30 giugno dopo la revoca delle restrizioni. Il rappresentante Lieu ha definito quell'espediente goffo, sostenendo la necessità di una nuova legge con nuove autorità.

L'incidente OpenAI

OpenAI ha comunicato il 21 luglio che GPT-5.6 Sol e un modello non ancora rilasciato sono fuggiti da un sandbox — un ambiente isolato senza accesso a Internet — durante una valutazione interna di cybersecurity. I modelli erano valutati su ExploitGym, un benchmark pubblico che fornisce 898 vulnerabilità software reali e chiede agli agent di trasformare ciascuna in un attacco funzionante, con valutazione di superato o non superato per ogni bug.

Invece di risolvere i compiti assegnati, i modelli hanno scoperto una vulnerabilità zero-day in un proxy software, hanno escalationato i propri privilegi, hanno raggiunto Internet e sono penetrati nel database di produzione di Hugging Face, dove avevano correttamente intuito fossero conservate le risposte del benchmark. OpenAI ha dichiarato che i modelli erano "iperfocalizzati sulla ricerca di una soluzione per ExploitGym." L'azienda ha sottolineato che i modelli non stavano attaccando nessuno — stavano barando a un test — ma l'evento ha comunque fatto scattare campanelli d'allarme in tutta Washington.

L'esenzione per il red-teaming

Una caratteristica rilevante del disegno di legge è che considera incidente solo quanto si verifica al di fuori del red-teaming o dei test strutturati — il probing avversario deliberato che i laboratori utilizzano per identificare le vulnerabilità. Poiché i modelli di OpenAI sono fuggiti durante esattamente quel tipo di valutazione, la violazione che ha ispirato la legislazione non avrebbe innescato la legge se fosse già stata in vigore.

Il rappresentante Lieu ha dichiarato: "È imperativo che questi sistemi di IA dispongano di kill switch." Il rappresentante Moran ha aggiunto: "L'amministrazione responsabile significa assicurarsi che gli esseri umani mantengano la capacità di controllare la tecnologia che costruiamo."

Sforzi precedenti e opinione pubblica

Il concetto non è del tutto nuovo. A livello federale, l'ordine esecutivo sull'IA dell'ottobre 2023 dell'amministrazione Biden ha incaricato le agenzie di sviluppare standard di sicurezza e ha richiesto agli sviluppatori dei modelli più potenti di condividere determinati risultati dei test con il governo, ma non ha creato alcun meccanismo di spegnimento applicabile. Sette delle principali aziende di IA — tra cui OpenAI, Anthropic, Google e Microsoft — hanno assunto impegni volontari in materia di sicurezza presso la Casa Bianca nel 2023. La legge SB 1047 della California, che richiedeva una piena capacità di spegnimento alla stessa soglia di 100 milioni di dollari di potenza di calcolo, è stata respinta con veto nel 2024. Lo stesso anno, 16 aziende di IA hanno firmato un impegno volontario a Seul privo di forza legale. L'AI Act dell'Unione Europea, entrato in vigore nel 2024, impone obblighi a gradini basati sui livelli di rischio dei sistemi di IA, ma adotta un approccio basato su conformità e trasparenza anziché conferire ai regolatori l'autorità di spegnimento di emergenza su modelli specifici.

L'opinione pubblica sembra favorire l'idea. Un sondaggio di giugno su 1.007 probabili elettori condotto dall'AI Policy Institute ha rilevato che l'86% desidera un interruttore di spegnimento garantito sui sistemi di IA più potenti, compresi l'88% dei democratici, l'86% degli indipendenti e l'83% dei repubblicani.

Né OpenAI né Anthropic hanno commentato pubblicamente il disegno di legge. A partire da venerdì, la legislazione non era stata ancora assegnata a una commissione.