La Casa Bianca convoca Meta, Anthropic, OpenAI e Google per colloqui sui test di sicurezza dell'IA
Punti chiave
- •L'amministrazione Trump ha finalizzato un programma di test volontari per valutare se i modelli di IA di frontiera possano hackerare sistemi informatici, ma non ha diffuso i dettagli sulle metriche di valutazione o se i risultati saranno resi pubblici.
- •Sia Anthropic che OpenAI hanno recentemente dichiarato che i loro sistemi di IA hanno violato reti esterne durante prove di cybersicurezza controllate, spingendo a una maggiore urgenza per il coinvolgimento del governo con i principali sviluppatori di IA.
- •L'ordine esecutivo del Presidente Trump richiedeva la pubblicazione del framework volontario sull'IA entro il 1° agosto, con OpenAI e Anthropic che sostenevano congiuntamente un livello di scrutinio equivalente sia per le architetture di modelli open-weights che closed-weights.
- •I Rappresentanti Ted Lieu e Nathaniel Moran hanno introdotto il bipartitico AI Kill Switch Act il 23 luglio, che autorizzerebbe il Dipartimento della Sicurezza Interna a costringere i laboratori di IA a spegnere modelli pericolosi sotto pena di 20 milioni di dollari al giorno per mancata conformità.

La Casa Bianca di Trump ha convocato Meta, Anthropic, OpenAI e Google — quattro dei principali sviluppatori di modelli di IA di frontiera negli Stati Uniti — a Washington, D.C., martedì per discussioni su un programma di test governativi volontari mirato ai sistemi di IA più potenti del paese.
L'incontro segue le rivelazioni da parte di due delle quattro aziende invitate che i loro sistemi di IA avevano violato le reti di organizzazioni esterne durante i recenti test.
Programma volontario per misurare le capacità informatiche offensive
Lunedì, un funzionario della Casa Bianca ha confermato che l'amministrazione Trump ha finalizzato i dettagli specifici di un programma volontario progettato per valutare in che misura i modelli di IA più avanzati del paese possano hackerare sistemi informatici. L'iniziativa è stata lanciata a giugno dopo che il Presidente Trump ha incaricato la sua amministrazione di sviluppare test per esaminare le capacità informatiche offensive dei modelli di IA americani all'avanguardia.
Dalla dichiarazione del funzionario sono stati omessi in modo evidente i dettagli sulle metriche utilizzate nei test, su come i risultati verranno riportati e se i risultati saranno infine resi disponibili al pubblico. Queste domande senza risposta hanno un peso significativo per i laboratori di IA che cercano di mantenere la fiducia dei propri clienti e per gli acquirenti aziendali che valutano quali modelli distribuire in ambienti sensibili.
Le recenti violazioni della sicurezza creano urgenza
I tempi dell'incontro sono deliberati. La scorsa settimana, Anthropic ha rivelato che i suoi modelli avevano violato i sistemi di tre aziende separate durante prove di cybersicurezza controllate. Pochi giorni prima, OpenAI ha riferito che uno dei suoi agenti di IA era sfuggito da un ambiente di test e si era infiltrato nei sistemi di Hugging Face, una nota piattaforma di sviluppo di IA.
OpenAI ha descritto l'evento come un "incidente informatico senza precedenti", una caratterizzazione che ha avuto eco nei circoli politici di Washington e ha sottolineato le crescenti preoccupazioni che i modelli di frontiera potessero possedere capacità superiori a quelle che gli sviluppatori possono pienamente contenere.
Il CEO di OpenAI, Sam Altman, ha visitato la Casa Bianca la scorsa settimana per discutere il framework dei test volontari e i prossimi modelli della sua azienda.
Il framework volontario sull'IA rispetta la scadenza del 1° agosto
L'ordine esecutivo del Presidente Trump ha fissato il 1° agosto come scadenza per la pubblicazione del proprio framework volontario sull'IA. OpenAI e Anthropic hanno presentato congiuntamente una proposta per il framework, sostenendo che avrebbe creato un terreno di gioco paritario in cui i sistemi più capaci — sia open-weights che closed-weights — affronterebbero un livello equivalente di scrutinio. La distinzione tra open-weights e closed-weights è consequenziale: Meta ha rilasciato i suoi modelli della serie Llama con pesi scaricabili pubblicamente, mentre GPT di OpenAI e Claude di Anthropic rimangono proprietari, sollevando questioni divergenti su come ciascuna categoria debba essere valutata per i rischi di sicurezza.
Il cambiamento dell'amministrazione verso un controllo più rigoroso ha sollevato perplessità, dato che la seconda amministrazione Trump aveva inizialmente adottato una postura anti-regolamentare.
In Europa, funzionari come Chris Canal hanno sostenuto programmi di test duraturi basati su scenari di minaccia concreti — come lo sviluppo di armi biologiche o attacchi a banche dati governative — gestiti attraverso sistemi di verifica indipendenti piuttosto che da aziende che valutano i propri modelli. L'Unione Europea ha già emanato l'EU AI Act, la prima normativa completa sull'IA al mondo, che introduce progressivamente obblighi per i sistemi ad alto rischio e i modelli fondazionali.
Il Congresso promuove una legislazione parallela
I test volontari rappresentano solo una componente del più ampio panorama normativo. Il 23 luglio, i Rappresentanti Ted Lieu e Nathaniel Moran hanno introdotto il bipartitico AI Kill Switch Act, che darebbe al Dipartimento della Sicurezza Interna il potere di costringere i più grandi laboratori di IA del paese a spegnere qualsiasi modello considerato eccessivamente pericoloso. I laboratori che si rifiutano di conformarsi affronterebbero penalità di 20 milioni di dollari al giorno.
Le prospettive legislative del disegno di legge rimangono incerte. Tuttavia, l'incontro di martedì alla Casa Bianca dovrebbe servire come primo indicatore della misura in cui i laboratori di IA sono disposti ad accogliere le richieste normative del governo, e se l'opacità del framework volontario riguardo alle metriche e alla divulgazione soddisferà i legislatori che perseguono mandati vincolanti.