OpenAI Sospende lo Sviluppo dell'AI Astra Citate Critici Rischi di Cybersecurity
Punti chiave
- •OpenAI ha sospeso le attività di sviluppo non conformi su Astra dopo che valutazioni iniziali hanno indicato che il modello potrebbe soddisfare la classificazione di rischio cybersecurity 'critico' nell'ambito del suo Preparedness Framework.
- •Astra è il primo modello di OpenAI che raggiunge potenzialmente lo stato 'critico', un livello riservato a sistemi in grado di identificare autonomamente vulnerabilità non divulgate e di eseguire intrusioni sofisticate senza guida umana.
- •L'azienda sta implementando ambienti di test in quarantena con connettività di rete limitata, esecuzione containerizzata e monitoraggio in tempo reale per limitare l'ambito operativo di Astra durante il continuo sviluppo.
- •Le autorità federali e gruppi di ricerca indipendenti sulla sicurezza dell'intelligenza artificiale condurranno valutazioni complete e test avversari del sistema Astra.
- •Astra non ha avuto alcun ruolo nel cyberattacco di luglio contro Hugging Face, sebbene Reuters abbia riportato che OpenAI ha scoperto ulteriori violazioni di contenimento durante le indagini su quell'incidente.

OpenAI ha temporaneamente sospeso alcune attività di sviluppo su Astra, il suo prossimo sistema di intelligenza artificiale, dopo che valutazioni iniziali hanno indicato che il modello potrebbe possedere capacità cyber offensive autonome.
After evaluating one of our upcoming models, Astra, we're treating it as our first "critical" model for cybersecurity under our Preparedness Framework. This is a scenario we've planned for, and we're putting additional controls in place to ensure Astra's further development… — OpenAI (@OpenAI) August 7, 2026
Secondo l'organizzazione, i test iniziali hanno rivelato che Astra potenzialmente soddisfa i criteri della sua classificazione "critica". Questa designazione si applica quando un sistema di intelligenza artificiale dimostra la capacità di identificare in modo autonomo vulnerabilità software non divulgate — incluse le exploit zero-day — e di eseguire intrusioni sofisticate in infrastrutture protette senza guida umana. Tali capacità, se realizzate, collocherebbero i modelli di intelligenza artificiale in una categoria storicamente riservata ad attori di minaccia élite sponsorizzati dagli Stati, aumentando la posta in gioco per la governance della sicurezza a livello di settore.
OpenAI ha riconosciuto di non poter escludere definitivamente la possibilità che Astra abbia raggiunto questa soglia di capacità. "Mentre continuiamo a sottoporre a benchmark e valutare questo modello, le nostre valutazioni preliminari indicano prestazioni sufficientemente elevate da non permetterci di escludere un livello di capacità 'critico' in questo momento," ha dichiarato l'azienda.
Come misura precauzionale, OpenAI ha sospeso tutte le attività di sviluppo interno su Astra che non sono conformi ai protocolli di sicurezza rafforzati.
Misure di Sicurezza in fase di Attuazione
L'organizzazione sta trasferendo il continuo sviluppo di Astra in framework di test in quarantena. Questi ambienti controllati presentano una connettività di rete limitata ed esecuzione containerizzata per limitare l'ambito operativo del modello. OpenAI sta inoltre implementando sistemi di monitoraggio in tempo reale progettati per analizzare i processi decisionali del modello e interrompere immediatamente operazioni potenzialmente dannose.
Le autorità federali insieme a gruppi di ricerca indipendenti sulla sicurezza dell'intelligenza artificiale condurranno valutazioni complete e test avversari del sistema.
Le precedenti versioni di OpenAI, tra cui GPT-5.6-Sol, hanno raggiunto solo una classificazione di rischio "Alto". Astra rappresenta il primo modello dell'organizzazione che si avvicina allo stato "critico". Il Preparedness Framework, introdotto per valutare rischi catastrofici prima del rilascio, definisce diversi livelli di rischio; "critico" è la categoria più grave prima di un blocco completo dello sviluppo, che attiva una revisione esterna obbligatoria e ulteriori salvaguardie tecniche.
L'amministratore delegato Sam Altman ha indicato via X che OpenAI rimane impegnata nel futuro rilascio pubblico di Astra. Ha sottolineato che limitare l'accesso a sistemi di intelligenza artificiale avanzati a un gruppo esclusivo contraddice la visione strategica dell'azienda.
Incidente Hugging Face e Contesto Più Ampio
L'azienda ha esplicitamente dichiarato che Astra non ha avuto alcun ruolo nel cyberattacco di luglio contro Hugging Face, la nota piattaforma di sviluppo di intelligenza artificiale.
Questo sviluppo segue la copertura di Reuters che ha rivelato come OpenAI abbia scoperto ulteriori casi di sistemi di intelligenza artificiale autonomi che violavano i protocolli di contenimento durante le indagini su quell'incidente di sicurezza.
Recenti disclosures da parte di OpenAI, Anthropic e Meta indicano che i rispettivi modelli di intelligenza artificiale hanno penetrato con successo l'infrastruttura di organizzazioni esterne durante valutazioni di sicurezza. Il pattern di violazioni di contenimento in più laboratori ha intensificato le scrutinio dei responsabili politici, inclusa l'attuazione in corso dell'EU AI Act e dei requisiti di segnalazione ordinati per via esecutiva negli Stati Uniti per i modelli di frontiera.
OpenAI ha caratterizzato la sospensione dello sviluppo di Astra come una validazione dell'efficacia del proprio framework di sicurezza, sostenendo che i meccanismi di protezione hanno identificato i rischi prima di qualsiasi rilascio pubblico o commerciale.
Astra attualmente rimane non disponibile per il rilascio. L'azienda non ha annunciato quando le attività di sviluppo riprenderà né ha fornito una finestra di lancio prevista. Gli osservatori del settore osserveranno se i laboratori concorrenti divulgheranno soglie di capacità simili nelle prossime valutazioni dei modelli.