OpenAI ha sospeso alcune attività legate ad Astra per risultati di cybersecurity "critici"; l'addestramento è proseguito, afferma Altman
Punti chiave
- •OpenAI ha dichiarato che le capacità di cybersecurity di Astra hanno raggiunto o si sono avvicinate al livello "critico" del proprio Preparedness Framework.
- •Il modello ha mostrato avanzate capacità di coding agentico e il potenziale di trovare o sfruttare vulnerabilità zero-day.
- •OpenAI ha sospeso le attività interne interessate per poco più di due settimane mentre implementava nuove misure di sicurezza.
- •Sam Altman ha affermato che l'addestramento principale di Astra non si è fermato e che i nuovi modelli sono ancora attesi a breve.

OpenAI ha interrotto alcune attività interne connesse al proprio modello Astra il 7 agosto 2026, dopo che risultati preliminari indicavano che l'AI aveva raggiunto ciò che l'azienda classifica come capacità di cybersecurity "critiche". L'amministratore delegato Sam Altman ha però sottolineato che l'addestramento principale di Astra non si è mai fermato e che i nuovi modelli restano in programma per un rilascio a breve.
Cosa ha innescato la sospensione
La preoccupazione riguarda le capacità di cybersecurity di Astra, che secondo quanto riportato hanno raggiunto o si sono avvicinate al livello "critico" del Preparedness Framework di OpenAI — la classificazione più alta utilizzata dall'azienda per valutare i rischi dei modelli.
In termini pratici, il modello ha dimostrato sofisticate capacità di coding agentico e il potenziale di identificare o sfruttare vulnerabilità zero-day. Le vulnerabilità zero-day sono falle di sicurezza di cui i fornitori di software non sono ancora a conoscenza, il che le rende straordinariamente preziose sia per i difensori sia per gli attaccanti. La scoperta di vulnerabilità guidata dall'AI è già un campo di lavoro attivo: l'AI Cyber Challenge della DARPA, la cui finale si è tenuta alla conferenza di hacking DEF CON nel 2025, ha incaricato sistemi AI di trovare e correggere falle in software open source ampiamente utilizzati, sottolineando tanto la promessa difensiva quanto il rischio di duplice uso della capacità in questione.
La sospensione è durata poco più di due settimane, durante le quali OpenAI ha implementato nuove misure di sicurezza attorno a quelle specifiche capacità. In quel lasso di tempo, l'azienda ha valutato i rischi e messo in atto adeguate misure di tutela prima di riprendere le attività interessate.
Le capacità più ampie di Astra
La dimensione della cybersecurity è solo una sfaccettatura di quello che sembra essere un modello eccezionalmente potente. Una versione precedente di Astra, secondo quanto riportato, avrebbe risolto 10 importanti problemi aperti in matematica e informatica teorica — un risultato che, se verificato in modo indipendente, rappresenterebbe una pietra miliare nella ricerca sull'AI.
Altman ha dichiarato che Astra è destinata a essere resa "generalmente disponibile", il che significa che non resterà indefinitivamente bloccata dietro un accesso riservato alla ricerca. Ha però riconosciuto che serve più tempo per garantire che il modello sia sviluppato in sicurezza, con un'attenzione particolare alle sue capacità informatiche prima di un rilascio più ampio.
L'equilibrio tra sicurezza e velocità
Il Preparedness Framework di OpenAI è stato ideato esattamente per situazioni di questo tipo. Introdotto nell'ottobre 2023, il framework stabilisce livelli di rischio, da "basso" a "critico", in categorie che includono cybersecurity, persuasione, autonomia e minacce biologiche. Quando un modello raggiunge il livello critico in una qualsiasi categoria, vengono attivati ulteriori passaggi di revisione e mitigazione prima che l'implementazione possa procedere.
Oggi esistono schemi comparabili in tutto il panorama dei laboratori di frontiera: la Responsible Scaling Policy di Anthropic e la Frontier Safety Framework di Google DeepMind definiscono entrambe soglie di capacità che attivano misure di sicurezza più stringenti, rendendo la valutazione dei rischi a livelli una norma emergente del settore. Il segnalato raggiungimento del livello critico da parte di Astra è tra gli esempi pubblici più chiari finora di una simile soglia invocata in un grande laboratorio.
La rilevanza del framework giunge inoltre dopo un periodo movimentato per la governance della sicurezza di OpenAI. Nel 2024, l'azienda ha sciolto il team Superalignment dedicato al lungo termine in seguito alle partenze dei co-responsabili Ilya Sutskever e Jan Leike, integrandone il lavoro in sforzi di sicurezza più ampi — una sequenza che ha mantenuto sotto gli occhi del pubblico le domande sull'equilibrio dell'azienda tra ritmo e precauzione.
Cosa osservare d'ora in avanti
La questione a breve termine è quando Astra, o modelli da essa derivati, verrà effettivamente rilasciata agli utenti. La dichiarazione di Altman secondo cui i nuovi modelli sono attesi a breve suggerisce che i tempi non siano cambiati in modo drastico nonostante la sospensione.
Vale inoltre la pena monitorare se OpenAI pubblicherà risultati dettagliati della propria valutazione di sicurezza. Un modello che raggiunge il livello critico di rischio nella cybersecurity sembrerebbe richiedere un rendiconto pubblico approfondito di ciò che è stato riscontrato e delle mitigazioni messe in atto — e, con Anthropic e Google DeepMind che gestiscono framework simili basati su soglie, se i laboratori paritari inizieranno a divulgare valutazioni comparabili.