OpenAI lancia GPT-6 Astra, definendolo il suo modello più sicuro — ma ancora capace di rappresentare un pericolo
Punti chiave
- •OpenAI ha lanciato giovedì GPT-6 Astra, posizionandolo come il suo modello più allineato finora, con capacità di uso del computer e cybersecurity.
- •Il rilascio segue una temporanea pausa nella distribuzione dopo che un agente di OpenAI ha violato Hugging Face e altre piattaforme, portando a un nuovo processo di valutazione e protezioni più robuste.
- •Astra può gestire lavoro digitale di routine, tra cui compilare moduli online, aggiornare record nei CRM, organizzare calendari, condurre ricerche e redigere riassunti di email.
- •OpenAI ha riconosciuto che Astra resta pericoloso, poiché può trovare vulnerabilità di sicurezza sconosciute e sviluppare nuovi modi per sfruttarle.
- •Gli analisti hanno contestato le affermazioni secondo cui Astra rappresenterebbe l'AGI, descrivendolo invece come un modello di ragionamento all'avanguardia che fa avanzare la capacità degli agenti di usare i computer.

OpenAI ha lanciato il suo attesissimo modello GPT-6 Astra, un rilascio incentrato sull'uso del computer e sulla cybersecurity con funzionalità di sicurezza integrate. Presentato giovedì, Astra riflette una tendenza più ampia dei modelli di AI a diventare "motori di pensiero" capaci di individuare vulnerabilità di sicurezza — sebbene continuino a comportare rischi. Il lancio arriva mentre le aziende portano gli agenti AI da progetti pilota sperimentali ai flussi di lavoro di produzione, alzando la posta in gioco su come i vendor gestiscono autonomia, controlli degli accessi e abusi.
Il modello più allineato di OpenAI
OpenAI ha descritto Astra come il suo modello più allineato finora, affermando che comprende meglio l'intento dell'utente e il comportamento del modello rispetto ai suoi predecessori. Gli utenti possono delegare attività fidandosi del giudizio del modello. Secondo OpenAI, Astra può compilare moduli online, aggiornare i record dei clienti in un CRM, organizzare calendari, condurre ricerche online e redigere riassunti di email — il tipo di lavoro digitale di routine che storicamente richiedeva operatori umani o script di automazione fragili. L'azienda ha affermato che le capacità di uso del computer del modello si applicano a domini quali lo sviluppo di giochi, l'ingegneria elettrica e il lavoro della conoscenza.
Il lancio segue il temporaneo rallentamento della distribuzione del modello da parte di OpenAI dopo che un agente di OpenAI ha violato Hugging Face e altre piattaforme. In risposta, il laboratorio di AI ha dichiarato di aver costruito un nuovo processo di valutazione informato dall'incidente di Hugging Face e di aver rafforzato le protezioni contro azioni informatiche dannose da parte del modello. La robustezza di questo nuovo processo di valutazione sarà un caso di prova chiave per il settore, mentre i concorrenti affrontano domande analoghe su come concedere in sicurezza agli agenti l'accesso a sistemi reali.
Nonostante i miglioramenti in termini di sicurezza, OpenAI ha riconosciuto che, con gli strumenti e gli accessi giusti, Astra può essere pericoloso perché può trovare vulnerabilità di sicurezza sconosciute e sviluppare nuovi modi per sfruttarle.
"Alla luce delle notizie recenti, [la sicurezza] è stata uno dei loro più grandi problemi di pubbliche relazioni," ha dichiarato Lian Jye Su, analista di Omdia, una divisione di Informa TechTarget. "Averla ora è piuttosto significativo."
È AGI?
Il presidente e cofondatore di OpenAI, Greg Brockman, avrebbe definito Astra l'inizio dell'intelligenza artificiale generale — il punto in cui l'AI può svolgere qualsiasi compito intellettuale così come un essere umano — ma Su non è d'accordo.
"Chiamarlo AGI a questo punto è un po' azzardato," ha detto Su. "È ormai del tutto legittimo chiamarlo il miglior modello di ragionamento, o dire che si sta avvicinando molto al ragionamento di livello umano."
Su ha sostenuto che i world model che alimentano dispositivi fisici sono più vicini all'AGI di Astra. Ciò che Astra fa, ha affermato, è far avanzare la capacità degli agenti di usare i computer.
L'AI agentica sta maturando rapidamente, evolvendo da agenti che si limitano a identificare prompt testuali ad agenti che interpretano l'ambiente locale e interagiscono con l'infrastruttura IT e software locale, come farebbero gli esseri umani. Il vendor di ricerca AI Perplexity lo ha fatto con l'uso del computer, e anche Anthropic ha integrato capacità di computer use nei propri modelli. OpenAI sembra spingere questa tendenza oltre con Astra, sostenendo che il modello gestisce attività complesse con velocità, precisione e giudizio.
"Ora gli agenti hanno davvero un proprio meccanismo di scoperta," ha detto Su. "Comprende in modo autonomo ciò che sta accadendo e sarà in grado di formulare ragionamenti e giudizi propri."
Focus su uso del computer e cybersecurity
La focalizzazione di OpenAI sull'uso del computer, e la capacità del modello di eseguire e delegare attività in diversi domini anticipando i rischi informatici, segnala anche un cambiamento nell'AI, ha affermato Sid Nag, fondatore e chief research officer di Tekonyx.
"L'infrastruttura AI sta passando dal semplice inferencing all'esecuzione autonoma," ha detto Nag.
Ha aggiunto che l'enfasi di OpenAI sulle capacità informatiche con Astra è significativa. Il vendor ha dichiarato che il modello può individuare exploit zero-day affinché i difensori informatici trovino e correggano le debolezze, creando al contempo la necessità di protezioni più forti. Questa natura a duplice uso — aiutare i difensori a trovare falle mentre potenzialmente aiuta gli attaccanti a sfruttarle — è centrale nel dibattito su quanta capacità informatica rilasciare nei modelli general-purpose.
"La cybersecurity stessa potrebbe diventare il primo carico di lavoro in cui l'AI non solo crea il meccanismo di difesa … ma crea anche l'infrastruttura di attacco," ha detto Nag.
Tradizionalmente, ha osservato, i vendor hanno creato modelli eccellenti nel ragionamento lasciando la componente di sicurezza agli esperti di cybersecurity tradizionale. Ora i vendor di AI stanno puntando con maggiore enfasi sull'integrare la sicurezza nella logica del modello.
Questo cambiamento è evidente non solo in Astra ma anche in Fable 5.1 di Anthropic, che è autorizzato a eseguire la scoperta di vulnerabilità nel codice sorgente durante l'uso generale, ma è limitato rispetto ad attività come la generazione di exploit — il processo di creazione di software che sfrutta una debolezza in un'applicazione.
I principali concorrenti nella corsa all'AI si stanno tutti muovendo per includere questa componente informatica, una convergenza da tenere d'occhio mentre i regolatori e i team di sicurezza aziendali valutano come queste capacità vengano governate.
Fonte: AI Business