NotizieMacroOpenAI lancia GPT-6 Astra per flussi di lavoro professionali autonomi e destina 1 miliardo di dollari alla cybersecurity in prima linea

OpenAI lancia GPT-6 Astra per flussi di lavoro professionali autonomi e destina 1 miliardo di dollari alla cybersecurity in prima linea

Autore: Metaverse Post·

Punti chiave

  • GPT-6 Astra ottiene il 99,9% su ARC-AGI-3, il 72,6% su OSWorld 2.0, il 96% su GPQA Diamond e un punteggio perfetto su ExploitBench.
  • Il modello completa le attività di computer-use circa il 47% più velocemente del predecessore e ha stabilito un record stimato di efficienza computaz di 169, secondo Epoch AI.
  • OpenAI destina 1 miliardo di dollari per sovvenzionare risorse di cybersecurity AI frontier per i difensori in prima linea come aziende idriche, gestori di reti elettriche, governi locali e banche di comunità, a partire dagli Stati Uniti.
  • Astra ha prodotto esiti disallineati nel 2,4% dei test avversariali e, secondo i rapporti, ha scoperto due vulnerabilità zero-day precedentemente sconosciute durante le valutazioni di cybersecurity.
  • L'accesso API costa 10 dollari per milione di token in input e 50 dollari per milione in output, e gli amministratori enterprise devono effettuare l'opt-in prima che il modello sia abilitato per i propri spazi di lavoro.
OpenAI lancia GPT-6 Astra per flussi di lavoro professionali autonomi e destina 1 miliardo di dollari alla cybersecurity in prima linea

L'azienda di ricerca sull'intelligenza artificiale OpenAI ha presentato GPT-6 Astra, il suo ultimo modello frontier progettato per l'uso autonomo del computer, l'ingegneria del software, la ricerca scientifica e flussi di lavoro professionali complessi. Il lancio si inserisce in una più ampia corsa del settore verso l'AI agentica—modelli in grado di operare software, navigare e completare lavori in più fasi con supervisione limitata—dove l'affidabilità sui compiti reali, e non solo la qualità della conversazione, è diventata il principale elemento distintivo. Il sistema è stato reso disponibile a un gruppo ristretto di organizzazioni il giorno del lancio e nei prossimi giorni verrà esteso agli abbonati ChatGPT Plus, Pro, Business ed Enterprise, nonché tramite l'API di OpenAI e i principali provider cloud.

OpenAI posiziona Astra come leader in diverse categorie di benchmark. Il modello otterrebbe il 99,9% su ARC-AGI-3, un test di ragionamento astratto progettato per resistere alla memorizzazione, satura FrontierMath Tier 4 al 98% e raggiunge il 100% su ExploitBench. Nelle valutazioni pratiche ha ottenuto il 59,3% su Agents' Last Exam, il 72,6% su OSWorld 2.0—un benchmark per il controllo di interfacce computer reali—e il 96% su GPQA Diamond, il benchmark scientifico di livello universitario. Queste suite agentiche e di computer-use sono considerate tra le valutazioni più difficili e irrisolte per i modelli frontier, motivo per cui punteggi nell'intervallo del 50–70% vengono considerati un progresso significativo.

OpenAI evidenzia inoltre notevoli guadagni di efficienza, rilevando che Astra completa le attività di computer-use in circa il 47% di tempo in meno rispetto al predecessore, utilizzando sostanzialmente meno token in output. Nei flussi di lavoro di coding e scientifici basati su terminale, il modello ha ottenuto il 57,9% su Terminal-Bench 4.0 e il 64,6% su Terminal-Bench Science 0.1, con costi API stimati inferiori rispetto alle configurazioni concorrenti. Ricercatori indipendenti di Epoch AI hanno inoltre rilevato un nuovo record stimato di efficienza computaz pari a 169.

Astra introduce un meccanismo di gestione del contesto ridisegnato nell'ambiente Codex di OpenAI che conserva note di lavoro ricercabili durante sessioni prolungate, evitando la perdita di informazioni tipicamente associata alla compressione della finestra di contesto—una limitazione di lunga data per gli agenti che lavorano su attività di lunga durata, dove i modelli precedenti tendevano a dimenticare o perdere dettagli una volta che le conversazioni superavano i limiti del contesto. Il modello è inoltre progettato per gestire compiti professionali in più fasi, tra cui analisi dei dati, redazione di documenti, aggiornamenti CRM e lavori di ingegneria specializzata.

This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast. pic.twitter.com/gDd0IsewJw — OpenAI (@OpenAI) September 3, 2026

Cybersecurity, allineamento e un impegno da 1 miliardo di dollari per i difensori

Accanto alle sue capacità, OpenAI pone l'accento sulle proprietà di sicurezza di Astra, descrivendo il modello come il proprio rilascio più allineato fino ad oggi. Le valutazioni interne indicano miglioramenti sostanziali nella comprensione delle intenzioni dell'utente e nel rispetto dei confini dei compiti. Nei test avversariali, Astra ha prodotto esiti disallineati a un tasso del 2,4%, significativamente al di sotto delle cifre riportate per i modelli frontier concorrenti. Il sistema ha inoltre dimostrato una migliore resistenza all'elusione dei meccanismi di revisione automatica e una ridotta tendenza a fornire allucinazioni sulle proprie capacità.

Nelle valutazioni di cybersecurity, Astra soddisfa la soglia interna di preparazione Critica di OpenAI. Ha ottenuto un punteggio perfetto su ExploitBench e un tasso di successo del 42,4% su ExploitGym, scoprendo inoltre, secondo i rapporti, due vulnerabilità zero-day precedentemente sconosciute durante la valutazione. Le distribuzioni standard rifiuteranno le richieste di creare proof-of-concept di exploit, sebbene OpenAI intenda ampliare l'accesso difensivo tramite il proprio programma Daybreak nelle prossime settimane.

In concomitanza con il lancio, OpenAI ha annunciato un impegno da 1 miliardo di dollari per sovvenzionare risorse di cybersecurity AI frontier per i difensori in prima linea. L'iniziativa Daybreak for Frontline Defenders si rivolge agli operatori di servizi essenziali—tra cui aziende idriche, gestori di reti elettriche, governi locali e banche di comunità—a partire dagli Stati Uniti, con un'espansione internazionale prevista. Il programma affronta un divario ampiamente documentato nelle capacità di cybersecurity: le utility più piccole e le istituzioni pubbliche spesso non dispongono dei budget e del personale delle grandi imprese, eppure gestiscono infrastrutture che le agenzie di sicurezza hanno più volte segnalato come bersagli attrattivi per ransomware e campagne di intrusione legate a stati nazionali.

Alongside the launch of GPT-6 Astra, we're committing $1 billion to subsidize Daybreak access and frontier capabilities to help frontline defenders protect essential services and critical infrastructure. Welcome to the AGI era for cybersecurity. — fouad (@fouadmatin) September 3, 2026

Il programma prevede un pilota con il Multi-State Information Sharing and Analysis Center—un'organizzazione non profit che supporta la cybersecurity di governi statali e locali negli Stati Uniti—e integra più di 35 prodotti partner attraverso la Daybreak Defense Network.

L'accesso API è prezzato a 10 dollari per milione di token in input e 50 dollari per milione di token in output, con una modalità fast opzionale disponibile al doppio della tariffa standard. Gli amministratori enterprise devono abilitare esplicitamente Astra per i propri spazi di lavoro, una scelta di opt-in che offre alle organizzazioni il controllo su quando le nuove capacità frontier raggiungono i propri utenti, e il modello supporta lo Zero Data Retention per i clienti API idonei, una funzionalità tipicamente richiesta dai clienti di settori regolamentati che gestiscono dati sensibili.