NieuwsMacroOpenAI lanceert GPT-6 Astra voor autonome professionele workflows en zet 1 miljard dollar in voor frontline-cybersecurity

OpenAI lanceert GPT-6 Astra voor autonome professionele workflows en zet 1 miljard dollar in voor frontline-cybersecurity

Auteur: Metaverse Post·

Belangrijkste punten

  • GPT-6 Astra behaalt 99,9% op ARC-AGI-3, 72,6% op OSWorld 2.0, 96% op GPQA Diamond en een perfecte score op ExploitBench.
  • Het model voltooit computergebruiktaken ongeveer 47% sneller dan zijn voorganger en vestigde volgens Epoch AI een geschat rekenefficiëntierecord van 169.
  • OpenAI zeggt 1 miljard dollar toe om frontier-AI-cybersecurityresources te subsidiëren voor frontline-verdedigers zoals waterbedrijven, netbeheerders, lokale overheden en communitybanken, beginnend in de Verenigde Staten.
  • Astra produceerde in 2,4% van de adversariële tests misaligned uitkomsten en ontdekte naar verluidt twee eerder onbekende zero-day-kwetsbaarheden tijdens cybersecurity-evaluaties.
  • API-toegang kost $10 per miljoen invoertokens en $50 per miljoen uitvoertokens, waarbij enterprise-beheerders zich moeten aanmelden voordat het model voor hun workspaces wordt ingeschakeld.
OpenAI lanceert GPT-6 Astra voor autonome professionele workflows en zet 1 miljard dollar in voor frontline-cybersecurity

AI-onderzoeksbedrijf OpenAI heeft GPT-6 Astra onthuld, zijn nieuwste frontier-model, ontworpen voor autonoom computergebruik, software-engineering, wetenschappelijk onderzoek en complexe professionele workflows. De lancering past binnen een bredere industriewedloop richting agentische AI—modellen die software kunnen bedienen, kunnen browsen en meerstapswerk met beperkt toezicht kunnen uitvoeren—waarbij betrouwbaarheid op taken in de echte wereld, en niet alleen chatkwaliteit, het belangrijkste onderscheidende vermogen is geworden. Het systeem werd op de lanceringdag beschikbaar gesteld aan een beperkte groep organisaties en wordt de komende dagen uitgerold naar ChatGPT Plus-, Pro-, Business- en Enterprise-abonnees, evenals via de OpenAI API en grote cloudproviders.

OpenAI positioneert Astra als koploper in meerdere benchmarkcategorieën. Het model behaalt naar verluidt 99,9% op ARC-AGI-3, een test voor abstract redeneren die bestand is gemaakt tegen memorisatie, verzadigt FrontierMath Tier 4 met 98% en behaalt 100% op ExploitBench. In praktische evaluaties bereikte het 59,3% op Agents' Last Exam, 72,6% op OSWorld 2.0—een benchmark voor het bedienen van echte computerinterfaces—en 96% op het wetenschappelijke GPQA Diamond-benchmark op graduatenniveau. Deze agentische en computergebruiksuites gelden als een van de moeilijkste onopgeloste evaluaties voor frontier-modellen, waardoor scores in het bereik van 50–70% worden beschouwd als opmerkelijke vooruitgang.

OpenAI benadrukt bovendien aanzienlijke efficiëntiewinst, waarbij het aangeeft dat Astra computergebruiktaken in ongeveer 47% minder tijd voltooit dan zijn voorganger, terwijl het aanzienlijk minder uitvoertokens gebruikt. In terminalgebaseerde codeer- en wetenschappelijke workflows behaalde het model 57,9% op Terminal-Bench 4.0 en 64,6% op Terminal-Bench Science 0.1, met geschatte API-kosten onder die van concurrerende configuraties. Onafhankelijke onderzoekers van Epoch AI registreerden daarnaast een nieuw geschat rekenefficiëntierecord van 169.

Astra introduceert een herontworpen contextbeheermechanisme in de Codex-omgeving van OpenAI dat doorzoekbare werkdirs bewaart gedurende lange sessies, waardoor het informatieverlies dat doorgaans gepaard gaat met contextvenstercompressie wordt vermeden—een langdurige beperking voor agents die aan taken van uren werken, waar eerdere modellen doorgaans details vergaten of lieten vallen zodra gesprekken hun contextlimieten overschreden. Het model is bovendien ontworpen voor meerstapsprofessionele taken, waaronder data-analyse, het opstellen van documenten, CRM-updates en gespecialiseerd engineeringwerk.

This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast. pic.twitter.com/gDd0IsewJw — OpenAI (@OpenAI) September 3, 2026

Cybersecurity, alignment en een toezegging van 1 miljard dollar voor verdedigers

Naast de mogelijkheden benadrukt OpenAI de veiligheidseigenschappen van Astra en beschrijft het bedrijf het model als zijn best uitgelijnde release tot nu toe. Interne evaluaties wijzen op aanzienlijke verbeteringen in het begrijpen van gebruikersintenties en het respecteren van taakgrenzen. In adversariële tests produceerde Astra in 2,4% van de gevallen misaligned uitkomsten, aanzienlijk lager dan de gerapporteerde cijfers van concurrerende frontier-modellen. Het systeem toonde ook verbeterde weerstand tegen het omzeilen van geautomatiseerde beoordelingsmechanismen en een verminderde neiging tot hallucineren over zijn eigen mogelijkheden.

In cybersecurity-evaluaties voldoet Astra aan de interne 'Critical preparedness'-drempel van OpenAI. Het behaalde een perfecte score op ExploitBench en een slagingspercentage van 42,4% op ExploitGym, waarbij het naar verluidt tijdens de beoordeling twee eerder onbekende zero-day-kwetsbaarheden ontdekte. Standaardimplementaties zullen verzoeken om proof-of-concept-exploits weigeren, hoewel OpenAI van plan is de defensieve toegang via haar Daybreak-programma in de komende weken uit te breiden.

Gelijktijdig met de lancering kondigde OpenAI een toezegging van 1 miljard dollar aan om frontier-AI-cybersecurityresources te subsidiëren voor frontline-verdedigers. Het initiatief Daybreak for Frontline Defenders richt zich op operatoren van essentiële diensten—waaronder waterbedrijven, beheerders van elektriciteitsnetten, lokale overheden en communitybanken—beginnend in de Verenigde Staten met geplande internationale uitbreiding. Het programma adresseert een wijd gedocumenteerde kloof in cybersecuritycapaciteit: kleinere nutsbedrijven en publieke instellingen beschikken vaak niet over de budgetten en het personeel van grote ondernemingen, terwijl zij infrastructuur beheren die door veiligheidsdiensten herhaaldelijk is aangemerkt als aantrekkelijk doelwit voor ransomware en aan campagnes gekoppeld aan staten.

Alongside the launch of GPT-6 Astra, we're committing $1 billion to subsidize Daybreak access and frontier capabilities to help frontline defenders protect essential services and critical infrastructure. Welcome to the AGI era for cybersecurity. — fouad (@fouadmatin) September 3, 2026

Het programma omvat een pilot met het Multi-State Information Sharing and Analysis Center—een non-profitorganisatie die cybersecurity van staats- en lokale overheden in de Verenigde Staten ondersteunt—en integreert meer dan 35 partnerproducten via het Daybreak Defense Network.

API-toegang is geprijsd op $10 per miljoen invoertokens en $50 per miljoen uitvoertokens, met een optionele snelle modus tegen het dubbele van het standaardtarief. Enterprise-beheerders moeten Astra expliciet inschakelen voor hun workspaces, een opt-in-ontwerp dat organisaties controle geeft over wanneer nieuwe frontier-mogelijkheden hun gebruikers bereiken, en het model ondersteunt Zero Data Retention voor in aanmerking komende API-klanten, een functie die doorgaans vereist wordt door klanten in gereguleerde sectoren die gevoelige gegevens verwerken.