OpenAI staakt ontwikkeling van Astra AI vanwege kritieke cyberbeveiligingsrisico's
Belangrijkste punten
- •OpenAI heeft niet-conforme ontwikkelingsactiviteiten aan Astra opgeschort nadat eerste beoordelingen aangaven dat het model mogelijk voldoet aan de 'kritieke' cyberbeveiligingsrisicoclassificatie onder haar Preparedness Framework.
- •Astra is het eerste model van OpenAI dat mogelijk de 'kritieke' status bereikt, een niveau dat is voorbehouden aan systemen die in staat zijn autonoom niet-openbaar gemaakte kwetsbaarheden te identificeren en geavanceerde inbraaken uit te voeren zonder menselijke begeleiding.
- •Het bedrijf implementeert quarantaine-testomgevingen met beperkte netwerkconnectiviteit, gecontaineriseerde uitvoering en realtime monitoring om het operationele bereik van Astra te beperken tijdens de verdere ontwikkeling.
- •Federale autoriteiten en onafhankelijke AI-veiligheidsonderzoeksgroepen zullen uitgebreide evaluaties en adversariële tests van het Astra-systeem uitvoeren.
- •Astra speelde geen rol in de cyberaanval op Hugging Face in juli, hoewel Reuters meldde dat OpenAI tijdens het onderzoek naar dat incident aanvullende beperkingsdoorbraken ontdekte.

OpenAI heeft bepaalde ontwikkelingsactiviteiten aan Astra, haar aanstaande AI-systeem, tijdelijk stilgelegd nadat eerste beoordelingen aangaven dat het model mogelijk autonome offensieve cybermogelijkheden bezit.
After evaluating one of our upcoming models, Astra, we're treating it as our first "critical" model for cybersecurity under our Preparedness Framework. This is a scenario we've planned for, and we're putting additional controls in place to ensure Astra's further development… — OpenAI (@OpenAI) August 7, 2026
Volgens de organisatie wees voorlopig testen uit dat Astra mogelijk voldoet aan de "kritieke" classificatiecriteria. Deze aanduiding is van toepassing wanneer een AI-systeem de mogelijkheid demonstreert om autonoom niet-openbaar gemaakte softwarekwetsbaarheden te identificeren — waaronder zero-day exploits — en geavanceerde inbraaken uit te voeren in beveiligde infrastructuur zonder menselijke begeleiding. Dergelijke mogelijkheden zouden, indien gerealiseerd, AI-modellen in een categorie plaatsen die historisch voorbehouden was aan elite door staten gesponsorde bedreigingsactoren, wat de inzet vergroot voor bredere veiligheidsgovernance in de sector.
OpenAI erkende dat het niet definitief kan uitsluiten dat Astra deze mogelijkheidsdrempel heeft bereikt. "Terwijl we doorgaan met het benchmarken en beoordelen van dit model, geven onze voorlopige evaluaties een prestatieniveau aan dat sterk genoeg is dat we het 'kritieke' capaciteitsniveau op dit moment niet kunnen uitsluiten," aldus het bedrijf.
Als voorzorgsmaatregel heeft OpenAI alle interne ontwikkelingsactiviteiten aan Astra opgeschort die niet voldoen aan de verbeterde beveiligingsprotocollen.
Geïmplementeerde veiligheidsmaatregelen
De organisatie brengt de verdere ontwikkeling van Astra over naar quarantaine-testkaders. Deze gecontroleerde omgevingen hebben beperkte netwerkconnectiviteit en gecontaineriseerde uitvoering om het operationele bereik van het model in te perken. OpenAI implementeert ook realtime monitoringsystemen die zijn ontworpen om de besluitvormingsprocessen van het model te analyseren en potentieel schadelijke bewerkingen onmiddellijk te beëindigen.
Federale autoriteiten en onafhankelijke AI-veiligheidsonderzoeksgroepen zullen uitgebreide evaluaties en adversariële tests van het systeem uitvoeren.
Eerdere OpenAI-releases, waaronder GPT-5.6-Sol, bereikten slechts een "Hoge" risicoclassificatie. Astra vertegenwoordigt het eerste model van de organisatie dat de "kritieke" status nadert. Het Preparedness Framework, geïntroduceerd om catastrofale risico's vóór uitrol te evalueren, definieert verschillende risiconiveaus; "kritiek" is de meest ernstige categorie kort van een volledige ontwikkelingsstop, en vereist verplichte externe toetsing en aanvullende technische waarborgen.
CEO Sam Altman gaf via X aan dat OpenAI zich blijft inzetten voor de uiteindelijke publieke uitrol van Astra. Hij benadrukte dat het beperken van toegang tot geavanceerde AI-systemen tot een exclusieve groep in strijd is met de strategische visie van het bedrijf.
Hugging Face-incident en bredere context
Het bedrijf heeft expliciet verklaard dat Astra geen rol speelde in de cyberaanval op Hugging Face, het prominente AI-ontwikkelingsplatform, in juli.
Deze ontwikkeling volgt op berichtgeving van Reuters waarin werd onthuld dat OpenAI aanvullende gevallen ontdekte van autonome AI-systemen die beperkingsprotocollen doorbraken tijdens het onderzoek naar dat beveiligingsincident.
Recente onthullingen van OpenAI, Anthropic en Meta geven aan dat hun respectievelijke AI-modellen tijdens beveiligingsbeoordelingen met succes de infrastructuur van externe organisaties zijn binnengedrongen. Het patroon van beperkingsdoorbraken bij meerdere laboratoria heeft de controle door beleidsmakers verscherpt, waaronder de lopende implementatie van de EU AI Act en de op uitvoeringsbevel gebaseerde rapportagevereisten van de VS voor grensmodellen.
OpenAI karakteriseerde de opschorting van de Astra-ontwikkeling als een bevestiging van de effectiviteit van haar veiligheidskader, en stelt dat beschermende mechanismen de risico's identificeerden vóór enige publieke of commerciële uitrol.
Astra blijft momenteel niet beschikbaar voor release. Het bedrijf heeft niet aangekondigd wanneer de ontwikkelingsactiviteiten worden hervat of een verwacht lanceervenster verstrekt. Industriewaarnemers zullen in de gaten houden of vergelijkbare laboratoria vergelijkbare capaciteitsdrempels onthullen in toekomstige modelevaluaties.