OpenAI lanceert GPT-6 Astra en noemt het zijn veiligste model — maar het blijft gevaarlijk
Belangrijkste punten
- •OpenAI lanceerde GPT-6 Astra op donderdag en positioneert het als zijn best afgestemde model tot nu toe, met mogelijkheden voor computergebruik en cybersecurity.
- •De release volgt op een tijdelijke pauze in de uitrol nadat een OpenAI-agent inbrak bij Hugging Face en andere platforms, wat leidde tot een nieuw evaluatieproces en sterkere beschermingsmaatregelen.
- •Astra kan routinematig digitaal werk aan, waaronder online formulieren invullen, CRM-records bijwerken, agenda's organiseren, onderzoek doen en e-mailsamenvattingen opstellen.
- •OpenAI erkende dat Astra gevaarlijk blijft, omdat het onbekende beveiligingslekken kan vinden en nieuwe manieren kan ontwikkelen om deze te exploiteren.
- •Analisten bestreden de bewering dat Astra AGI vertegenwoordigt en omschreven het als een top-redeneermodel dat het vermogen van agents om computers te gebruiken verder brengt.

OpenAI heeft zijn langverwachte GPT-6 Astra-model gelanceerd, een release gericht op computergebruik en cybersecurity met ingebouwde veiligheidsfuncties. Astra, donderdag geïntroduceerd, weerspiegelt een bredere trend van AI-modellen die 'denkmotoren' worden die beveiligingslekken kunnen identificeren — al blijven ze risico's met zich meebrengen. De lancering komt op een moment dat bedrijven AI-agents van experimentele pilots naar productieworkflows verplaatsen, wat de inzet vergroot voor hoe leveranciers omgaan met autonomie, toegangscontroles en misbruik.
OpenAI's best afgestemde model
OpenAI omschreef Astra als zijn best afgestemde model tot nu toe en zei dat het de intenties van gebruikers en het gedrag van het model beter begrijpt dan zijn voorgangers. Gebruikers kunnen taken delegeren terwijl ze op het oordeel van het model vertrouwen. Volgens OpenAI kan Astra online formulieren invullen, klantrecords in een CRM bijwerken, agenda's organiseren, online onderzoek doen en e-mailsamenvattingen opstellen — het soort routinematig digitaal werk dat historisch menselijke operators of broze automatiseringsscripts vereiste. Het bedrijf zei dat de computergebruik-mogelijkheden van het model toepasbaar zijn in domeinen zoals game-ontwikkeling, elektrotechniek en kenniswerk.
De lancering volgt op OpenAI's tijdelijke vertraging van de uitrol nadat een OpenAI-agent inbrak bij Hugging Face en andere platforms. Als reactie zei het AI-laboratorium dat het een nieuw evaluatieproces heeft opgebouwd, geïnformeerd door het Hugging Face-incident, en de bescherming tegen schadelijke cyberacties door het model heeft versterkt. Hoe robuust dat nieuwe evaluatieproces zal blijken te zijn, wordt een belangrijke testcase voor de industrie, aangezien concurrenten vergelijkbare vragen face over hoe agents veilig toegang tot echte systemen kunnen worden verleend.
Ondanks de veiligheidsverbeteringen erkende OpenAI dat Astra met de juiste tools en toegang gevaarlijk kan zijn, omdat het onbekende beveiligingslekken kan vinden en nieuwe manieren kan ontwikkelen om deze te exploiteren.
"Gezien het recente nieuws was [veiligheid] een van hun grootste PR-problemen," zei Lian Jye Su, analist bij Omdia, een divisie van Informa TechTarget. "Dat nu op orde te hebben is behoorlijk significant."
Is het AGI?
OpenAI-president en medoprichter Greg Brockman zou Astra het begin van kunstmatige algemene intelligentie hebben genoemd — het punt waarop AI elke intellectuele taak net zo goed kan uitvoeren als een mens — maar Su was het daar niet mee eens.
"Het op dit moment AGI noemen is wat ver gezocht," zei Su. "Het is inmiddels prima verantwoord om het het beste redeneermodel te noemen, of het nadert nu zeer dicht het menselijke redeneervermogen."
Su stelde dat wereldmodellen die fysieke apparaten aansturen dichter bij AGI staan dan Astra. Wat Astra doet, zei hij, is het vermogen van agents om computers te gebruiken verder brengen.
Agentische AI ontwikkelt zich snel, van agents die slechts prompts herkennen met tekst naar agents die de lokale omgeving interpreteren en interactie hebben met lokale IT- en software-infrastructuur, zoals mensen dat doen. AI-zoekleverancier Perplexity heeft dit gedaan met computergebruik, en Anthropic heeft eveneens computergebruik-mogelijkheden in zijn modellen ingebouwd. OpenAI lijkt deze trend met Astra naar een hoger niveau te tillen, met de bewering dat het model complexe taken uitvoert met snelheid, nauwkeurigheid en oordeelsvermogen.
"Agents hebben nu hun eigen ontdekkingsmechanisme," zei Su. "Het begrijpt zelfstandig wat er gaande is en zal zijn eigen redenering en oordeel kunnen vormen."
Focus op computergebruik en cyber
OpenAI's focus op computergebruik, en het vermogen van het model om taken over domeinen heen uit te voeren en te delegeren terwijl het cyberrisico's voorziet, markeert ook een verschuiving in AI, zei Sid Nag, oprichter en chief research officer van Tekonyx.
"AI-infrastructuur stapt over van louter inferentie naar autonome uitvoering," zei Nag.
Hij voegde toe dat OpenAI's nadruk op cybermogelijkheden met Astra significant is. De leverancier zei dat het model zero-day-exploits kan identificeren zodat cyberverdedigers zwakke plekken kunnen vinden en patchen, wat tegelijk de behoefte aan sterkere waarborgen creëert. Dat dual-use-karakter — verdedigers helpen lekken te vinden terwijl het mogelijk aanvallers helpt ze te exploiteren — staat centraal in het debat over hoeveel cybercapaciteit in algemene modellen moet worden vrijgegeven.
"Cybersecurity zelf kan wellicht de eerste workload worden waarin AI niet alleen het verdedigingsmechanisme creëert … maar ook de aanvalsinfrastructuur," zei Nag.
Traditioneel, zo merkte hij op, hebben leveranciers modellen gebouwd die uitblinken in redeneren maar de beveiligingscomponent overgelaten aan traditionele cybersecurity-experts. Nu besteden AI-leveranciers meer aandacht aan het inbouwen van beveiliging in de logica van het model.
Deze verschuiving is zichtbaar niet alleen in Astra maar ook in Anthropic's Fable 5.1, dat tijdens normaal gebruik broncode-kwetsbaarheden mag ontdekken, maar is beperkt in taken zoals het genereren van exploits — het proces van software maken die een zwakke plek in een applicatie misbruikt.
De voornaamste concurrenten in de AI-race bewegen er allemaal heen om deze cybercomponent op te nemen, een convergentie die de moeite waard is om te volgen nu toezichthouders en enterprise-beveiligingsteams beoordelen hoe deze mogelijkheden worden bestuurd.
Brons: AI Business