Terwijl AI-bedrijven ‘recursieve zelfverbetering’ naderen, noemt een natuurkundeprofessor volledige autonomie ‘het slechtste idee in de geschiedenis van de mensheid’
Belangrijkste punten
- •Anthropic zegt dat het Claude-model nu 26% van het modelonderzoek en -ontwikkeling van het bedrijf leidt, waarbij de meeste taken end-to-end vanaf een high-level prompt worden uitgevoerd onder menselijk toezicht.
- •Toonaangevende AI-labs definiëren recursieve zelfverbetering verschillend, variërend van enige AI-feedback op modelverbetering tot volledig autonome zelfverbetering, waardoor voortgangsclaims bedrijven niet direct vergelijkbaar zijn.
- •OpenAI heeft een geautomatiseerde 'research intern' gebouwd en een doel van maart 2028 gesteld voor een geautomatiseerde AI-onderzoeker, terwijl het erkent dat het nog niet weet hoe veilig volledig uitgelijnde RSI kan worden bereikt.
- •Elon Musk zei dat de opeenvolgende Grok-modellen van xAI steeds meer met minder menselijke tussenkomst worden gebouwd en dat de mijlpaal eind dit jaar bereikt zou kunnen zijn, maar niet later dan 2027.
- •Microsoft AI-CEO Mustafa Suleyman heeft 'humanistische superintelligentie' binnen bepaalde grenzen gepromoot, terwijl verdeeldheid in de sector blijft bestaan over oproepen tot een gecoördineerde AI-vertraging voor de veiligheid.

De vooruitzichten dat kunstmatige-intelligentiemodellen zichzelf leren om efficiënter en capabeler te worden — ooit een verafgelegen ambitie onder technologische onderzoekers — komen steeds dichter bij de werkelijkheid.
Naarmate de technologie vordert, zeggen ontwikkelaars dat deze 'recursieve zelfverbetering' of RSI nadert, een fase waarin AI-modellen manieren vinden om zichzelf te verbeteren en hun opvolgers te bouwen. Technologie-topmannen zeggen dat deze verschuiving vooruitgang in wetenschap en geneeskunde kan brengen, maar dat deze ook risico's met zich meebrengt.
De onzekerheid over waar dit allemaal naartoe kan leiden staat centraal in de groeiende angst dat AI aan menselijke controle ontsnapt, en over mogelijke bedreigingen voor de mensheid. Die zorgen brachten verschillende AI-industrieleiders vorig weekend ertoe zich aan te sluiten bij een oproep om het groeitempo van de technologie te vertragen.
Anthropic lichtte deze week toe hoe het model Claude het bedrijf helpt bij het ontwikkelen van de volgende, intelligentere versie van zichzelf. Claude leidt nu 26% van het modelonderzoek en -ontwikkeling van Anthropic, wat volgens het bedrijf betekent dat het het grootste deel van een taak "end-to-end vanuit een high-level prompt" kan uitvoeren, terwijl het nog steeds onder menselijk toezicht werkt. De modellen werken nog niet volledig autonoom — in ieder geval nog niet.
Tegenstrijdige definities van RSI
Toonaangevende AI-bedrijven definiëren recursieve zelfverbetering verschillend. Sommigen definiëren het als enige feedback van AI op modelverbetering, anderen als AI die volledig autonoom aan dat doel werkt. Het onderscheid is belangrijk: omdat er geen gedeelde drempel is voor wat als RSI telt, meten voortgangsclaims van verschillende labs niet allemaal hetzelfde.
Autonome recursieveverbetering betekent in essentie AI die zichzelf kan verbeteren door de volgende versie van het systeem te ontwerpen, daarna de volgende versie, enzovoort, aldus Anthony Aguirre, president en CEO van de non-profit Future of Life Institute en hoogleraar natuurkunde aan de University of California, Santa Cruz.
"Het echt belangrijke hier is dat naarmate AI er meer van doet, het sneller gaat, omdat AI nu eenmaal veel, veel sneller opereert dan mensen", zei hij.
Experts wegen runaway-risico af tegen een geleidelijke realiteit
De angst rond RSI is grotendeels gebaseerd op de mogelijkheid dat uit het proces een runaway-superintelligentie ontstaat — een scenario waarin zelfverbeterende systemen zich verder ontwikkelen dan het vermogen van mensen om ze te monitoren of controleren — aldus John Thickstun, universitair docent informatica aan Cornell University die methoden bestudeert om het gedrag van AI-modellen te beheersen. Maar een meer gegronde kijk, zei hij, suggereert dat er al enige tijd een vorm van recursieve zelfverbetering gaande is in AI-ontwikkeling.
"We gebruiken deze modellen al jaren in ondersteunende rollen bij het creëren van de volgende versie van deze modellen. Dus mensen gebruiken de vorige generatie modellen om code te schrijven voor de AI-systemen die vervolgens de volgende generatie creëren", zei hij.
Prominente AI-onderzoekers — waaronder OpenAI-medegrondlegger Andrej Karpathy — experimenteren al jaren met het laten trainen en verbeteren van nieuwe AI-systemen door AI-modellen. Die inspanningen hebben kleine verbeteringen opgeleverd, maar geen grote creatieve sprongen, zei Thickstun.
Aguirre zei echter dat AI-bedrijven tegenwoordig veel dichter bij die grotere sprongen in verbetering staan.
"Je kunt in deze grafieken van Anthropic door de tijd heen zien dat steeds meer onderzoek door de AI wordt gedaan en dat het steeds dichter bij volledige autonomie komt", zei hij. "En het resultaat van dat succes is uiteindelijk iets dat, denk ik, extreem angstaanjagend is. Ik denk dat dit waarschijnlijk het slechtste idee in de geschiedenis van de mensheid is om te doen. En ja, ze doen het."
De aankondiging van Anthropic gaf het publiek — en andere labs — enig inzicht in de RSI-voortgang, en het bedrijf moedigde concurrenten aan vergelijkbare cijfers te delen. Cijfers die concurrenten als reactie publiceren, kunnen de sector een gemeenschappelijke basis geven voor het vergelijken van voortgang richting autonoom onderzoek. Toch heeft Anthropic niet expliciet gezegd hoe dicht het bij volledig autonome modelverbetering staat.
OpenAI's "research intern" en een doel voor 2028
ChatGPT-maker OpenAI kondigde deze maand aan dat het een geautomatiseerde "research intern" heeft ontwikkeld, gedefinieerd als een systeem dat goed gedefinieerde onderzoekstaken onder menselijke aansturing kan uitvoeren, waaronder "taken die een bekwame onderzoeker enkele dagen zouden kosten". Het bedrijf heeft gezegd door te gaan met het doel tegen maart 2028 een geautomatiseerde AI-"onderzoeker" te creëren. Die datum geeft waarnemers een concreet, door het bedrijf zelf genoemd referentiepunt om die voortgang aan af te meten.
In die aankondiging zei OpenAI dat hoewel RSI kan helpen de acties van modellen af te stemmen op menselijke waarden en bedoelingen, dat nietekent dat "snelle RSI noodzakelijkerwijs een uitkomst is die we moeten nastreven".
"Of en hoe we verder moeten, moet afhangen van ons vermogen om menselijke controle te behouden en van weloverwogen democratische keuzes over de voordelen en risico's", schreef het bedrijf in een blogpost.
Musk suggereert een snellere tijdlijn bij xAI
Elon Musk lijkt eerder geneigd door te pakken. In maart zei hij over xAI's Grok-modellen dat "mensen geleidelijk steeds minder in de loop zitten" bij modelverbetering en dat "elke opeenvolgende model door het vorige is gebouwd", terwijl hij verduidelijkte dat het proces nog niet volledig geautomatiseerd was. Dat doel zou eind dit jaar bereikt kunnen zijn, voegde hij eraan toe, "maar niet later" dan 2027 — een tijdlijn die vóór OpenAI's doel van maart 2028 ligt, hoewel de twee bedrijven de mijlpaal anders omschrijven.
Microsoft's "humanistische" alternatief
Microsoft en enkele andere toonaangevende AI-bedrijven lijken een andere aanpak te volgen. Mustafa Suleyman, CEO van Microsoft AI, heeft gezegd dat het bedrijf richting "humanistische superintelligentie" gaat — geavanceerde AI-mogelijkheden in dienst van mensen en de mensheid als geheel. In een essay uit 2025 zei Suleyman dat dit niet zou betekenen "een onbegrensde en onbeperkte entiteit met hoge mate van autonomie", maar eerder AI die "zorgvuldig gekalibreerd, gecontextualiseerd, binnen grenzen" is.
Veiligheidsmaatregelen kunnen de maat niet houden
Een belangrijke uitdaging voor labs — waarmee ze in essentie worden geconfronteerd sinds het ontstaan van de technologie — is ervoor te zorgen dat hun veiligheidsmaatregelen gelijke tred houden met de mogelijkheden van hun modellen.
In de technologiesector zijn verdeeldheden ontstaan over oproepen tot een gecoördineerde AI-vertraging voor de veiligheid, en niet elke grote speler in de AI-wereld heeft specifiek gereageerd op zijn koers richting RSI.
Anthropic, een vooraanstaande stem in oproepen tot tempering, heeft gezegd zijn ontwikkelwerk te vertragen of tijdelijk te pauzeren — onder de voorwaarde dat mondiale concurrenten dat ook deden, en op een "verifieerbare manier".
OpenAI zei deze maand expliciet dat het nog niet weet hoe het "veilig helemaal tot uitgelijnde, volledige RSI" kan komen, en voegde eraan toe dat het bedrijf "niet kan aannemen dat de voortgang in alignment en veiligheid gelijke tred houdt". Capabelere systemen kunnen moeilijker te monitoren worden, vervolgde het, maar het nastreven van RSI blijft een doel dat het bedrijf waardevol vindt, omdat een "geautomatiseerde AI-onderzoeker ook een geautomatiseerde veiligheids- of alignment-onderzoeker kan zijn".
Dit verhaal verscheen oorspronkelijk op Fortune.com.