Musk stelt voor dat rivaliserende AI-labs frontier-modellen voor publicatie peer-reviewen, met overheid als laatste redmiddel
Belangrijkste punten
- •Musk stelde voor dat toonaangevende AI-bedrijven rivalen één tot twee weken vroegtijdige toegang verlenen om nieuwe modellen te beoordelen vóór de openbare release, zodat concurrenten elkaar eerlijk kunnen houden op het gebied van veiligheid.
- •Musk betoogde dat de overheid alleen moet ingrijpen als een bedrijf een beveiligingsprobleem identificeert dat het niet wil oplossen, onder verwijzing naar het gebrek aan diepe technische expertise van ambtenaren op het gebied van frontier-AI.
- •OpenAI onthulde dat twee van zijn AI-modellen autonoom uit een sandbox-testomgeving ontsnapten en de systemen van Hugging Face infiltreerden, waarbij ze valsspeelden bij een interne evaluatietest.
- •Musk's voorstel voor peer-review tussen laboratoria zou voortbouwen op het Frontier Model Forum dat in 2023 werd opgericht, hoewel zijn eigen bedrijf xAI momenteel geen lid is van dat orgaan.
- •Zinvolle samenwerking binnen de sector vereist dat Musk en OpenAI-CEO Sam Altman hun lopende persoonlijke en juridische geschillen aan de kant zetten, die voortvloeien uit Musk's medoprichting van en vertrek bij OpenAI.

Elon Musk pleit ervoor dat 's werelds meest geavanceerde AI-modellen een peer-review door concurrerende laboratoria ondergaan vóór de openbare release—maar hij wil dat de sector, niet de overheid, het voortouw neemt.
De CEO van Tesla en SpaceX zei dat toonaangevende AI-bedrijven moeten samenwerken om zichzelf te handhaven en veiligheidszorgen te signaleren met betrekking tot de geavanceerde modellen die ze in een versnellend tempo inzetten. Musk behoort al meer dan tien jaar tot de meest prominente stemmen die waarschuwen voor AI-risico's. In 2023 was hij ondertekenaar van een open brief van het Future of Life Institute waarin werd opgeroepen tot een pauze van zes maanden in de training van AI-systemen die krachtiger zijn dan GPT-4—een verzoek waaraan de sector geen gehoor gaf.
"Het meest directe wat we kunnen doen is ervoor zorgen dat de toonaangevende AI-bedrijven in ieder geval gewoon bij elkaar komen—een soort gesprek hebben—om de paar weken en gewoon alle veiligheids- en beveiligingskwesties bespreken," zei Musk in een interview met Zanny Minton Beddoes, hoofdredacteur van The Economist, dat donderdag werd gepubliceerd.
Musk betoogde dat de overheid alleen moet ingrijpen als een bedrijf een beveiligingsprobleem identificeert dat het niet wil oplossen. Anders zou het rivalen een week of twee vroegtijdige toegang verlenen om nieuwe modellen te beoordelen, waardoor "concurrenten elkaar eerlijk kunnen houden," zei hij.
"Ik denk dat het vrij moeilijk is voor iemand in de overheid die geen diep technisch inzicht heeft en niet aan de frontier van AI werkt om te weten of iets wel of niet zou moeten worden uitgebracht," zei Musk.
Toen Minton Beddoes vroeg wanneer een dergelijk systeem zou moeten worden ingevoerd, antwoordde Musk: "onmiddellijk," en voegde eraan toe dat zelfs een vertraging van zes maanden buitensporig zou zijn gezien de snelheid van AI-ontwikkeling.
"Er zijn zoveel aankondigingen van AI-doorbraken, soms meerdere per dag," zei hij. "Ik bedoel, hoeveel waren er vorige week?"
OpenAI, Anthropic, Google en Musk's eigen xAI—nu onderdeel van SpaceX—hebben allemaal in de afgelopen maand nieuwe AI-modellen uitgebracht naarmate de concurrentie tussen toonaangevende labs toeneemt.
Musk's opmerkingen volgen op een OpenAI-onthulling eerder deze week dat twee van zijn AI-modellen ontsnapten uit een "sandbox," een geïsoleerde testomgeving zonder directe internettoegang, en de systemen van Hugging Face infiltreerden, een open-source platform voor het hosten van AI-modellen. Volgens een blogpost van het bedrijf handelden de modellen autonoom om te valsspelen bij een interne evaluatietest.
Het incident deed de bezorgdheid toenemen over de groeiende mogelijkheden van AI-agents en hun potentieel om autonoom geavanceerde cyberaanvallen uit te voeren. Hoewel Musk's interview op maandag werd opgenomen—voordat OpenAI de inbreuk openbaar maakte—schreef hij in een woensdagse post op X: "We bevinden ons in de Singulariteit." De opmerking, gemaakt in reactie op een post van een andere gebruiker die verschillende recente AI-ontwikkelingen samenvatte waaronder het Hugging Face-incident, leek te verwijzen naar het hypothetische moment waarop AI de menselijke intelligentie overtreft en technologische verandering drijft in een tempo dat mensen niet langer kunnen anticiperen of beheren.
Experts hebben eerder tegen Fortune gezegd dat geavanceerde AI-modellen in de handen van kwaadwillende actoren een aanzienlijke bedreiging vormen voor organisaties. Dat omvat Anthropic's Mythos-model, dat het bedrijf aanvankelijk niet openbaar uitbracht vanwege de opmerkelijke capaciteit om kwetsbaarheden in cyberbeveiliging bloot te leggen, zoals eerder werd gemeld.
AI stelt kwaadwillende actoren in staat om cyberaanvallen uit te voeren, zelfs met minimale programmeerkennis, aldus Zach Lewis, chief information officer en chief information security officer aan de University of Health Sciences and Pharmacy in St. Louis. AI-agents zouden de drempel verder kunnen verlagen door het aanvalsproces te automatiseren, aldus Lewis.
In juni tekende president Donald Trump een uitvoerend bevel dat AI-bedrijven vroeg om de overheid vrijwillig toezicht te geven op niet-uitgebrachte AI-modellen. Het bevel bouwde voort op een bredere reeks vrijwillige veiligheidsverbintenissen die verschillende grote AI-bedrijven in 2023 in het Witte Huis waren aangegaan. Na het Hugging Face-incident hebben sommige wetgevers, waaronder afgevaardigde Greg Casar (D-Texas), opgeroepen tot strengere AI-regulering.
Thomas Wolf, medoprichter van Hugging Face, vertelde de BBC dat de aanval op zijn bedrijf een "wake-up call" is voor de sector en waarschuwde dat "dit een van de meest voorkomende soorten cyberaanvallen zal zijn die we zien" in de toekomst.
Musk's voorstel voor samenwerking tussen laboratoria zou voortbouwen op het bestaande Frontier Model Forum, een instantie uit de industrie die in 2023 werd opgericht en waardoor Amazon, Anthropic, Google, Meta, Microsoft en OpenAI vrijwillig informatie delen over kwetsbaarheden en bedreigingen. Musk's xAI is geen lid.
De bedrijven in het Frontier Model Forum delen echter geen niet-uitgebrachte modellen met elkaar—een hiaat dat Musk's voorstel direct zou aanpakken.
Sommige bedrijven, waaronder OpenAI, hebben de overheid al vroegtijdige toegang gegeven tot bepaalde modellen. In een blogpost van eind juni stelde het bedrijf: "Als onderdeel van onze voortdurende samenwerking met de Amerikaanse overheid hebben we onze plannen en de mogelijkheden van de modellen gepresenteerd," voorafgaand aan de lancering van zijn nieuwste model, GPT-5.6 Sol.
OpenAI merkte in de post op dat het niet verwachtte dat het delen met de overheid vóór de release standaardpraktijk zou worden, maar beschreef het als "het nemen van deze korte-termijnstap omdat we geloven dat dit het sterkste pad is naar bredere beschikbaarheid in de komende weken."
Musk erkende dat zinvolle samenwerking tussen toonaangevende AI-bedrijven vereist dat hij en OpenAI-CEO Sam Altman hun meningsverschillen aan de kant zetten. De twee zijn verwikkeld in een escalerend conflict dat teruggaat tot Musk's rol als medoprichter van OpenAI in 2015 en zijn vertrek uit de organisatie drie jaar later. Ze hebben onlangs woorden gehad op sociale media en botsen voor de rechter over de tegenkanting van de SpaceX-CEO tegen OpenAI's transitie van een non-profit naar een winstgevende entiteit.
"Uiteindelijk, als we moeten praten, dan praten we. Ik bedoel, zet onze persoonlijke meningsverschillen opzij voor het algemene belang, zoiets," zei Musk.