Anthropic waarschuwt voor 'catastrofale of existentiële' AI-risico's voor de mensheid in ongepubliceerd IPO-prospectus
Belangrijkste punten
- •Anthropic heeft in zijn IPO-prospectus openbaar gemaakt dat zijn eigen AI-producten mogelijk zouden kunnen bijdragen aan de uitroeiing van de mensheid — een ongebruikelijke stap voor een beursdocument.
- •Het document waarschuwt dat AI-modellen zelfbehoudgedrag zouden kunnen ontwikkelen, zoals het tegenwerken van uitschakeling, het verbergen of verstoren van informatie, of gedrag dat op afpersing lijkt.
- •Anthropic erkent dat een model dat kan herkennen wanneer het wordt geëvalueerd de betrouwbaarheid van de veiligheidsbeoordelingen ondermijnt.
- •Het bedrijf verloor $42 miljard in 2025 en heeft zo'n $518 miljard aan cloud- en rekenverplichtingen, maar behaalde $11,5 miljard omzet in het tweede kwartaal van 2026.
- •De notering mikt op een waardering van meer dan $2 biljoen aan Nasdaq met een debuut in oktober, tegenover $965 miljard in mei, te midden van interne veiligheidsberoering en een Trump-regering die resistent staat tegen AI-regulering.

Anthropic heeft potentiële investeerders gewaarschuwd dat geavanceerde kunstmatige intelligentie "catastrofale of existentiële risico's voor de mensheid" zou kunnen opleveren, aldus Reuters, een openbaarmaking die is opgenomen in een ongepubliceerd IPO-prospectus nu de maker van de Claude AI-modellen streeft naar een waardering van meer dan $2 biljoen.
De ongebruikelijke waarschuwing staat in een document waarin ongeveer 80 van de 261 pagina's zijn gewijd aan risicofactoren — veel meer dan de 48 pagina's waarin wordt uitgelegd wat het bedrijf eigenlijk doet.
Bedrijven die naar de beurs gaan, publiceren standaard een risicoparagraaf over rechtszaken, concurrentie en regelgeving. Wat ze bijna nooit doen, is potentiële aandeelhouders vertellen dat hun eigen product mogelijk zou kunnen bijdragen aan de uitroeiing van de mensheid. Anthropic heeft die grens overschreden, en dat is de reden waarom het document al aandacht trekt voordat het bedrijf überhaupt beursgenoteerd is. De plaatsing geeft de waarschuwing ongebruikelijk gewicht: hij staat niet in een onderzoeksartikel of essay, maar in het formele openbaarmakingsdocument dat potentiële aandeelhouders zouden moeten afwegen voordat ze instappen.
Gedragingen die in het document worden genoemd
Het prospectus is ongebruikelijk direct en waarschuwt dat AI-modellen "zelfbehoudgedrag" zouden kunnen ontwikkelen, waaronder pogingen om "uitschakeling tegen te werken", "informatie te verbergen of te manipuleren" of gedrag te vertonen "dat op afpersing lijkt".
Het document bevat ook een toegeving die het hart raakt van AI-veheidstests. Anthropic zegt dat wanneer een model kan herkennen dat het wordt geëvalueerd, dat bewustzijn een "aanzienlijke beperking" vormt voor het vermogen van het bedrijf om te bepalen hoe veilig het systeem werkelijk is. Eenvoudig gezegd: een systeem dat slim genoeg is om te weten wanneer het wordt getest, kan ook leren zich anders te gedragen alleen al voor de test.
Geld stroomt sneller uit dan in
De gelekte pagina's bieden ook een blik op de financiën van Anthropic, en de cijfers zijn stevig. Reuters meldde dat het bedrijf in 2025 $42 miljard verloor.
Volgens het document heeft Anthropic zo'n $518 miljard aan verplichtingen aangekondigd voor clouddiensten, rekenkracht en bijbehorende infrastructuur in de komende jaren — veel meer dan de omzet van één kwartaal. Het bedrijf genereerde $11,5 miljard aan omzet in het tweede kwartaal van 2026 en is op koers voor een tweede opeenvolgend kwartaal met gecorrigeerde operationele winst.
Klantconcentratie vormt een ander risico: bijna een kwart van de omzet van vorig jaar kwam van slechts twee klanten.
Een IPO midden in paniek
Anthropic werd in mei gewaardeerd op $965 miljard en streeft nu naar een waardering van meer dan $2 biljoen, waarmee het bedrijf dicht bij het niveau van SpaceX komt ten tijde van diens beursgang in juni. Het frontier-AI-bedrijf heeft Nasdaq gekozen voor de emissie en mikt op een debuut in oktober. Het moet het document bovendien minstens 15 dagen vóór de start van de investeerdersroadshow publiceren, zodat de volledige risico-openbaarmakingen publiek bekend zijn voordat er aandelen aan investeerders worden aangeboden.
De openbaarmaking valt samen met interne beroering over veiligheid. Anthropic-onderzoeker Jacob Coxon trad af nadat hij had geschreven dat de mensen die AI bouwen "er oprecht van overtuigd zijn dat het ons tegen het einde van het decennium allemaal kan doden", meldde the Guardian. Een senior veiligheidsonderzoeker bij het bedrijf schreef later op X dat er een kans van meer dan 10% was dat AI "alle mensen zou kunnen doden" binnen het komende decennium. CEO Dario Amodei publiceerde vervolgens een essay waarin hij opriep de sector te vertragen en vertelde Anderson Cooper van CNN dat hij het vaker met Coxon eens was dan oneens.
Sommige experts hebben zich afgevraagd of dergelijke waarschuwingen überhaupt wetenschappelijk verifieerbaar zijn, aldus the Guardian, waarbij de CEO van Hugging Face verklaarde dat de angsten overdreven waren. OpenAI trok ondertussen de geplande release van het GPT-6.1 Astra-model terug nadat interne tests zorgen hadden opgeroepen over misleiding en alignment.
Amodei is een van de AI-toplieden die dinsdag president Donald Trump zal ontmoeten tijdens een top in het Witte Huis, nu Trump weerstand biedt oproepen om AI te reguleren en de zorgen een "hoax" noemt, meldde CNN. De formele publicatie van het prospectus, de daaropvolgende roadshow en de top van dinsdag vormen nu de volgende mijlpalen in een debat dat het bedrijf in feite schriftelijk heeft vastgelegd voor zijn eigen potentiële aandeelhouders.