Anthropic zegt pogingen om AI te gebruiken voor onderzoek naar biologische wapens te hebben geblokkeerd
Belangrijkste punten
- •Het rapport van Anthropic beschreef vijf gevallen waarin de Claude-chatbot werd gebruikt voor mogelijk gevaarlijk biologisch onderzoek.
- •Een onderzoek betrof een verzoek om chikungunya besmettelijker en schadelijker te maken, dat Anthropic blokkeerde.
- •Het bedrijf verbande de betrokken accounts, verstoorde relaynetwerken die werden gebruikt om beperkingen te omzeilen en breidde zijn veiligheidsmaatregelen uit.
- •Anthropic zei dat een aan Iran gelinkte actor Claude gebruikte om openbare gegevens te analyseren voor aanbevelingen over doelwitten met betrekking tot Amerikaanse zeestrijdkrachten.
- •Het rapport verscheen na openbare waarschuwingen van een veiligheidsonderzoeker en een voormalige werknemer van Anthropic over ernstige risico’s van geavanceerde AI.

Anthropic zei donderdag dat het dit jaar meerdere pogingen heeft verstoord om zijn kunstmatige-intelligentiemodellen te gebruiken voor biologisch onderzoek dat mogelijk de ontwikkeling van biologische wapens zou kunnen ondersteunen. Het bedrijf zei naar aanleiding daarvan de betrokken accounts te hebben verbannen en zijn veiligheidsmaatregelen te hebben aangescherpt.
In zijn rapport van 154 pagina’s, Detecting and Countering Misuse of AI, beschreef Anthropic vijf casestudy’s over onderzoekers die zijn Claude-chatbot gebruikten voor geavanceerd biologisch onderzoek met mogelijke dual-use-toepassingen.
Na het onderzoek zei Anthropic de accounts te hebben verbannen, zijn bevindingen te hebben gedeeld met overheidsinstanties en andere AI-laboratoria en zijn veiligheidsmaatregelen te hebben uitgebreid.
“We hebben alle betrokken accounts verbannen, met partners samengewerkt om de relaynetwerken die regionale blokkades omzeilden uit de lucht te halen en onze bevindingen gedeeld met getroffen AI-labs en overheidsinstanties,” zei Anthropic.
Het bedrijf benadrukte dat het niet beweerde dat de onderzoekers schade wilden veroorzaken. Biologisch onderzoek kan bijdragen aan de ontwikkeling van vaccins en behandelingen, maar dezelfde kennis kan ook worden misbruikt, aldus Anthropic.
“Biologische capaciteiten kunnen voor tweeërlei gebruik zijn: ze kunnen worden ingezet voor nuttige of schadelijke doeleinden, en het is vaak moeilijk om daartussen onderscheid te maken,” stelt het rapport. “Dezelfde informatie die kan worden gebruikt om een biologisch wapen te ontwikkelen, kan bijvoorbeeld ook worden gebruikt om een vaccin of een geneesmiddel voor een ziekte te ontwikkelen.”
In een van de gevallen vroeg een onderzoeker Claude om te helpen bij het opstellen van een subsidievoorstel voor gain-of-function-onderzoek naar chikungunya, een virus dat door muggen wordt overgedragen. Anthropic zei dat het voorstel inhield dat het virus zou worden aangepast om het besmettelijker en gevaarlijker te maken.
Hoewel dergelijk onderzoek wetenschappers kan helpen bij de ontwikkeling van vaccins en behandelingen, zei het bedrijf dat het ook kan worden misbruikt om het virus schadelijker te maken. Anthropic zei het verzoek te hebben geblokkeerd en later te hebben ontdekt dat de onderzoekers een platform van een derde partij gebruikten om regionale beperkingen te omzeilen en afgewezen prompts automatisch naar een ander AI-model door te sturen.
Volgens het rapport hadden andere gevallen betrekking op vogelgriep, onderzoek naar orthopoxvirussen en onderzoek naar niet-overdraagbare gifstoffen en toxines.
“Geavanceerde dreigingsactoren weten dat wij (en andere AI-aanbieders) proberen gevaarlijk gebruik van onze modellen te detecteren, en zij gebruiken het dual-usekarakter van biologie om een vorm van ‘plausibele ontkenbaarheid’ rond hun onderzoek in stand te houden,” zei het bedrijf.
Het rapport beschreef ook verschillende aan Iran gelinkte gevallen waarin actoren Claude naar verluidt gebruikten ter ondersteuning van beïnvloedingscampagnes, surveillanceoperaties en onderzoek naar Amerikaanse zeestrijdkrachten.
“We hebben een dreigingsactor met een Iraanse connectie geïdentificeerd en verstoord die Claude gebruikte om publiek toegankelijke gegevens te verzamelen en te analyseren en aanbevelingen voor doelwitten tegen Amerikaanse zeestrijdkrachten in de regio te ontwikkelen,” zei Anthropic. “We hebben het account van de actor verbannen, detectiemechanismen ontwikkeld om het risico op toekomstig misbruik te verkleinen en dreigingsinformatie gedeeld met overheidsinstanties om de dreiging te verstoren.”
Het rapport werd gepubliceerd nadat een senior veiligheidsonderzoeker van Anthropic dinsdag zei dat er een kans van meer dan 10% bestaat dat AI binnen het komende decennium “alle mensen zal doden”. Die verklaring kwam als reactie op een voormalige werknemer die ontslag nam nadat hij het bedrijf ervan had beschuldigd onverantwoordelijk te handelen.
Jacob Coxon, voormalig onderzoeker bij Anthropic en OpenAI, schreef zondag in een lange ontslagthread op X dat “de mensen die AI bouwen oprecht geloven dat AI ons tegen het einde van het decennium allemaal zou kunnen doden”.
“Ik heb vandaag ontslag genomen bij Anthropic. De afgelopen drie jaar heb ik bij zowel OpenAI als Anthropic onderzoek gedaan naar pretraining. Geen van beide bedrijven handelt verantwoordelijk. Ze racen recht op zelfverbeterende superintelligentie af en gokken met ons leven,” schreef Coxon.
FOX Business kon Anthropic niet onmiddellijk bereiken voor commentaar. Robert McGreevy van FOX Business droeg bij aan dit verslag.
Bron: FOX Business