Anthropic-rapport beschrijft AI-gebruik bij cybercriminaliteit, beïnvloedingscampagnes en staatsoperaties
Belangrijkste punten
- •Het rapport behandelt hoogwaardige gevallen van misbruik die in Rusland, China, Iran en andere regio’s zijn gedetecteerd en verstoord, en meet niet de frequentie van typisch misbruik.
- •Dreigingsactoren gebruikten multi-agentsystemen om cyberoperaties te automatiseren, waaronder phishing, malwareontwikkeling, het verzamelen van inloggegevens en data-exfiltratie.
- •Anthropic identificeerde beïnvloedingscampagnes, surveillanceprogramma’s, wapenprojecten en dual-use-biologisch onderzoek onder de gedocumenteerde activiteiten.
- •Het bedrijf beschuldigde verschillende Chinese laboratoria ervan Claude-outputs en reasoning traces heimelijk te verzamelen voor de training van concurrerende modellen, waarbij sommige doorgeleidingen mogelijk gevoelige gegevens blootlegden.
- •Anthropic zei dat geen van de gevallen betrekking had op zijn meest capabele Fable- of Mythos-modellen, behalve één incident dat verband hield met distillatie.

Het AI-onderzoeksbedrijf Anthropic heeft zijn nieuwste dreigingsinformatierapport gepubliceerd, “Detecting and Countering Misuse of AI: September 2026”, waarin pogingen van kwaadwillende actoren worden beschreven om zijn Claude-modellen in te zetten voor cyberoperaties, beïnvloedingscampagnes, surveillance, biologisch onderzoek, wapenontwikkeling, fraude en modeldistillatie.
Het rapport behandelt activiteiten die tussen december 2025 en augustus 2026 zijn gedetecteerd en verstoord. De gevallen hadden betrekking op vermoedelijke door staten gesteunde groepen, financieel gemotiveerde criminelen, commerciële aanbieders van spyware en propagandainstellingen die actief waren in Rusland, China, Iran en andere regio’s.
Anthropic zei dat geen van de gedocumenteerde gevallen van misbruik betrekking had op zijn meest capabele Fable- of Mythos-klassemodellen, met uitzondering van één geval dat in het deel over distillatie wordt beschreven. Het bedrijf benadrukte ook dat de openbaar gemaakte incidenten geen typisch misbruik vertegenwoordigen. Ze werden in plaats daarvan geselecteerd als de meest geavanceerde en vernieuwende dreigingsactiviteiten die tot nu toe zijn vastgesteld. Dat betekent dat het rapport een overzicht biedt van hoogwaardig gedocumenteerd misbruik en niet meet hoe vaak deze activiteiten voorkomen. Anthropic zei dat het in elk geval de bijbehorende accounts heeft geblokkeerd, zijn beveiligingsmaatregelen op basis van onderzoeksbevindingen heeft aangescherpt en inlichtingen heeft gedeeld met autoriteiten en partners uit de sector.
We're publishing our most detailed threat intelligence report to date. It covers how people tried to misuse Claude—for cyberattacks, influence operations, surveillance, biology, and building weapons—and how we found and stopped them. We disrupted every operation in the report,… — Anthropic (@AnthropicAI) September 10, 2026
https://x.com/AnthropicAI/status/2098097512544444447?ref_src=twsrc%5Etfw
Van assistent naar orchestrator: belangrijkste bevindingen
De centrale conclusie van het rapport is dat AI in de cybercriminaliteit is verschoven van een adviserend hulpmiddel naar een operationele orchestrator. In de meeste onderzochte operaties gebruikten dreigingsactoren multi-agentframeworks die zelfstandig verkenning, exploitatie, het verzamelen van inloggegevens en data-exfiltratie uitvoerden. Mensen selecteerden voornamelijk de doelwitten en beoordeelden de resultaten.
Een opvallende zaak, aangeduid als GTG-20006, werd in verband gebracht met de Russische groep Midnight Blizzard, die banden heeft met de staat. De groep gebruikte AI-gestuurde workflows voor phishing, de ontwikkeling van malware en ontwijking, waarbij de toolkit automatisch opnieuw werd opgebouwd zodra beveiligingsproducten deze detecteerden. Afzonderlijk daarvan gebruikten vermoedelijke ShinyHunters-gelieerde actoren AI om het verzamelen van inloggegevens op industriële schaal uit te voeren. Daarbij werden 1.8 million Android applications gedecompileerd op zoek naar geheimen en werden inbreuken in slechts twee tot drie uur voltooid.
Buiten cyberoperaties documenteerde Anthropic beïnvloedingscampagnes die waren gericht op verkiezingen en de publieke opinie in Moldavië, Kenia, Maleisië en Bangladesh. Het bedrijf beschreef ook staatsgelieerde surveillanceactiviteiten in China, Iran en Mali, waaronder een platform dat was ontworpen om ongeveer 25 million mobile subscribers te monitoren.
Het rapport identificeerde daarnaast inspanningen voor wapenontwikkeling, waaronder een programma voor geleide raketten in Jemen en een project voor een autonome dronezwerm in Rusland. Het deel over biologisch misbruik beschrijft vijf gevallen van dual-use-onderzoek, waaronder gain-of-function-werk met het chikungunyavirus en onderzoeken naar de aanpassing van vogelgriep. Anthropic zei dat zijn classifiers deze activiteiten grotendeels hebben ingeperkt.
Het rapport beschrijft ook illegale distillatiecampagnes die worden toegeschreven aan Chinese laboratoria, waaronder Alibaba, DeepSeek, Moonshot AI, Xiaomi en Zhipu. Anthropic beschuldigt de laboratoria ervan gebruikersvragen heimelijk naar Claude door te sturen, reasoning traces te verzamelen en de daaruit voortkomende outputs te gebruiken om concurrerende modellen te trainen. In verschillende gevallen zou deze doorgeleiding gevoelige bedrijfs- en overheidsgegevens zonder medeweten van gebruikers aan derden hebben blootgesteld.
Anthropic presenteerde de openbaarmaking zowel als een waarschuwing als een routekaart. Het bedrijf zei dat, naarmate AI-modellen capabeler worden, gecoördineerde inspanningen van de AI-sector en overheden op het gebied van detectie en verdediging essentieel zullen zijn om voortdurende tegenstanders voor te blijven.
Bron: Metaverse Post