Il rapporto di Anthropic illustra l’uso dell’IA nella criminalità informatica, nelle campagne di influenza e nelle operazioni statali
Punti chiave
- •Il rapporto riguarda casi di uso improprio di alto livello rilevati e interrotti in Russia, Cina, Iran e altre regioni, non la frequenza dell’uso improprio tipico.
- •Gli attori delle minacce hanno utilizzato sistemi multi-agente per automatizzare operazioni informatiche, tra cui phishing, sviluppo di malware, raccolta di credenziali ed esfiltrazione di dati.
- •Anthropic ha individuato campagne di influenza, programmi di sorveglianza, progetti di armamenti e ricerche biologiche a duplice uso tra le attività documentate.
- •L’azienda ha accusato diversi laboratori cinesi di estrarre di nascosto output e tracce del ragionamento di Claude per addestrare modelli concorrenti; secondo le accuse, alcuni inoltri avrebbero esposto dati sensibili.
- •Anthropic ha dichiarato che nessuno dei casi ha coinvolto i suoi modelli più capaci Fable o Mythos, ad eccezione di un incidente legato alla distillazione.

La società di ricerca sull’IA Anthropic ha pubblicato il suo più recente rapporto di intelligence sulle minacce, “Detecting and Countering Misuse of AI: September 2026”, che descrive i tentativi di attori malevoli di trasformare i suoi modelli Claude in strumenti per operazioni informatiche, campagne di influenza, sorveglianza, ricerca biologica, sviluppo di armi, frodi e distillazione di modelli.
Il rapporto riguarda attività rilevate e interrotte tra dicembre 2025 e agosto 2026. I casi hanno coinvolto gruppi sospettati di essere sponsorizzati da Stati, criminali motivati da interessi finanziari, fornitori commerciali di spyware e istituzioni di propaganda operanti in Russia, Cina, Iran e altre regioni.
Anthropic ha dichiarato che nessuno dei casi documentati di uso improprio ha coinvolto i suoi modelli più capaci delle classi Fable o Mythos, fatta eccezione per un caso descritto nella sezione sulla distillazione. L’azienda ha inoltre sottolineato che gli incidenti resi pubblici non rappresentano l’uso improprio tipico. Sono stati invece selezionati in quanto esempi delle attività di minaccia più sofisticate e innovative identificate finora. Ciò significa che il rapporto costituisce una documentazione degli abusi di alto livello osservati, non una misura della frequenza con cui tali attività si verificano. Anthropic ha affermato di aver bloccato gli account associati in ogni caso, rafforzato le proprie misure di sicurezza sulla base dei risultati delle indagini e condiviso informazioni con le autorità e i partner del settore.
We're publishing our most detailed threat intelligence report to date. It covers how people tried to misuse Claude—for cyberattacks, influence operations, surveillance, biology, and building weapons—and how we found and stopped them. We disrupted every operation in the report,… — Anthropic (@AnthropicAI) September 10, 2026
https://x.com/AnthropicAI/status/2098097512544444447?ref_src=twsrc%5Etfw
Dall’assistente all’orchestratore: principali risultati
La conclusione centrale del rapporto è che l’IA è passata dall’essere uno strumento consultivo a un orchestratore operativo della criminalità informatica. Nella maggior parte delle operazioni esaminate, gli attori delle minacce hanno impiegato framework multi-agente in grado di eseguire autonomamente ricognizione, sfruttamento delle vulnerabilità, raccolta di credenziali ed esfiltrazione di dati. I partecipanti umani si sono occupati principalmente di selezionare gli obiettivi e verificare i risultati.
Un caso rilevante, identificato come GTG-20006, è stato collegato al gruppo russo legato agli apparati statali Midnight Blizzard. Il gruppo ha utilizzato flussi di lavoro basati sull’IA per attività di phishing, sviluppo di malware ed elusione, ricostruendo automaticamente il proprio arsenale ogni volta che i prodotti di sicurezza lo rilevavano. Separatamente, affiliati sospetti di ShinyHunters hanno usato l’IA per industrializzare la raccolta di credenziali, decompilando 1.8 million applicazioni Android alla ricerca di segreti e completando violazioni in appena due o tre ore.
Al di là delle operazioni informatiche, Anthropic ha documentato campagne di influenza rivolte contro elezioni e opinione pubblica in Moldova, Kenya, Malaysia e Bangladesh. Ha inoltre descritto attività di sorveglianza allineate con gli interessi statali in Cina, Iran e Mali, inclusa una piattaforma progettata per monitorare circa 25 million di abbonati alla telefonia mobile.
Il rapporto ha inoltre individuato attività di sviluppo di armi, tra cui un programma per razzi guidati in Yemen e un progetto russo per uno sciame autonomo di droni. La sezione sull’uso improprio in ambito biologico illustra cinque casi di ricerca a duplice uso, tra cui attività di gain-of-function sul virus chikungunya e studi sull’adattamento dell’influenza aviaria. Anthropic ha dichiarato che i suoi classificatori hanno contenuto in larga misura queste attività.
Il rapporto descrive anche campagne illecite di distillazione attribuite a laboratori cinesi, tra cui Alibaba, DeepSeek, Moonshot AI, Xiaomi e Zhipu. Anthropic accusa i laboratori di aver instradato di nascosto le richieste degli utenti verso Claude, raccolto tracce del ragionamento e utilizzato gli output risultanti per addestrare modelli concorrenti. In diversi casi, questo inoltro avrebbe esposto dati aziendali e governativi sensibili a soggetti terzi senza che gli utenti ne fossero a conoscenza.
Anthropic ha presentato la divulgazione sia come un avvertimento sia come una roadmap. L’azienda ha affermato che, con l’aumento delle capacità dei modelli di IA, saranno essenziali sforzi coordinati di rilevamento e difesa da parte dell’industria dell’IA e dei governi per mantenere un vantaggio sugli avversari persistenti.
Fonte: Metaverse Post