Raport Anthropic szczegółowo opisuje wykorzystanie AI w cyberprzestępczości, kampaniach wpływu i operacjach państwowych
Najważniejsze informacje
- •Raport obejmuje przypadki zaawansowanego niewłaściwego wykorzystania wykryte i zakłócone w Rosji, Chinach, Iranie i innych regionach, a nie częstotliwość typowych nadużyć.
- •Aktorzy zagrażający wykorzystywali systemy wieloagentowe do automatyzacji operacji cybernetycznych, w tym phishingu, tworzenia złośliwego oprogramowania, pozyskiwania danych uwierzytelniających i eksfiltracji danych.
- •Anthropic zidentyfikował wśród opisanych działań kampanie wpływu, programy inwigilacyjne, projekty związane z bronią oraz badania biologiczne podwójnego zastosowania.
- •Firma zarzuciła kilku chińskim laboratoriom potajemne pozyskiwanie wyników Claude’a i śladów rozumowania w celu trenowania konkurencyjnych modeli; niektóre takie przepływy miały ujawnić wrażliwe dane.
- •Anthropic poinformował, że żaden z przypadków nie dotyczył jego najbardziej zaawansowanych modeli Fable lub Mythos, z wyjątkiem jednego incydentu związanego z destylacją.

Firma badawcza zajmująca się sztuczną inteligencją Anthropic opublikowała najnowszy raport dotyczący cyberzagrożeń, „Wykrywanie i przeciwdziałanie niewłaściwemu wykorzystaniu AI: wrzesień 2026”, opisujący próby wykorzystania jej modeli Claude przez złośliwych aktorów do operacji cybernetycznych, kampanii wpływu, inwigilacji, badań biologicznych, rozwoju broni, oszustw i destylacji modeli.
Raport obejmuje działania wykryte i zakłócone między grudniem 2025 roku a sierpniem 2026 roku. Przypadki dotyczyły podejrzewanych grup sponsorowanych przez państwa, przestępców motywowanych finansowo, dostawców komercyjnego oprogramowania szpiegującego oraz instytucji propagandowych działających w Rosji, Chinach, Iranie i innych regionach.
Anthropic poinformował, że żaden z udokumentowanych przypadków niewłaściwego wykorzystania nie dotyczył jego najbardziej zaawansowanych modeli klasy Fable lub Mythos, z wyjątkiem jednego przypadku opisanego w części dotyczącej destylacji. Firma podkreśliła również, że ujawnione incydenty nie reprezentują typowego niewłaściwego wykorzystania. Wybrano je jako najbardziej zaawansowaną i nowatorską aktywność związaną z zagrożeniami, jaką dotąd zidentyfikowano. Oznacza to, że raport stanowi zapis udokumentowanego niewłaściwego wykorzystania na najwyższym poziomie, a nie miarę częstotliwości występowania takich działań. Anthropic poinformował, że w każdym przypadku zablokował powiązane konta, wzmocnił zabezpieczenia na podstawie ustaleń ze śledztw oraz udostępnił informacje organom władz i partnerom z branży.
We're publishing our most detailed threat intelligence report to date. It covers how people tried to misuse Claude—for cyberattacks, influence operations, surveillance, biology, and building weapons—and how we found and stopped them. We disrupted every operation in the report,… — Anthropic (@AnthropicAI) September 10, 2026
https://x.com/AnthropicAI/status/2098097512544444447?ref_src=twsrc%5Etfw
Od asystenta do koordynatora: najważniejsze ustalenia
Główny wniosek raportu jest taki, że AI przekształciła się z narzędzia doradczego w operacyjnego koordynatora działań cyberprzestępczych. W większości analizowanych operacji aktorzy zagrażający wykorzystywali struktury wieloagentowe, które autonomicznie prowadziły rozpoznanie, eksploatację systemów, pozyskiwanie danych uwierzytelniających i eksfiltrację danych. Uczestnicy po stronie ludzkiej zajmowali się przede wszystkim wyborem celów i analizą wyników.
Jeden z istotnych przypadków, oznaczony jako GTG-20006, powiązano z rosyjską grupą powiązaną z aparatem państwowym Midnight Blizzard. Grupa wykorzystywała przepływy pracy sterowane przez AI do phishingu, tworzenia złośliwego oprogramowania i obchodzenia zabezpieczeń, automatycznie przebudowując swój zestaw narzędzi za każdym razem, gdy wykrywały go produkty bezpieczeństwa. Niezależnie od tego podejrzewani afilianci ShinyHunters wykorzystywali AI do uprzemysłowienia pozyskiwania danych uwierzytelniających, dekompilując 1.8 million aplikacji na Androida w poszukiwaniu sekretów i przeprowadzając włamania w czasie zaledwie od dwóch do trzech godzin.
Poza operacjami cybernetycznymi Anthropic udokumentował kampanie wpływu wymierzone w wybory i opinię publiczną w Mołdawii, Kenii, Malezji i Bangladeszu. Opisał również działania inwigilacyjne powiązane z państwami w Chinach, Iranie i Mali, w tym platformę zaprojektowaną do monitorowania około 25 million abonentów telefonii komórkowej.
Raport wskazał ponadto działania związane z rozwojem broni, w tym program pocisków kierowanych w Jemenie oraz projekt autonomicznego roju dronów w Rosji. W części dotyczącej niewłaściwego wykorzystania biologii przedstawiono pięć przypadków badań podwójnego zastosowania, w tym prace nad zwiększaniem funkcji wirusa chikungunya oraz badania nad przystosowaniem wirusa ptasiej grypy. Anthropic poinformował, że jego klasyfikatory w dużej mierze powstrzymały te działania.
Raport szczegółowo opisuje również nielegalne kampanie destylacji przypisywane chińskim laboratoriom, w tym Alibaba, DeepSeek, Moonshot AI, Xiaomi i Zhipu. Anthropic zarzuca laboratoriom potajemne przekierowywanie zapytań użytkowników do Claude’a, pozyskiwanie śladów rozumowania i wykorzystywanie uzyskanych wyników do trenowania konkurencyjnych modeli. W kilku przypadkach taki pośredni przepływ miał ujawnić wrażliwe dane firmowe i rządowe stronom trzecim bez wiedzy użytkowników.
Anthropic przedstawił ujawnione informacje zarówno jako ostrzeżenie, jak i mapę dalszych działań. Firma stwierdziła, że wraz ze wzrostem możliwości modeli AI skoordynowane działania branży AI i rządów w zakresie wykrywania zagrożeń oraz obrony będą niezbędne, aby wyprzedzać stale działających przeciwników.
Źródło: Metaverse Post