Anthropic twierdzi, że zablokował próby wykorzystania AI w badaniach nad bronią biologiczną
Najważniejsze informacje
- •Raport Anthropic opisał pięć przypadków potencjalnie niebezpiecznych badań biologicznych prowadzonych z wykorzystaniem chatbota Claude.
- •Jedno z dochodzeń dotyczyło prośby związanej ze zwiększeniem zakaźności i szkodliwości wirusa chikungunya, którą Anthropic zablokował.
- •Firma zablokowała powiązane konta, zakłóciła działanie sieci przekierowujących używanych do obchodzenia ograniczeń i rozszerzyła zabezpieczenia.
- •Anthropic poinformował, że aktor powiązany z Iranem wykorzystywał Claude’a do analizowania publicznych danych w celu opracowania rekomendacji dotyczących celów związanych z amerykańskimi siłami morskimi.
- •Raport opublikowano po publicznych ostrzeżeniach badacza ds. bezpieczeństwa Anthropic i byłego pracownika dotyczących poważnych zagrożeń związanych z zaawansowaną AI.

Anthropic poinformował w czwartek, że w tym roku zakłócił kilka prób wykorzystania jego modeli sztucznej inteligencji do badań biologicznych, które potencjalnie mogłyby wesprzeć rozwój broni biologicznej. Firma podała, że w rezultacie zablokowała powiązane konta i wzmocniła zabezpieczenia.
W 154-stronicowym raporcie Detecting and Countering Misuse of AI Anthropic opisał pięć przypadków dotyczących badaczy, którzy wykorzystywali jego chatbota Claude do zaawansowanych badań biologicznych o potencjalnym podwójnym zastosowaniu.
Po przeprowadzeniu dochodzenia Anthropic poinformował, że zablokował konta, przekazał ustalenia władzom państwowym i innym laboratoriom AI oraz rozszerzył środki bezpieczeństwa.
„Zablokowaliśmy wszystkie powiązane konta, współpracowaliśmy z partnerami przy likwidacji sieci przekierowujących, które omijały blokady regionalne, oraz przekazaliśmy nasze ustalenia zainteresowanym laboratoriom AI i władzom państwowym” — poinformował Anthropic.
Firma podkreśliła, że nie twierdzi, iż badacze zamierzali wyrządzić szkodę. Badania biologiczne mogą wspierać opracowywanie szczepionek i terapii, ale ta sama wiedza może zostać niewłaściwie wykorzystana — stwierdził Anthropic.
„Możliwości biologiczne mają podwójne zastosowanie: mogą być wykorzystywane w celach pożytecznych lub szkodliwych, a często trudno je od siebie odróżnić” — stwierdzono w raporcie. „Te same informacje, które można wykorzystać do opracowania broni biologicznej, mogą posłużyć na przykład do opracowania szczepionki lub leku na chorobę”.
Jeden z przypadków dotyczył badacza, który poprosił Claude’a o pomoc w przygotowaniu wniosku grantowego dotyczącego badań nad uzyskaniem funkcji, obejmujących chikungunyę — wirusa przenoszonego przez komary. Anthropic podał, że propozycja zakładała modyfikację wirusa w celu zwiększenia jego zakaźności i niebezpieczeństwa.
Choć tego rodzaju badania mogą pomóc naukowcom w opracowywaniu szczepionek i terapii, firma stwierdziła, że mogą również zostać niewłaściwie wykorzystane do zwiększenia szkodliwości wirusa. Anthropic poinformował, że zablokował żądanie, a później odkrył, iż badacze korzystali z zewnętrznej platformy, aby omijać ograniczenia regionalne i automatycznie przekierowywać odrzucone zapytania do innego modelu AI.
Według raportu inne przypadki dotyczyły ptasiej grypy, badań nad ortopokswirusami oraz badań związanych z nieprzenoszącymi się jadami i toksynami.
„Zaawansowani aktorzy zagrożeń wiedzą, że my — podobnie jak inni dostawcy AI — próbujemy wykrywać niebezpieczne zastosowania naszych modeli, i wykorzystują dwojakie zastosowanie biologii, aby utrzymywać swego rodzaju «wiarygodne zaprzeczenie» dotyczące swoich badań” — poinformowała firma.
Raport opisał również kilka przypadków powiązanych z Iranem, w których aktorzy mieli wykorzystywać Claude’a do wspierania kampanii wpływu, operacji inwigilacyjnych i badań dotyczących amerykańskich sił morskich.
„Zidentyfikowaliśmy i zakłóciliśmy działalność aktora zagrożenia powiązanego z Iranem, który wykorzystywał Claude’a do gromadzenia i analizowania publicznie dostępnych danych w celu opracowania rekomendacji dotyczących celów przeciwko amerykańskim siłom morskim w regionie” — poinformował Anthropic. „Zablokowaliśmy konto tego aktora, opracowaliśmy mechanizmy wykrywania w celu ograniczenia ryzyka przyszłego niewłaściwego wykorzystania oraz przekazaliśmy informacje wywiadowcze dotyczące zagrożenia władzom państwowym, aby zakłócić jego działalność”.
Raport opublikowano po tym, jak starszy badacz ds. bezpieczeństwa w Anthropic powiedział we wtorek, że prawdopodobieństwo, iż AI „zabije wszystkich ludzi”, w ciągu najbliższej dekady przekracza 10%. Była to odpowiedź na wypowiedź byłego pracownika, który zrezygnował z pracy, oskarżając firmę o nieodpowiedzialne działania.
Jacob Coxon, były badacz Anthropic i OpenAI, napisał w obszernym wątku rezygnacyjnym opublikowanym w niedzielę na X, że „ludzie budujący AI naprawdę wierzą, że do końca dekady może ona zabić nas wszystkich”.
„Dziś zrezygnowałem z pracy w Anthropic. Przez ostatnie trzy lata prowadziłem badania nad pretrainingiem zarówno w OpenAI, jak i w Anthropic. Żadna z tych firm nie działa odpowiedzialnie. Pędzą prosto ku samodoskonalącej się superinteligencji i ryzykują naszym życiem” — napisał Coxon.
Anthropic nie odpowiedział od razu na prośbę FOX Business o komentarz. W powstaniu materiału uczestniczył Robert McGreevy z FOX Business.
Źródło: FOX Business