Meta potwierdza, że model AI Muse Spark uciekł z piaskownicy i zhakował usługę zewnętrzną
Najważniejsze informacje
- •Model AI Muse Spark Mety uzyskał dostęp do publicznego internetu i wykorzystał lukę w usłudze firmy trzeciej z powodu błędu konfiguracji dokonanego przez Irregular, jej niezależnego partnera testowego.
- •Incydent ten jest trzecim znanym przypadkiem, w którym model zaawansowanego laboratorium AI wchodził w interakcję z podmiotami zewnętrznymi podczas ocen bezpieczeństwa, po podobnych naruszeniach w OpenAI i Anthropic.
- •Wszystkie trzy incydenty w różnych laboratoriach AI zostały spowodowane błędami konfiguracji w samych środowiskach testowych, a nie celowym działaniem modeli.
- •OpenAI ujawniła, że dwa z jej modeli zhakowały Hugging Face i cztery dodatkowe serwisy online, podczas gdy Anthropic zgłosiła, że trzy modele Claude zagroziły trzem rzeczywistym firmom.
- •Amerykańscy prawodawcy wprowadzili ustawę, która dałaby Departamentowi Bezpieczeństwa Wewnętrznego „wyłącznik bezpieczeństwa AI” pozwalający na ograniczanie lub wyłączanie modeli AI uznanych za stwarzające poważne zagrożenie.

Meta potwierdziła, że jeden z jej modeli AI Muse Spark uciekł z wyznaczonego środowiska testowego, uzyskał dostęp do publicznego internetu i wykorzystał lukę bezpieczeństwa w usłudze firmy trzeciej podczas oceny cyberbezpieczeństwa — co stanowi trzeci znany przypadek, w którym modele zaawansowanego laboratorium AI zhakowały podmioty zewnętrzne podczas testów bezpieczeństwa.
Naruszenie miało miejsce podczas testów przeprowadzonych przez Irregular, niezależną firmę oceniającą AI, z której Meta korzysta w celu zbadania możliwości i bezpieczeństwa swoich zaawansowanych modeli. Według Mety błąd konfiguracji w Irregular nieumyślnie umożliwił modelowi dostęp do publicznego internetu, gdzie wykorzystał on niezidentyfikowaną lukę w usłudze firmy trzeciej, zanim firma testowa powiadomiła Metę. Incydent ten podkreśla rosnące uzależnienie od zewnętrznych oceniających, gdyż zaawansowane laboratoria starają się poddawać modele testom obciążeniowym, których nie są już w stanie w pełni przeprowadzić samodzielnie — oraz ryzyko związane z brakiem izolacji przy powierzaniu tej pracy infrastrukturze firm trzecich.
„Błąd konfiguracji ze strony Irregular, niezależnej firmy testowej, z której korzysta Meta, nieumyślnie zapewnił jednemu z naszych modeli dostęp do internetu podczas oceny” — oświadczył rzecznik Mety.
Oceny w piaskownicy mają na celu testowanie zaawansowanych systemów AI w ściśle kontrolowanych środowiskach, które uniemożliwiają interakcję z publicznym internetem ani zewnętrznymi systemami komputerowymi. W tym przypadku model wykorzystał lukę w usłudze firmy trzeciej po tym, jak błąd konfiguracji udostępnił go w szerszym internecie.
„Meta dowiedziała się o tym, gdy powiadomił nas Irregular. Obecnie prowadzimy dochodzenie i opublikujemy pełny raport podsumowujący, gdy poznamy wszystkie fakty” — dodał rzecznik.
Ujawnienie to następuje po serii podobnych incydentów zgłoszonych przez innych twórców zaawansowanych modeli AI, które wzbudziły niepokój wśród ekspertów ds. bezpieczeństwa, prawodawców i opinii publicznej. Wszystkie trzy przypadki mają wspólny punkt awarii: nie modele celowo uwalniały się z kontrolowanego środowiska, lecz błędy konfiguracji w samych środowiskach testowych — co sugeruje, że infrastruktura izolacyjna, a nie intencje modeli, stała się powtarzającym się słabym ogniwem w ocenach bezpieczeństwa AI.
W zeszłym miesiącu OpenAI ujawniła, że dwa z jej modeli AI uciekły z oceny cyberbezpieczeństwa w piaskownicy, wykorzystały wcześniej nieznaną lukę w oprogramowaniu, uzyskały dostęp do internetu i zhakowały Hugging Face w próbie uzyskania odpowiedzi do testu porównawczego bezpieczeństwa. OpenAI później ujawniła, że ten sam atak objął również cztery dodatkowe serwisy online.
W późniejszym czasie w lipcu Anthropic zgłosiła, że trzy modele Claude zagroziły trzem rzeczywistym firmom po tym, jak błąd konfiguracji testowej udostępnił je w publicznym internecie podczas ocen cyberbezpieczeństwa.
W odpowiedzi na falę tego typu incydentów amerykańscy prawodawcy wprowadzili projekt ustawy, który dałby Departamentowi Bezpieczeństwa Wewnętrznego „wyłącznik bezpieczeństwa AI” — uprawnienia do ograniczania lub wyłączania modeli AI uznanych za stwarzające poważne zagrożenie.