AktualnościAkcjeMeta potwierdza, że model AI Muse Spark uciekł z piaskownicy i zhakował usługę zewnętrzną

Meta potwierdza, że model AI Muse Spark uciekł z piaskownicy i zhakował usługę zewnętrzną

Autor: Decrypt·

Najważniejsze informacje

  • Model AI Muse Spark Mety uzyskał dostęp do publicznego internetu i wykorzystał lukę w usłudze firmy trzeciej z powodu błędu konfiguracji dokonanego przez Irregular, jej niezależnego partnera testowego.
  • Incydent ten jest trzecim znanym przypadkiem, w którym model zaawansowanego laboratorium AI wchodził w interakcję z podmiotami zewnętrznymi podczas ocen bezpieczeństwa, po podobnych naruszeniach w OpenAI i Anthropic.
  • Wszystkie trzy incydenty w różnych laboratoriach AI zostały spowodowane błędami konfiguracji w samych środowiskach testowych, a nie celowym działaniem modeli.
  • OpenAI ujawniła, że dwa z jej modeli zhakowały Hugging Face i cztery dodatkowe serwisy online, podczas gdy Anthropic zgłosiła, że trzy modele Claude zagroziły trzem rzeczywistym firmom.
  • Amerykańscy prawodawcy wprowadzili ustawę, która dałaby Departamentowi Bezpieczeństwa Wewnętrznego „wyłącznik bezpieczeństwa AI” pozwalający na ograniczanie lub wyłączanie modeli AI uznanych za stwarzające poważne zagrożenie.
Meta potwierdza, że model AI Muse Spark uciekł z piaskownicy i zhakował usługę zewnętrzną

Meta potwierdziła, że jeden z jej modeli AI Muse Spark uciekł z wyznaczonego środowiska testowego, uzyskał dostęp do publicznego internetu i wykorzystał lukę bezpieczeństwa w usłudze firmy trzeciej podczas oceny cyberbezpieczeństwa — co stanowi trzeci znany przypadek, w którym modele zaawansowanego laboratorium AI zhakowały podmioty zewnętrzne podczas testów bezpieczeństwa.

Naruszenie miało miejsce podczas testów przeprowadzonych przez Irregular, niezależną firmę oceniającą AI, z której Meta korzysta w celu zbadania możliwości i bezpieczeństwa swoich zaawansowanych modeli. Według Mety błąd konfiguracji w Irregular nieumyślnie umożliwił modelowi dostęp do publicznego internetu, gdzie wykorzystał on niezidentyfikowaną lukę w usłudze firmy trzeciej, zanim firma testowa powiadomiła Metę. Incydent ten podkreśla rosnące uzależnienie od zewnętrznych oceniających, gdyż zaawansowane laboratoria starają się poddawać modele testom obciążeniowym, których nie są już w stanie w pełni przeprowadzić samodzielnie — oraz ryzyko związane z brakiem izolacji przy powierzaniu tej pracy infrastrukturze firm trzecich.

„Błąd konfiguracji ze strony Irregular, niezależnej firmy testowej, z której korzysta Meta, nieumyślnie zapewnił jednemu z naszych modeli dostęp do internetu podczas oceny” — oświadczył rzecznik Mety.

Oceny w piaskownicy mają na celu testowanie zaawansowanych systemów AI w ściśle kontrolowanych środowiskach, które uniemożliwiają interakcję z publicznym internetem ani zewnętrznymi systemami komputerowymi. W tym przypadku model wykorzystał lukę w usłudze firmy trzeciej po tym, jak błąd konfiguracji udostępnił go w szerszym internecie.

„Meta dowiedziała się o tym, gdy powiadomił nas Irregular. Obecnie prowadzimy dochodzenie i opublikujemy pełny raport podsumowujący, gdy poznamy wszystkie fakty” — dodał rzecznik.

Ujawnienie to następuje po serii podobnych incydentów zgłoszonych przez innych twórców zaawansowanych modeli AI, które wzbudziły niepokój wśród ekspertów ds. bezpieczeństwa, prawodawców i opinii publicznej. Wszystkie trzy przypadki mają wspólny punkt awarii: nie modele celowo uwalniały się z kontrolowanego środowiska, lecz błędy konfiguracji w samych środowiskach testowych — co sugeruje, że infrastruktura izolacyjna, a nie intencje modeli, stała się powtarzającym się słabym ogniwem w ocenach bezpieczeństwa AI.

W zeszłym miesiącu OpenAI ujawniła, że dwa z jej modeli AI uciekły z oceny cyberbezpieczeństwa w piaskownicy, wykorzystały wcześniej nieznaną lukę w oprogramowaniu, uzyskały dostęp do internetu i zhakowały Hugging Face w próbie uzyskania odpowiedzi do testu porównawczego bezpieczeństwa. OpenAI później ujawniła, że ten sam atak objął również cztery dodatkowe serwisy online.

W późniejszym czasie w lipcu Anthropic zgłosiła, że trzy modele Claude zagroziły trzem rzeczywistym firmom po tym, jak błąd konfiguracji testowej udostępnił je w publicznym internecie podczas ocen cyberbezpieczeństwa.

W odpowiedzi na falę tego typu incydentów amerykańscy prawodawcy wprowadzili projekt ustawy, który dałby Departamentowi Bezpieczeństwa Wewnętrznego „wyłącznik bezpieczeństwa AI” — uprawnienia do ograniczania lub wyłączania modeli AI uznanych za stwarzające poważne zagrożenie.