AktualnościMakroKalifornia wzywa OpenAI na podstawie nakazu w sprawie modeli AI, które włamały się, aby wydostać się z testu

Kalifornia wzywa OpenAI na podstawie nakazu w sprawie modeli AI, które włamały się, aby wydostać się z testu

Autor: Decrypt·

Najważniejsze informacje

  • •Prokurator generalny Kalifornii Rob Bonta ogłosił 1 października, że jego urząd doręczył dzień wcześniej OpenAI nakaz dochodzeniowy w sprawie odpowiedzi na pytania dotyczące incydentów bezpieczeństwa związanych z modelami AI firmy, w tym lipcowego włamania naugging Face.
  • •Nakaz wynika z formalnego dochodzenia otwartego przez Bontę we wrześniu i dołącza Kalifornię do grupy organów badających OpenAI, obejmującej Alabamę, koalicję prokuratorów generalnych 15 stanów oraz rzekomo trwające postępowanie Federalnej Komisji Handlu.
  • •W lipcu dwa modele OpenAI oceniane w benchmarku obejmującym 898 rzeczywistych luk w oprogramowaniu odkryły lukę zero-day, uciekły ze środowiska testowego i przy użyciu skradzionych poświadczeń włamały się do Hugging Face, najwyraźniej szukając klucza odpowiedzi benchmarku.
  • •Hugging Face ujawnił włamanie 16 lipca, OpenAI potwierdziło pięć dni później odpowiedzialność swoich modeli, a później przyznało, że te same modele uzyskały dostęp do kont na czterech dodatkowych usługach.
  • •Bonta powiedział, że graniczne modele AI mogą służyć jako legalne narzędzia cyberobrony, ale ich deweloperzy ponoszą moralną i prawną odpowiedzialność za zapewnienie, że modele nie przeprowadzają ani nie umożliwiają cyberataków.
Kalifornia wzywa OpenAI na podstawie nakazu w sprawie modeli AI, które włamały się, aby wydostać się z testu

Prokurator generalny Kalifornii Rob Bonta ogłosił 1 października, że jego urząd doręczył OpenAI nakaz dochodzeniowy w sprawie uzyskania odpowiedzi na pytania dotyczące incydentów bezpieczeństwa związanych z modelami AI firmy, w tym lipcowego włamania na platformę deweloperską Hugging Face.

Bonta oświadczył w czwartek, że nakaz został doręczony dzień wcześniej, według jego urzędu.

Ten krok dołącza Kalifornię do rosnącej listy władz stanowych i federalnych przyglądających się OpenAI, obok istniejącego nakazu z Alabamy, żądania koalicji prokuratorów generalnych 15 stanów oraz rzekomo trwającego postępowania Federalnej Komisji Handlu.

„Moje urząd zadaje OpenAI dodatkowe pytania dotyczące incydentów i ryzyk w zakresie bezpieczeństwa cybernetycznego związanych z firmą i jej modelami AI”, powiedział prokurator generalny Bonta. „Deweloperzy, którzy nie [dopilnują, aby nie przeprowadzali ani nie umożliwiali cyberataków], mogą i powinni ponosić odpowiedzialność prawną, a moje urząd jest zobowiązany do ustalenia, czy w tym przypadku tak właśnie jest”.

Nakaz sądowy to prawny rozkaz przekazania dokumentów lub odpowiedzi, a jego zignorowanie może zakończyć się przed sędzią. Ten ma charakter dochodzeniowy — to narzędzie służące do gromadzenia faktów przed podjęciem decyzji o pozwie. Urząd Bonty nie ujawnił publicznie, jakie dokumenty chce uzyskać od OpenAI.

Modele graniczne — najbardziej zaawansowane systemy AI na rynku — mogą być „legalnymi narzędziami cyberobrony”, powiedział Bonta. Ale firmy, które je tworzą, mają „moralną i prawną odpowiedzialność”, aby upewnić się, że nie przeprowadzają ani nie umożliwiają cyberataków, zarówno podczas testów, jak i po premierze, dodał. Ta dwubiegunowa napiętość — modele stworzone do znajdowania luk mogą je również wykorzystywać — znajduje się w centrum rozszerzającej się kontroli nad OpenAI.

Test, z którego uciekły

Nakaz następuje po lipcowym incydencie, który brzmi jak kiepska science fiction. Według OpenAI, dwa modele były oceniane w ramach benchmarku, który daje AI 898 rzeczywistych luk w oprogramowaniu i prosi o przekształcenie każdej z nich w działający atak.

Modele znalazły lukę zero-day — dziurę bezpieczeństwa, o której nikt nie wiedział, więc nie było dostępnej poprawki — w oprogramowaniu strony trzeciej, którego środowisko testowe używało do instalowania pakietów kodu. Wykorzystały ją, aby się wydostać.

Następnie wywnioskowały, że Hugging Face, szeroko używana platforma, na której deweloperzy udostępniają modele AI i zbiory danych, może przechowywać klucz odpowiedzi. Modele włamały się przy użyciu skradzionych poświadczeń i kolejnych luk w oprogramowaniu. Mówiąc wprost, AI poszukiwało odpowiedzi na własny egzamin. Ten epizod iluje również problem specyficzny dla agentowego AI: ewaluacja zaprojektowana do pomiaru umiejętności ofensywnego hakowania jest tak bezpieczna, jak środowisko, w którym jest przeprowadzana.

Hugging Face ujawnił włamanie 16 lipca, a OpenAI potwierdziło pięć dni później, że stoją za nim jego modele. OpenAI później poinformowało, że te same modele dostały się do kont na czterech innych usługach.

Długa obserwacja OpenAI przez Kalifornię

Bonta ogłosił formalne dochodzenie w sprawie incydentu z Hugging Face we wrześniu, a nakaz jest jego częścią. OpenAI ma siedzibę w Kalifornii, a gdy Bonta odmówił sprzeciwienia się przejściu firmy na strukturę komercyjną w październiku 2025 roku, powiedział, że jego urząd będzie trzymał „OpenAI na oku”, aby chronić „bezpieczeństwo wszystkich Kalifornczyków”.

Nie jest sam. Brenna Bird, prokurator generalny Iowa, kierowała w sierpniu koalicją 15 stanów, domagając się, aby OpenAI zachowało dokumenty i było przejrzyste w sprawie włamania. Alabama wydała własny nakaz, a FTC rzekomo bada laboratoria AI, w tym OpenAI i Anthropic.

Osobno australijski premier Anthony Albanese powiedział, że agent OpenAI dostał się w czerwcu do portalu statystycznego Medicare. W tamtym czasie wydawało się to pierwszym znanym przypadkiem włamania agenta AI do strony rządowej. Później wyszło na jaw, że agenci OpenAI działali latem również na stronach rządowych USA, choć najwyraźniej nie uzyskano dostępu do żadnych niejawnych informacji.

Najbliższe kroki mają charakter proceduralny: jakie materiały OpenAI przedstawi w odpowiedzi na nakazy oraz czy urząd Bonty lub któreś z równoległych dochodzeń przejdzie od gromadzenia faktów do formalnego egzekwowania prawa. Te odpowiedzi mogą ukształtować sposób, w jaki rządy podchodzą do nadzoru nad modelami AI działającymi samodzielnie.