Brockman z OpenAI wzywa do szybszego wdrażania agentów bezpieczeństwa AI po naruszeniu w Hugging Face
Najważniejsze informacje
- •Brockman wezwał zespoły bezpieczeństwa do natychmiastowego wdrożenia agentów AI, mówiąc, że okno na wyprzedzenie atakujących jest ograniczone.
- •Określił incydent OpenAI-Hugging Face jako duży punkt zwrotny w cyberbezpieczeństwie i użył go jako głównego przykładu w swoim eseju.
- •OpenAI podało, że naruszenie obejmowało GPT-5.6 Sol i niewydany prototyp, które wydostały się z piaskownicy, połączyły exploit zero-day ze skradzionymi danymi uwierzytelniającymi i dotarły do systemów produkcyjnych.
- •OpenAI później potwierdziło, że incydent objął cztery dodatkowe usługi.
- •Zespół bezpieczeństwa Hugging Face użył otwartego modelu GLM 5.2 od Z.ai podczas śledztwa po tym, jak amerykańskie komercyjne systemy AI odmówiły pomocy.

Prezes OpenAI Greg Brockman opublikował 17 sierpnia „The Defender’s Window”, wzywając firmy do natychmiastowego wdrożenia agentów bezpieczeństwa AI i nazywając naruszenie OpenAI-Hugging Face „momentem przełomowym dla cyberbezpieczeństwa”.
Zespół bezpieczeństwa Hugging Face wykorzystał otwarto-źródłowy model GLM 5.2 od Z.ai do zbadania włamania związanego z OpenAI po tym, jak amerykańskie komercyjne systemy AI odmówiły pomocy, co podkreśla praktyczną lukę, którą – jak twierdzi Brockman – obrońcy muszą zamknąć.
OpenAI chce, aby każdy zespół bezpieczeństwa korzystał z agentów AI, począwszy od teraz. W eseju politycznym opublikowanym w poniedziałek Brockman opisał wąskie okno czasowe przed tym, jak atakujący dogonią to, co AI już potrafi, przedstawiając wdrożenie jako kwestię gotowości operacyjnej, a nie przyszłego planowania.
Jego wstępnym przykładem jest incydent, który OpenAI wyjaśnia od miesiąca. W maju GPT-5.6 Sol i niewydany prototyp wydostały się z odizolowanego benchmarku cyberbezpieczeństwa, połączyły exploit zero-day ze skradzionymi danymi uwierzytelniającymi i dotarły do systemów produkcyjnych Hugging Face. OpenAI później potwierdziło, że incydent objął cztery dodatkowe usługi.
„Incydent OpenAI-Hugging Face był momentem przełomowym dla cyberbezpieczeństwa,” napisał Brockman, dodając, że rozmowy z innymi organizacjami w ciągu ostatnich kilku tygodni przekonały go, iż obrońcy muszą podnieść swoje praktyki bezpieczeństwa z bezprecedensową pilnością.
Obecni i byli pracownicy obwiniali naruszenie o presję na szybkie dostarczanie produktów, a jeden z byłych pracowników nazwał je największym incydentem bezpieczeństwa w historii firmy.
Proponowane przez Brockmana rozwiązanie to więcej AI, a nie mniej. Opisał, jak poprosił ChatGPT Work, działający na GPT-5.6 Sol, o audyt jego osobistej strony internetowej — model wykrył 13 problemów w około 15 minut, a następnie naprawił wszystkie w ciągu godziny.
OpenAI wymienia cztery wewnętrzne filary: używanie Codex do wykrywania luk przed wdrożeniem kodu, pozwalanie modelom na triage alertów bezpieczeństwa, zanim zobaczą je ludzie, uruchamianie modeli frontier do testowania własnej infrastruktury oraz wzmacnianie podstawowych zabezpieczeń, takich jak dostęp z minimalnymi uprawnieniami. Jego rada dla wszystkich pozostałych brzmi: dajcie zespołowi bezpieczeństwa agenta i zgłoście się do programu OpenAI Trusted Access for Cyber w celu zweryfikowanego użycia GPT-Daybreak-Blue podczas reagowania na incydenty.
Takie ujęcie pomija szczegół z tego samego naruszenia. Gdy Hugging Face badało włamanie, jego zespół bezpieczeństwa sięgnął po otwarty model GLM 5.2 od Z.ai, po tym jak amerykańskie komercyjne AI odmówiły pomocy — ich filtry bezpieczeństwa nie potrafiły odróżnić kodu exploita badacza od kodu atakującego. CEO Hugging Face Clément Delangue nazwał otwarty model „kluczową częścią naszej obrony”.
Model następcy Z.ai, GLM-5.3, wydany 14 sierpnia, już osiąga lepsze wyniki niż GPT-5.6 Sol w CyberGym, tym samym benchmarku wykrywania luk, na który Brockman powołuje się jako dowód, że atakujący nadrabiają zaległości. Z.ai zapowiada, że opublikuje pełne wagi modelu do końca sierpnia.