AktualnościMakroOpenAI wstrzymało część działań związanych z Astra z powodu „krytycznych” ustaleń dotyczących cyberbezpieczeństwa; Altman mówi, że trening trwał

OpenAI wstrzymało część działań związanych z Astra z powodu „krytycznych” ustaleń dotyczących cyberbezpieczeństwa; Altman mówi, że trening trwał

Autor: CryptoBriefing·

Najważniejsze informacje

  • OpenAI powiedziało, że możliwości cyberbezpieczeństwa Astra osiągnęły lub zbliżyły się do poziomu „critical” w Preparedness Framework.
  • Model wykazał zaawansowane umiejętności agentowego kodowania oraz potencjał do znajdowania lub wykorzystywania podatności zero-day.
  • OpenAI wstrzymało objęte tym działania wewnętrzne na nieco ponad dwa tygodnie, wdrażając nowe środki bezpieczeństwa.
  • Sam Altman powiedział, że podstawowy trening Astra nie został zatrzymany, a nowe modele nadal mają zostać wkrótce wydane.
OpenAI wstrzymało część działań związanych z Astra z powodu „krytycznych” ustaleń dotyczących cyberbezpieczeństwa; Altman mówi, że trening trwał

OpenAI wstrzymało niektóre wewnętrzne działania związane z modelem Astra 7 sierpnia 2026 roku, po wstępnych ustaleniach wskazujących, że AI osiągnęła to, co firma klasyfikuje jako „krytyczne” możliwości w zakresie cyberbezpieczeństwa. CEO Sam Altman podkreślił jednak, że podstawowy trening Astra nigdy nie został zatrzymany i że nowe modele nadal mają zostać wkrótce wprowadzone na rynek.

Co spowodowało przerwę

Zastrzeżenia dotyczą możliwości cyberbezpieczeństwa Astra, które według doniesień osiągnęły lub zbliżyły się do poziomu „critical” w OpenAI Preparedness Framework — najwyższej klasyfikacji, jakiej firma używa do oceny ryzyka modeli.

W praktyce model wykazał zaawansowane umiejętności agentowego kodowania oraz potencjał do identyfikowania lub wykorzystywania podatności zero-day. Podatności zero-day to luki bezpieczeństwa, których dostawcy oprogramowania jeszcze nie znają, co czyni je niezwykle cennymi zarówno dla obrońców, jak i atakujących. Odkrywanie podatności z użyciem AI jest już aktywnym obszarem prac: AI Cyber Challenge DARPA, którego finały odbyły się podczas konferencji hakerskiej DEF CON w 2025 roku, polegał na tym, by systemy AI znajdowały i łatały luki w szeroko używanym oprogramowaniu open source, co podkreśla zarówno defensywny potencjał, jak i ryzyko podwójnego zastosowania tej zdolności.

Przerwa trwała nieco ponad dwa tygodnie, podczas gdy OpenAI wdrażało nowe środki bezpieczeństwa wokół tych konkretnych możliwości. W tym czasie firma oceniła ryzyka i wprowadziła zabezpieczenia, zanim wznowiła objęte działaniami obszary.

Szersze możliwości Astra

Wymiar cyberbezpieczeństwa to tylko jeden aspekt tego, co wydaje się wyjątkowo potężnym modelem. Według doniesień wcześniejsza wersja Astra rozwiązała 10 głównych otwartych problemów z matematyki i teoretycznej informatyki — co, jeśli zostałoby niezależnie potwierdzone, stanowiłoby przełomowe osiągnięcie w badaniach nad AI.

Altman powiedział, że Astra ma być udostępniona „generally available”, co oznacza, że nie będzie bezterminowo zamknięta za ograniczonym dostępem badawczym. Przyznał jednak, że potrzeba więcej czasu, aby zapewnić bezpieczny rozwój modelu, ze szczególnym uwzględnieniem jego zdolności cybernetycznych przed szerszym wdrożeniem.

Równowaga między bezpieczeństwem a tempem

OpenAI Preparedness Framework został zaprojektowany właśnie na takie sytuacje. Wprowadzony w październiku 2023 roku, ustanawia poziomy ryzyka — od „low” do „critical” — w kategoriach obejmujących cyberbezpieczeństwo, perswazję, autonomię oraz zagrożenia biologiczne. Gdy model osiąga poziom krytyczny w dowolnej kategorii, uruchamiane są dodatkowe etapy przeglądu i ograniczania ryzyka przed kontynuacją wdrożenia.

Podobne schematy istnieją obecnie także w innych czołowych laboratoriach: Responsible Scaling Policy Anthropic i Frontier Safety Framework Google DeepMind definiują progi możliwości, które uruchamiają surowsze zabezpieczenia, czyniąc stopniową ocenę ryzyka wyłaniającą się normą branżową. Doniesienie o osiągnięciu przez Astra poziomu krytycznego należy do najjaśniejszych publicznych przykładów zastosowania takiego progu w dużym laboratorium.

Znaczenie tego frameworku wiąże się również z burzliwym okresem w nadzorze bezpieczeństwa OpenAI. W 2024 roku firma rozwiązała swój długoterminowy zespół Superalignment po odejściu współkierujących Ilyi Sutskevera i Jana Leike’a, włączając jego prace do szerszych działań bezpieczeństwa — co utrzymywało pytania o równowagę między tempem a ostrożnością w centrum uwagi publicznej.

Na co zwracać uwagę dalej

Najbliższe pytanie brzmi, kiedy Astra lub modele z niej pochodne faktycznie trafią do użytkowników. Słowa Altmana, że nowe modele są oczekiwane wkrótce, sugerują, że harmonogram nie zmienił się znacząco mimo przerwy.

Warto też śledzić, czy OpenAI opublikuje szczegółowe ustalenia ze swojej oceny bezpieczeństwa. Model, który osiąga poziom krytyczny w zakresie ryzyka cyberbezpieczeństwa, wydaje się wymagać pełnego publicznego rozliczenia tego, co wykryto i jakie środki zaradcze wprowadzono — a przy równoległym stosowaniu podobnych frameworków progowych przez Anthropic i Google DeepMind także tego, czy inne laboratoria zaczną ujawniać porównywalne oceny własnych modeli.