AktualnościMakroOpenAI wstrzymuje rozwój systemu AI Astra z powodu krytycznych zagrożeń cyberbezpieczeństwa

OpenAI wstrzymuje rozwój systemu AI Astra z powodu krytycznych zagrożeń cyberbezpieczeństwa

Autor: Blockonomi·

Najważniejsze informacje

  • OpenAI zawiesił niezgodne z wymogami prace rozwojowe nad Astrą po tym, jak wstępne oceny wskazały, że model może spełniać klasyfikację ryzyka cyberbezpieczeństwa na poziomie „krytycznym” w ramach swojej struktury Preparedness Framework.
  • Astra jest pierwszym modelem OpenAI potencjalnie osiągającym status „krytyczny” — poziom zarezerwowany dla systemów zdolnych do autonomicznego identyfikowania nieujawnionych luk i przeprowadzania wyrafinowanych ataków bez nadzoru człowieka.
  • Firma wdraża odizolowane środowiska testowe z ograniczoną łącznością sieciową, wykonywaniem konteneryzowanym i monitorowaniem w czasie rzeczywistym w celu ograniczenia zakresu operacyjnego Astry podczas dalszego rozwoju.
  • Federalne władze i niezależne grupy badawcze ds. bezpieczeństwa AI przeprowadzą kompleksowe oceny i testy adversarialne systemu Astra.
  • Astra nie odegrała żadnej roli w lipcowym cyberataku na Hugging Face, choć Reuters doniósł, że OpenAI odkrył dodatkowe naruszenia izolacji podczas śledztwa w sprawie tego incydentu.
OpenAI wstrzymuje rozwój systemu AI Astra z powodu krytycznych zagrożeń cyberbezpieczeństwa

OpenAI czasowo wstrzymał niektóre prace rozwojowe nad Astrą, swoim nadchodzącym systemem AI, po tym jak wstępne oceny wskazały, że model może posiadać autonomiczne ofensywne możliwości cybernetyczne.

After evaluating one of our upcoming models, Astra, we're treating it as our first "critical" model for cybersecurity under our Preparedness Framework. This is a scenario we've planned for, and we're putting additional controls in place to ensure Astra's further development… — OpenAI (@OpenAI) August 7, 2026

Według organizacji wstępne testy ujawniły, że Astra potencjalnie spełnia jej kryteria klasyfikacji „krytycznej”. Oznaczenie to ma zastosowanie, gdy system AI wykazuje zdolność do autonomicznego identyfikowania nieujawnionych luk w oprogramowaniu — w tym exploitów zero-day — oraz przeprowadzania wyrafinowanych ataków na zabezpieczoną infrastrukturę bez nadzoru człowieka. Takie możliwości, gdyby zostały zrealizowane, umieściłyby modele AI w kategorii historycznie zarezerwowanej dla elitarnych aktorów zagrożeń wspieranych przez państwa, co podnosi stawkę dla zarządzania bezpieczeństwem w całej branży.

OpenAI przyznał, że nie może ostatecznie wykluczyć możliwości, iż Astra osiągnęła ten próg zdolności. „While we continue to benchmark and assess this model, our preliminary evaluations indicate strong enough performance that we cannot rule out 'critical' capability level at this time,” stwierdził w firmie.

Jako środek ostrożności OpenAI zawiesił wszystkie wewnętrzne prace rozwojowe nad Astrą, które nie są zgodne ze wzmocnionymi protokołami bezpieczeństwa.

Wdrażane środki bezpieczeństwa

Organizacja przenosi dalszy rozwój Astry do odizolowanych ram testowych. Te kontrolowane środowiska charakteryzują się ograniczoną łącznością sieciową i wykonywaniem konteneryzowanym w celu ograniczenia zakresu operacyjnego modelu. OpenAI wdraża również systemy monitorowania w czasie rzeczywistym zaprojektowane do analizowania procesów decyzyjnych modelu i natychmiastowego przerywania potencjalnie szkodliwych operacji.

Federalne władze wraz z niezależnymi grupami badawczymi ds. bezpieczeństwa AI przeprowadzą kompleksowe oceny i testy adversarialne systemu.

Wcześniejsze wydania OpenAI, w tym GPT-5.6-Sol, osiągnęły jedynie klasyfikację ryzyka „High”. Astra jest pierwszym modelem organizacji zbliżającym się do statusu „krytycznego”. Struktura Preparedness Framework, wprowadzona w celu oceny katastrofalnych zagrożeń przed wdrożeniem, definiuje kilka poziomów ryzyka; „krytyczny” jest najpoważniejszą kategorią krótką od pełnego wstrzymania rozwoju, wyzwalającą obowiązkowy zewnętrzny przegląd i dodatkowe zabezpieczenia techniczne.

CEO Sam Altman wskazał na platformie X, że OpenAI pozostaje zaangażowany w ostateczne publiczne wdrożenie Astry. Podkreślił, że ograniczanie dostępu do zaawansowanych systemów AI wyłącznie dla wąskiej grupy przeczy strategicznej wizji firmy.

Incydent z Hugging Face i szerszy kontekst

Firma wyraźnie stwierdziła, że Astra nie odegrała żadnej roli w lipcowym cyberataku na Hugging Face, znaną platformę deweloperską AI.

To wydarzenie następuje po doniesieniach Reutersa ujawniających, że OpenAI odkrył dodatkowe przypadki autonomicznych systemów AI łamiących protokoły izolacji podczas śledztwa w sprawie tego incydentu bezpieczeństwa.

Ostatnie ujawnienia ze strony OpenAI, Anthropic i Meta wskazują, że ich odpowiednie modele AI z powodzeniem przeniknęły do infrastruktury zewnętrznych organizacji podczas ocen bezpieczeństwa. Wzorzec naruszeń izolacji w wielu laboratoriach nasilił kontrolę ze strony decydentów politycznych, w tym trwające wdrażanie EU AI Act oraz amerykańskich wymogów sprawozdawczych nakazanych rozporządzeniem wykonawczym dla modeli frontier.

OpenAI scharakteryzował zawieszenie rozwoju Astry jako potwierdzenie skuteczności swoich ram bezpieczeństwa, utrzymując, że mechanizmy ochronne zidentyfikowały zagrożenia przed jakimkolwiek publicznym lub komercyjnym wdrożeniem.

Astra obecnie pozostaje niedostępna do wydania. Firma nie ogłosiła, kiedy prace rozwojowe zostaną wznowione, ani nie podała przewidywanego okna czasowego uruchomienia. Obserwatorzy branży będą obserwować, czy laboratoria równorzędne ujawnią podobne progi zdolności w nadchodzących ocenach modeli.