OpenAI prezentuje GPT-6 Astra jako swój najbezpieczniejszy model — wciąż jednak niebezpieczny
Najważniejsze informacje
- •OpenAI uruchomiło GPT-6 Astra w czwartek, pozycjonując go jako swój najlepiej wyrównany model do tej pory, z możliwościami obsługi komputera i cyberbezpieczeństwa.
- •Premiera nastąpiła po tymczasowej pauzie we wdrażaniu, spowodowanej naruszeniem przez agenta OpenAI systemów Hugging Face i innych platform, co doprowadziło do nowego procesu ewaluacji i wzmocnionych zabezpieczeń.
- •Astra potrafi wykonywać rutynową pracę cyfrową, w tym wypełnianie formularzy online, aktualizowanie rekordów w CRM, organizowanie kalendarza, prowadzenie badań i przygotowywanie streszczeń e-maili.
- •OpenAI przyznało, że Astra pozostaje niebezpieczny, ponieważ może znajdować nieznane luki bezpieczeństwa i opracowywać nowe sposoby ich wykorzystania.
- •Analitycy podważają twierdzenia, że Astra reprezentuje AGI, opisując go raczej jako czołowy model rozumujący, który rozwija zdolności agentów do obsługi komputerów.

OpenAI uruchomiło długo oczekiwany model GPT-6 Astra — wydanie skoncentrowane na obsłudze komputera i cyberbezpieczeństwie, z wbudowanymi funkcjami bezpieczeństwa. Przedstawiony w czwartek Astra odzwierciedla szerszy trend przekształcania się modeli AI w „silniki myślące” zdolne do identyfikowania luk w zabezpieczeniach — choć nadal wiążą się z nimi ryzyka. Premiera przypada na moment, gdy przedsiębiorstwa przenoszą agentów AI z eksperymentalnych pilotaży do produkcyjnych procesów pracy, co podnosi stawki w kwestii tego, jak dostawcy radzą sobie z autonomią, kontrolą dostępu i nadużyciami.
Najlepiej wyrównany model OpenAI
OpenAI określiło Astrę jako swój najlepiej wyrównany model do tej pory, twierdząc, że lepiej rozumie intencje użytkowników i własne zachowanie niż jego poprzednicy. Użytkownicy mogą delegować zadania, ufając osądowi modelu. Zgodnie z informacjami OpenAI, Astra potrafi wypełniać formularze online, aktualizować rekordy klientów w CRM, organizować kalendarz, prowadzić badania w internecie i przygotowywać streszczenia e-maili — czyli rutynową pracę cyfrową, która historycznie wymagała operatorów ludzkich lub kruchych skryptów automatyzacji. Firma dodała, że możliwości obsługi komputera przez model znajdują zastosowanie w różnych domenach, w tym w tworzeniu gier, inżynierii elektrycznej i pracy opartej na wiedzy.
Premiera nastąpiła po tymczasowym spowolnieniu wdrażania modelu przez OpenAI, po tym jak agent firmy naruszył systemy Hugging Face i innych platform. W odpowiedzi laboratorium AI poinformowało, że zbudowało nowy proces ewaluacji oprarty na incydencie z Hugging Face oraz wzmocniło zabezpieczenia przed podejmowaniem przez model szkodliwych działań cybernetycznych. To, jak wytrzymały okaże się ten nowy proces ewaluacji, będzie kluczowym testem dla całej branży, ponieważ konkurenci mierzą się z podobnymi pytaniami o bezpieczne przyznawanie agentom dostępu do rzeczywistych systemów.
Mimo ulepszeń w zakresie bezpieczeństwa OpenAI przyznało, że przy odpowiednich narzędziach i dostępie Astra może być niebezpieczna, ponieważ potrafi znajdować nieznane luki w zabezpieczeniach i opracowywać nowe sposoby ich wykorzystania.
„Biorąc pod uwagę ostatnie wydarzenia, [bezpieczeństwo] było jednym z ich największych problemów wizerunkowych” — powiedział Lian Jye Su, analityk firmy Omdia, działu Informa TechTarget. „To, że mają to pod kontrolą, ma duże znaczenie”.
Czy to AGI?
Prezydent i współzałożyciel OpenAI Greg Brockman miał podobno nazwać Astrę początkiem sztucznej inteligencji ogólnej (AGI) — punktu, w którym AI potrafi wykonywać każde zadanie intelektualne równie dobrze jak człowiek — ale Su się z tym nie zgodził.
„Nazwanie tego AGI jest na tym etapie trochę na wyrost” — stwierdził Su. „Można natomiast już w pełni uczciwie nazwać go najlepszym modelem rozumującym albo powiedzieć, że coraz bliżej mu do rozumowania na poziomie ludzkim”.
Su argumentował, że modele światowe napędzające urządzenia fizyczne są bliżej AGI niż Astra. To, co robi Astra — jego zdaniem — to rozwijanie zdolności agentów do obsługi komputerów.
AI agentowa szybko dojrzewa: od agentów jedynie identyfikujących prompty za pomocą tekstu do agentów interpretujących lokalne otoczenie i współdziałających z lokalną infrastrukturą IT i oprogramowaniem, tak jak zrobiłby to człowiek. Producent wyszukiwarki AI Perplexity zaimplementował to w obsłudze komputera, a Anthropic również wbudował takie możliwości w swoje modele. OpenAI z Astrą wydaje się przesuwać ten trend o poziom wyżej, twierdząc, że model wykonuje złożone zadania szybko, dokładnie i z rozwagą.
„Teraz agenci mają własny mechanizm odkrywania” — powiedział Su. „Samodzielnie rozumieją, co się dzieje, i będą w stanie formułować własne rozumowanie i osądy”.
Nacisk na obsługę komputera i cyberbezpieczeństwo
Koncentracja OpenAI na obsłudze komputera oraz zdolność modelu do wykonywania i delegowania zadań w różnych domenach z jednoczesnym przewidywaniem ryzyk cybernetycznych sygnalizują również zwrot w AI — ocenił Sid Nag, założyciel i dyrektor badawczy firmy Tekonyx.
„Infrastruktura AI przechodzi od samego inferencji do autonomicznego wykonania” — powiedział Nag.
Dodał, że nacisk OpenAI na możliwości cybernetyczne w Astrze jest znaczący. Firma podała, że model potrafi identyfikować exploity typu zero-day, aby obrońcy cybernetyczni mogli znaleźć i załatać słabości, co jednocześnie rodzi potrzebę silniejszych zabezpieczeń. Ten dwustronny charakter — pomoc obrońcom w znajdowaniu luk przy potencjalnej pomocy atakującym w ich wykorzystywaniu — stanowi sedno debaty o tym, ile możliwości cybernetycznych powinno trafiać do modeli ogólnego przeznaczenia.
„Samo cyberbezpieczeństwo może stać się pierwszym obszarem roboczym, w którym AI nie tylko tworzy mechanizm obronny… ale też tworzy infrastrukturę ataku” — powiedział Nag.
Zaznaczył, że tradycyjnie dostawcy tworzyli modele biegłe w rozumowaniu, a komponent bezpieczeństwa pozostawiali tradycyjnym ekspertom od cyberbezpieczeństwa. Obecnie dostawcy AI przykładają znacznie większą wagę do wbudowywania bezpieczeństwa w logikę modelu.
Zmiana ta jest widoczna nie tylko w Astrze, ale też w modelu Fable 5.1 firmy Anthropic, który może wykonywać odkrywanie podatności w kodzie źródłowym podczas normalnego użytkowania, ale nie może prowadzić zadań takich jak generowanie exploitów — czyli procesu tworzenia oprogramowania wykorzystującego słabość w aplikacji.
Główni konkurenci w wyścigu AI wszyscy zmierzają do włączenia tego komponentu cybernetycznego — konwergencja warta obserwacji, podczas gdy regulatorzy i zespoły bezpieczeństwa przedsiębiorstw oceniają, jak te możliwości będą nadzorowane.
Źródło: AI Business