AktualnościMakroOpenAI prezentuje GPT-6 Astra do autonomicznych profesjonalnych przepływów pracy i zobowiązuje się do 1 mld dolarów na cyberbezpieczeństwo liniowe

OpenAI prezentuje GPT-6 Astra do autonomicznych profesjonalnych przepływów pracy i zobowiązuje się do 1 mld dolarów na cyberbezpieczeństwo liniowe

Autor: Metaverse Post·

Najważniejsze informacje

  • GPT-6 Astra uzyskuje 99,9% na ARC-AGI-3, 72,6% na OSWorld 2.0, 96% na GPQA Diamond i maksymalny wynik na ExploitBench.
  • Model wykonuje zadania z użycia komputera około 47% szybciej niż poprzednik i ustanowił szacowany rekord efektywności obliczeniowej 169 według Epoch AI.
  • OpenAI zobowiązuje się przeznaczyć 1 miliard dolarów na subsydiowanie zasobów cyberbezpieczeństwa AI dla obrońców liniowych, takich jak zakłady wodociągowe, operatorzy sieci energetycznych, samorządy i banki społecznościowe, począwszy od Stanów Zjednoczonych.
  • Astra generowała niezgodne wyniki w 2,4% testów adversarialnych i podobno odkryła dwie wcześniej nieznane luki typu zero-day podczas ocen cyberbezpieczeństwa.
  • Dostęp przez API kosztuje 10 dolarów za milion tokenów wejściowych i 50 dolarów za milion tokenów wyjściowych, a administratorzy przedsiębiorstw muszą wyrazić zgodę przed włączeniem modelu dla swoich przestrzeni roboczych.
OpenAI prezentuje GPT-6 Astra do autonomicznych profesjonalnych przepływów pracy i zobowiązuje się do 1 mld dolarów na cyberbezpieczeństwo liniowe

Firma badawcza OpenAI zaprezentowała GPT-6 Astra, swój najnowszy model graniczny zaprojektowany do autonomicznego używania komputera, inżynierii oprogramowania, badań naukowych i złożonych profesjonalnych przepływów pracy. Premiera wpisuje się w szerszy wyścig branży ku AI agentowemu — modelom zdolnym operować oprogramowaniem, przeglądać internet i wykonywać wieloetapowe zadania przy ograniczonym nadzorze — gdzie o przewagę decyduje niezawodność w zadaniach rzeczywistych, a nie tylko jakość rozmowy. System stał się dostępny dla ograniczonej grupy organizacji w dniu premiery i w nadchodzących dniach zostanie udostępniony subskrybentom ChatGPT Plus, Pro, Business i Enterprise, a także przez API OpenAI i głównych dostawców chmury.

OpenAI pozycjonuje Astrę jako lidera w wielu kategoriach testów porównawczych. Model miał osiągać 99,9% na ARC-AGI-3 — teście abstrakcyjnego rozumowania odpornym na zapamiętywanie — wyczerpuje FrontierMath Tier 4 na poziomie 98% i uzyskuje 100% na ExploitBench. W ocenach praktycznych osiągnął 59,3% na Agents' Last Exam, 72,6% na OSWorld 2.0 — benchmarku sterowania rzeczywistymi interfejsami komputerowymi — oraz 96% na poziomie doktorskim w teście naukowym GPQA Diamond. Te zestawy agentowe i związane z używaniem komputera uchodzą za jedne z najtrudniejszych nierozwiązanych ocen dla modeli granicznych, dlatego wyniki w przedziale 50–70% traktowane są jako znaczący postęp.

OpenAI podkreśla również istotne zyski efektywności, zauważając, że Astra wykonuje zadania z użycia komputera w około 47% krótszym czasie niż poprzednik, zużywając przy tym znacznie mniej tokenów wyjściowych. W przepływach pracy opartych na terminalu, kodowaniu i zadaniach naukowych model uzyskał 57,9% na Terminal-Bench 4.0 i 64,6% na Terminal-Bench Science 0.1, a szacowane koszty API okazały się niższe niż w konkurujących konfiguracjach. Niezależni badacze z Epoch AI odnotowali także nowy, szacowany rekord efektywności obliczeniowej wynoszący 169.

Astra wprowadza przeprojektowany mechanizm zarządzania kontekstem w środowisku Codex OpenAI, który zachowuje przeszukiwalne notatki robocze podczas długich sesji, unikając utraty informacji typowo związanej z kompresją okna kontekstu — od dawna istniejącego ograniczenia agentów pracujących nad zadaniami trwającymi wiele godzin, gdzie wcześniejsze modele zwykle zapominały lub traciły szczegóły, gdy rozmowy przekraczały limity kontekstu. Model zaprojektowano także do obsługi wieloetapowych zadań profesjonalnych, w tym analizy danych, redagowania dokumentów, aktualizacji CRM i wyspecjalizowanej pracy inżynierskiej.

This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast. pic.twitter.com/gDd0IsewJw — OpenAI (@OpenAI) September 3, 2026

Cyberbezpieczeństwo, wyrównanie i zobowiązanie na rzecz obrońców wartego 1 mld dolarów

Wraz z możliwościami modelu OpenAI podkreśla właściwości bezpieczeństwa Astry, określając go jako swoją najlepiej wyrównaną dotąd wersję. Oceny wewnętrzne wskazują na znaczną poprawę w rozumieniu intencji użytkownika i poszanowaniu granic zadania. W testach adversarialnych Astra generowała niezgodne z celem wyniki z częstością 2,4%, znacznie poniżej wartości podawanych dla konkurujących modeli granicznych. System wykazał też lepszą odporność na obchodzenie automatycznych mechanizmów przeglądu oraz mniejszą skłonność do halucynowania na temat własnych możliwości.

W ocenach cyberbezpieczeństwa Astra spełnia wewnętrzny próg przygotowania „Critical” OpenAI. Osiągnęła maksymalny wynik na ExploitBench i 42,4% skuteczności na ExploitGym, a podczas oceny miała odkryć dwie wcześniej nieznane luki typu zero-day. Standardowe wdrożenia będą odrzucać prośby o tworzenie proof-of-concept luk, choć OpenAI planuje w najbliższych tygodniach rozszerzyć dostęp obronny w ramach programu Daybreak.

Równolegle z premierą OpenAI ogłosiła zobowiązanie wartości 1 miliarda dolarów na subsydiowanie zasobów cyberbezpieczeństwa AI granicznego dla obrońców liniowych. Inicjatywa Daybreak for Frontline Defenders kierowana jest do operatorów kluczowych usług — w tym zakładów wodociągowych, operatorów sieci elektroenergetycznych, samorządów lokalnych i banków społecznościowych — począwszy od Stanów Zjednoczonych, z planowaną ekspansją międzynarodową. Program odpowiada na szeroko udokumentowaną lukę w zdolnościach cyberbezpieczeństwa: mniejsze przedsiębiorstwa użyteczności publicznej i instytucje publiczne często nie dysponują budżetami i kadrą dużych korporacji, a zarządzają infrastrukturą, którą agencje bezpieczeństwa wielokrotnie wskazywały jako atrakcyjny cel dla ransomware i kampanii intruzji powiązanych z państwami.

Alongside the launch of GPT-6 Astra, we're committing $1 billion to subsidize Daybreak access and frontier capabilities to help frontline defenders protect essential services and critical infrastructure. Welcome to the AGI era for cybersecurity. — fouad (@fouadmatin) September 3, 2026

Program obejmuje pilotaż z Multi-State Information Sharing and Analysis Center — organizacją non-profit wspierającą cyberbezpieczeństwo władz stanowych i lokalnych w Stanach Zjednoczonych — oraz integruje ponad 35 produktów partnerskich poprzez Daybreak Defense Network.

Dostęp przez API wyceniono na 10 dolarów za milion tokenów wejściowych i 50 dolarów za milion tokenów wyjściowych, z opcjonalnym trybem szybkim dostępnym w podwójnej stawce standardowej. Administratorzy przedsiębiorstw muszą jawnie włączyć Astrę dla swoich przestrzeni roboczych — konstrukcja opt-in daje organizacjom kontrolę nad tym, kiedy nowe możliwości graniczne trafiają do ich użytkowników — a model obsługuje Zero Data Retention dla uprawnionych klientów API, funkcję zwykle wymaganą przez klientów z branż regulowanych przetwarzających wrażliwe dane.