AktualnościAkcjePageBreak, łowca błędów AI od Google, wykrył ponad 500 podatności XSS – tylko dwie w aplikacjach zaprojektowanych z myślą o bezpieczeństwie

PageBreak, łowca błędów AI od Google, wykrył ponad 500 podatności XSS – tylko dwie w aplikacjach zaprojektowanych z myślą o bezpieczeństwie

Autor: Cryptopolitan·

Najważniejsze informacje

  • •Autonomiczny agent bezpieczeństwa Google, PageBreak, potwierdził ponad 500 podatności cross-site scripting w aplikacjach internetowych pierwszej strony firmy.
  • •W setkach aplikacji opartych na bezpiecznych frameworkach Google potwierdzono jedynie dwie luki, a obie znajdowały się w wewnętrznych aplikacjach lub endpointach debugujących, które nie zostały w pełni utwardzone.
  • •PageBreak zgłasza błąd dopiero po tym, jak działający exploit z powodzeniem zostanie uruchomiony na żywej instancji aplikacji, a Google twierdzi, że jego wskaźnik fałszywych alarmów jest niemal zerowy.
  • •Większość skanów PageBreak działa na modelach Gemini 3.1 Pro i Gemini 3.5 Flash, a walidatory testują także wstrzykiwanie zapytań do bazy danych, wycieki path traversal oraz wykonanie kodu.
  • •Google zamierza zintegrować PageBreak z CodeMenderem, agentem piszącym poprawki, aby zespoły mogły przeglądać proponowane łatki obok potwierdzonych błędów.
PageBreak, łowca błędów AI od Google, wykrył ponad 500 podatności XSS – tylko dwie w aplikacjach zaprojektowanych z myślą o bezpieczeństwie

Autonomiczny agent bezpieczeństwa Google o nazwie PageBreak potwierdził ponad 500 podatności typu cross-site scripting (XSS) w aplikacjach internetowych pierwszej strony firmy – wynika ze szczegółów opublikowanych przez zespół Product Security Google. Dla porównania agent znalazł jedynie dwie luki w setkach aplikacji opartych na wysokogatunkowych, bezpiecznych z założenia frameworkach internetowych Google.

Jak poinformował Google, PageBreak zgłasza błąd dopiero po tym, jak działający exploit z powodzeniem zostanie uruchomiony na żywej kopii celu. Oba błędy znalezione w utwardzonym stosie zostały zaliczone na stan na 4 września 2026 roku, a oba znajdowały się w wewnętrznych aplikacjach lub endpointach debugujących, które nie zostały w pełni utwardzone. Google wskazuje na tę różnicę – ponad 500 ustaleń w szerszym zbiorze aplikacji pierwszej strony wobec dwóch w utwardzonym stosie – jako dowód, że frameworki bezpieczne z założenia mogą wytrzymać nieustępliwego zautomatyzowanego atakującego.

Zespół Product Security ogłosił PageBreak 24 września w wpisie na blogu autorstwa inżyniera ds. bezpieczeństwa informacji Michała Bentkowskiego. Agent działał jako projekt pilotażowy od listopada 2025 roku, a w styczniu 2026 roku stał się pełnoprawnym projektem.

Jak działa agent

Cross-site scripting to atak, w którym przeciwnik wstrzykuje skrypt do strony ładowanej przez innego użytkownika. W zależności od aplikacji wstrzyknięty skrypt może odczytywać dane lub przejąć zalogowaną sesję ofiary. To również jedna z najstarszych i najtrwalszych kategorii podatności internetowych, a rozmiar zbioru ilustruje, jaką powierzchnię ataku mogą gromadzić aplikacje, które od początku nie powstały na utwardzonych frameworkach.

Większość skanów PageBreak działa na modelach Gemini 3.1 Pro i Gemini 3.5 Flash, choć agent może korzystać z innych modeli. To, co odróżnia go od konwencjonalnego skanera opart na LLM, to drugi etap: każda podejrzana luka trafia do specjalnie zaprojektowanego walidatora, który odpala rzeczywisty payload na działającej instancji aplikacji. W przypadku XSS walidator wstrzykuje payload w języku JavaScript, ładuje stronę i sprawdza, czy skrypt się wykonuje.

Google pozycjonuje PageBreak jako lekarstwo na „AI slop” toniący zespoły bezpieczeństwa. Wpis Bentkowskiego opisuje LLM-y używane jako statyczne analizatory kodu, które zalewają inżynierów niezweryfikowanymi hipotezami, zostawiając im trudne zadanie odróżnienia prawdziwej, możliwej do wykorzystania luki od wiarygodnej halucynacji.

Poza XSS walidatory testują również wstrzykiwanie zapytań do bazy danych, wycieki typu path traversal oraz wykonanie kodu. Google uruchamia to samo ziarno w wielu iteracjach, więc agent, który zbłądzi w ślepą uliczkę, nadal otrzymuje powtarzające się szanse na trafienie w właściwy exploit. NIEzweryfikowani kandydaci nigdy nie docierają do zespołów produktowych jako potwierdzone błędy – poinformował Google; zamiast tego zasilają kolejne skany lub informują inżynierów budujących kolejny walidator, a wszystko to pozostaje w ramach procesu bezpieczeństwa. Firma twierdzi, że wskaźnik fałszywych alarmów PageBreak jest niemal zerowy.

Przewaga skali i plany integracji

Zasięg agenta jest zwielokrotniony przez samą skalę Google, której zewnętrzny badacz nie jest w stanie odtworzyć. Pojedyncze repozytorium kodu pozwala mu śledzić ścieżki wykonania między usługami, a dane bezpieczeństwa z ruchu na żywo mapują żądanie strony z powrotem na kod źródłowy, który je wygenerował. Istniejące skanery dają PageBreak również zalogowany dostęp do wewnętrznych witryn, do których w innym wypadku trudno byłoby dotrzeć.

Google planuje ściślej zintegrować PageBreak z CodeMender, agentem piszącym poprawki, aby zespoły mogły przeglądać proponowaną łatkę obok potwierdzonego błędu – to połączenie domknęłoby pętlę od wykrycia do usunięcia problemu. Google wspominał o CodeMenderze w maju, kiedy jego Grupa Analiz Zagrożeń poinformowała, że zidentyfikowała – według niej – pierwszy exploit dnia zero stworzony z pomocą AI.

Raport umieszcza PageBreak w szerszej fali testów bezpieczeństwa napędzanych AI. Przeciąg Bitcoin Red Team w sierpniu, obejmujący 501 projektów open source, wygenerował 7 958 ustaleń w ciągu 108 godzin, choć tylko 24,7% z nich miało wówczas odtwarzalne dowody – to luka weryfikacyjna, którą etap walidatora PageBreak ma właśnie domknąć. Autonomiczne agenty przekroczyły też granice, których przekraczać nieny: Cryptopolitan informował, że w maju Gemini podczas testów dotarł do trzech prawdziwych firm.

Źródło: Cryptopolitan