El cazador de bugs con IA de Google, PageBreak, registra más de 500 fallos de XSS, solo dos en apps con diseño seguro
Puntos clave
- •El agente de seguridad autónomo de Google, PageBreak, ha validado más de 500 vulnerabilidades de cross-site scripting en las web propias de la compañía.
- •Solo dos fallos confirmados surgieron de cientos de aplicaciones construidas sobre los frameworks de diseño seguro de Google, y ambos se encontraban en apps internas o endpoints de depuración que no habían sido completamente reforzados.
- •PageBreak reporta un bug solo después de que un exploit funcional tiene éxito contra una instancia en vivo de la aplicación, y Google afirma que su tasa de falsos positivos es cercana a cero.
- •La mayoría de los escaneos de PageBreak se ejecutan en Gemini 3.1 Pro y Gemini 3.5 Flash, y sus validadores también prueban inyección en consultas de bases de datos, fugas por path traversal y ejecución de código.
- •Google tiene la intención de integrar PageBreak con CodeMender, un agente que escribe correcciones, para que los equipos puedan revisar los parches propuestos junto a los bugs confirmados.

El agente de seguridad autónomo de Google, PageBreak, ha validado más de 500 vulnerabilidades de cross-site scripting (XSS) en las aplicaciones web propias de la compañía, según detalles publicados por el equipo de Seguridad de Producto de Google. En contraste, el agente encontró solo dos fallos entre cientos de aplicaciones construidas sobre los frameworks web de alta garantía y diseño seguro de Google.
PageBreak señala un bug solo después de que un exploit funcional se ejecuta con éxito contra una copia en vivo del objetivo, según Google. Ambos bugs encontrados en el stack reforzado se contabilizaron al 4 de septiembre de 2026, y ambos se encontraban en apps internas o endpoints de depuración que no habían sido completamente reforzados. Google señala la brecha —más de 500 hallazgos en su conjunto más amplio de apps propias frente a dos en el stack reforzado— como evidencia de que los frameworks de diseño seguro pueden resistir a un atacante automatizado implacable.
El equipo de Seguridad de Producto anunció PageBreak el 24 de septiembre en una entrada de blog del ingeniero de seguridad de la información Michał Bentkowski. El agente operó como piloto a partir de noviembre de 2025 y se convirtió en un proyecto completo en enero de 2026.
Cómo funciona el agente
El cross-site scripting es un ataque en el que un adversario inyecta un script en una página que otro usuario carga. Dependiendo de la aplicación, el script inyectado puede leer datos o hacerse con la sesión iniciada de una víctima. Es también una de las categorías de fallos web más antiguas y persistentes, y el tamaño del botín ilustra cuánta superficie de ataque puede acumularse en aplicaciones que no fueron construidas desde el inicio sobre frameworks reforzados.
La mayoría de los escaneos de PageBreak se ejecutan en Gemini 3.1 Pro y Gemini 3.5 Flash, aunque el agente puede recurr a otros modelos. Lo que lo separa de un escáner convencional basado en LLM es su segunda etapa: cada fallo sospechoso se pasa a un validador construido a medida, que dispara el payload real contra una instancia en ejecución de la aplicación. Para XSS, el validador inyecta un payload de JavaScript, carga la página y confirma si el script se ejecuta.
Google presenta PageBreak como un remedio para el «slop de IA» que ahoga a los equipos de seguridad. La entrada de Bentkowski describe LLMs desplegados como analizadores estáticos de código que abruman a los ingenieros con hipótesis sin verificar, dejando la difícil tarea de separar un bug real y explotable de una alucinación plausible.
Más allá de XSS, los validadores también prueban la inyección en consultas de bases de datos, fugas por path traversal y ejecución de código. Google ejecuta la misma semilla en múltiples iteraciones, de modo que un agente que se desvíe por un callejón sin salida sigue teniendo oportunidades repetidas de dar con el exploit correcto. Los candidatos sin verificar nunca llegan a los equipos de producto como bugs confirmados, dijo Google; en cambio, alimentan escaneos posteriores o orientan a los ingenieros que construyen el siguiente validador, todo dentro del flujo de trabajo de seguridad. La compañía afirma que la tasa de falsos positivos de PageBreak es cercana a cero.
Ventajas de escala y planes de integración
El alcance del agente se ve amplificado por la propia escala de Google, algo que un investigador externo no puede replicar. Un único repositorio de código le permite rastrear rutas de ejecución a través de los servicios, y los datos de seguridad de tráfico en vivo mapean una solicitud de página de vuelta al código fuente que la produjo. Los escáneres existentes también le dan a PageBreak acceso con sesión iniciada a sitios internos que de otro modo serían difíciles de alcanzar.
Google planea integrar PageBreak de manera más estrecha con CodeMender, un agente que escribe correcciones, para que los equipos puedan revisar un parche propuesto junto a un bug confirmado —una combinación que cerraría el ciclo desde la detección hasta la remediación. Google mencionó CodeMender en mayo cuando su Grupo de Inteligencia de Amenazas dijo haber identificado lo que consideraba el primer exploit de día cero creado con asistencia de IA.
El informe sitúa a PageBreak dentro de una ola más amplia de pruebas de seguridad impulsadas por IA. El barrido de agosto de Bitcoin Red Team sobre 501 proyectos de código abierto generó 7,958 hallazgos en 108 horas, aunque solo el 24.7% de ellos contaba con pruebas reproducibles en ese momento —una brecha de verificación que es precisamente el problema que la etapa de validación de PageBreak está diseñada para cerrar. Los agentes autónomos también han cruzado límites que no debían cruzar: Cryptopolitan informó en mayo que Gemini llegó a tres empresas reales durante pruebas.
Fuente: Cryptopolitan