El propio agente de IA de Google, PageBreak, ha validado más de 500 vulnerabilidades de cross-site scripting en aplicaciones web internas desarrolladas por la empresa. Solo encontró dos en cientos de aplicaciones creadas con los marcos web de alta confiabilidad de la compañía.
PageBreak señala un fallo solo después de que un exploit en funcionamiento se ejecuta contra una copia en vivo del objetivo, dijo Google.
Depuración de endpoints: ambos fallos contados
Ambos fallos en la pila endurecida se contabilizaron al 4 de septiembre de 2026. Ambos estaban en aplicaciones internas o en endpoints de depuración que no estaban completamente endurecidos.
Google cita la brecha: más de 500 hallazgos en su conjunto más amplio de aplicaciones de primera parte, frente a solo dos en el stack endurecido, como evidencia de que los marcos seguros por diseño pueden resistir a un atacante automatizado implacable.
El 24 de septiembre, el equipo de Product Security de Google anunció PageBreak en una publicación de blog de la ingeniera de seguridad de la información Michał Bentkowski. El agente se ejecutó como piloto a partir de noviembre de 2025 y se convirtió en un proyecto completo en enero de 2026.
El cross-site scripting, o XSS, ocurre cuando un atacante inyecta un script en una página que otro usuario carga. Dependiendo de la aplicación, el script podría leer datos o tomar el control de la sesión iniciada por la víctima.
Gemini 3.1 Pro analiza, y un validador debe activar el exploit
La mayoría de los escaneos se realiza con Gemini 3.1 Pro y Gemini 3.5 Flash, pero PageBreak también puede usar otros modelos. El segundo paso es lo que lo diferencia de un escáner LLM normal.
Cada posible fallo sospechoso es enviado por el agente a un validador diseñado específicamente. Luego, el validador activa la carga útil real contra una instancia en ejecución de la aplicación.
En cuanto a XSS, el validador inyecta una carga útil de JavaScript, carga la página y comprueba si el script se ejecuta.
Google está presentando PageBreak como una cura para el “desorden de la IA” que ahoga a los equipos de seguridad. La publicación de Bentkowski habla de los LLM como analizadores estáticos de código que abruman a los equipos con hipótesis no verificadas, donde lo difícil fue separar un fallo real y explotable de una alucinación plausible.
Además de XSS, los validadores prueban la inyección de consultas en bases de datos, fugas por traversal de rutas y ejecución de código.
Google ejecuta la misma semilla en varias iteraciones, así que un agente que se desvíe por un callejón sin salida aún obtiene oportunidades repetidas con el exploit correcto.
Google dice que los candidatos no verificados nunca llegan a los equipos de producto como fallos confirmados. Y siguen alimentando los escaneos posteriores o apuntan a ingenieros que construyen el siguiente validador, todavía dentro del flujo de trabajo de seguridad.
Google dice que la tasa de falsos positivos de PageBreak está cerca de cero.
El alcance del agente se amplifica con la propia escala de Google, que un investigador externo no puede replicar. Un repositorio de código le permite trazar rutas de ejecución entre servicios, y los datos de seguridad del tráfico en vivo mapean una solicitud de página de vuelta al código fuente.
Los escáneres existentes le pasan a PageBreak el acceso de inicio de sesión a sitios internos a los que, de otro modo, sería difícil llegar.
Google planea integrar PageBreak de forma más estrecha con CodeMender, un agente que escribe correcciones, para que los equipos puedan revisar un parche propuesto junto a un fallo confirmado.
Google citó CodeMender en mayo, cuando su Grupo de Threat Intelligence dijo que había detectado lo que creía que era el primer exploit de día cero creado con ayuda de IA.
El barrido de agosto del equipo Red Team de Bitcoin de 501 proyectos de código abierto generó 7.958 hallazgos en 108 horas, pero solo el 24,7% tenía pruebas reproducibles en ese momento.
Los agentes autónomos ya atraviesan límites que no se suponía que cruzaran, según informó Cryptopolitan cuando Gemini llegó a tres empresas reales durante las pruebas de mayo.
No solo leas noticias sobre cripto. Entiéndelas. Suscríbete a nuestro boletín. Es gratis.
