Google раскрыла результаты работы внутреннего ИИ-агента PageBreak, который тестирует веб-приложения компании. Как сообщила команда Product Security в блоге 24 сентября, агент подтвердил более 500 межсайтовых скриптовых уязвимостей в собственных приложениях Google, в том числе на чувствительных доменах. При этом в сотнях приложений, построенных на высоконадёжных веб-фреймворках компании, по состоянию на 4 сентября 2026 года было найдено лишь два дефекта. Оба находились во внутренних приложениях или отладочных конечных точках с пробелами в защите.
PageBreak начался как пилот в ноябре 2025 года и стал полноценным проектом в январе 2026 года. Его ключевая особенность — проверка подозрительных находок не на уровне статического анализа, а на работающей копии приложения. Для XSS валидатор внедряет JavaScript-нагрузку, загружает страницу и проверяет, выполнился ли скрипт. Google утверждает, что такой подход удерживает долю ложных срабатываний почти на нуле. Агент также проверяет SQL-инъекции, path traversal, исполнение кода и запросы к внутренним сервисам.
Большинство сканирований выполняется на моделях Gemini 3.1 Pro и Gemini 3.5 Flash, но PageBreak может работать и с другими моделями. Сами валидаторы написаны не ИИ. Google запускает одного и того же агента несколько раз, поскольку модель может зайти в тупик, прежде чем найдёт рабочий эксплойт. Неподтверждённые кандидаты не отправляются продуктовым командам как подтверждённые ошибки, а остаются внутри рабочего процесса безопасности и используются для последующих сканирований или создания новых валидаторов.
В Google объясняют такой дизайн проблемой «AI-шума»: LLM-сканеры часто генерируют правдоподобные, но невоспроизводимые отчёты об уязвимостях. Инженер по информационной безопасности Михал Бентковски отметил, что сложнее всего отделить реальный эксплуатируемый дефект от убедительной галлюцинации. Масштаб PageBreak усиливается доступом к внутренней инфраструктуре Google: единый репозиторий кода позволяет отслеживать пути выполнения между сервисами, данные о живом трафике связывают запрос к странице с исходным кодом, а существующие сканеры дают аутентифицированный доступ к внутренним сайтам.
Google планирует теснее интегрировать PageBreak с CodeMender — агентом, который генерирует исправления, чтобы команды могли рассматривать предлагаемый патч рядом с подтверждённой уязвимостью. В компании не раскрыли список затронутых приложений и не привели разбивку по продуктам или степени серьёзности.
Проблема проверки ИИ-отчётов знакома и криптоиндустрии. В июле исследователи безопасности Ethereum Foundation описывали схожий процесс: агенты формируют потенциальные находки, а отдельные ревьюеры пытаются их воспроизвести. Тогда был подтверждён один дефект в libp2p, позже получивший идентификатор CVE-2026-34219. В августе Bitcoin Red Team за 108 часов собрала 7 958 находок в 501 open-source проекте, но лишь 24,7% имели воспроизводимые доказательства на тот момент. В апреле со-гендиректор Cosmos Labs Барри Планкетт говорил, что число заявок в программу bug bounty выросло на 900% год к году, включая валидные и невалидные отчёты. Сам PageBreak остаётся внутренним инструментом Google и не предлагается криптопроектам.