OpenAI раздаёт кибермодель по пропускам: GPT-5.6-Cyber уже нашёл уязвимость в Chrome
Daybreak - программа OpenAI для тех, кто занимается защитой систем, запущенная в мае. Внутри неё компания снимает часть системных ограничений со своих моделей и даёт доступ к инструментам поиска уязвимостей. Августовское обновление добавило к программе два уровня допуска и отдельную модель, обученную под задачи, от которых обычный ChatGPT отказывается.
Две дыры в движке Chrome
Сразу после обучения GPT-5.6-Cyber в OpenAI направили на V8 - движок JavaScript, на котором работает Chrome (Хром). Модель нашла две ранее неизвестные уязвимости, которые связываются в цепочку и дают испортить память и выйти за пределы защищённой области движка. Исследователи компании подтвердили находку и передали её Google, ошибка получила номер CVE-2026-15903 и высокий уровень опасности.
Устроена первая ошибка так. Компилятор пропускал проверку при переводе значения в целое число, и из пустого значения получалось неожиданно большое. Уходя дальше как индекс массива, оно снимало проверку границ и открывало чтение и запись чужой памяти.
Chrome оказался не единственной мишенью. Той же моделью в OpenAI нашли не меньше пяти уязвимостей в популярной мобильной операционной системе, три критические ошибки в распространённой базе данных и больше четырёхсот проблем с повышением прав в ядре одной из ОС. Названий компания не приводит, раскрытие ещё идёт - и это тот случай, когда цифра без имени продукта внешней проверке не поддаётся.
Blue для обороны, Red для наступления
Daybreak теперь делится на два уровня допуска. Blue открывает модели общего назначения, включая GPT-5.6 Sol, без системного фильтра, который в обычном режиме отсеивает запросы по безопасности. OpenAI рекомендует начинать с него, этого хватает для разбора инцидентов, анализа вредоносного кода, ревизии исходников и проверки патчей. Red открывает модели, обученные специально под кибербезопасность, и предназначен для исследования уязвимостей, проверки эксплойтов и авторизованного тестирования на проникновение.
Доступ дают по заявке и людям, и организациям - с проверкой личности, мониторингом и юридическими обязательствами о характере работ. Ранний доступ к GPT-5.6-Cyber получили SpecterOps, SentinelOne и Palo Alto Networks, по данным TechCrunch, в списке также Accenture, IBM, CrowdStrike и Cloudflare.
«GPT-5.6-Cyber заметно улучшает наши узкоспециальные процессы поиска уязвимостей. Он точнее рассуждает о реальных ограничениях эксплойта, лучше удерживает сложное состояние и меньше чем за день закрыл работу, которую прежние модели не осилили за недели периодических попыток»,
- отметил Джаред Аткинсон, тех. директор SpecterOps.
Red отвечает на 95% запросов
Разницу между уровнями OpenAI измерила собственным тестом Advanced Cybersecurity Completion Rate. Он считает, как часто модель вообще берётся за запросы про цепочки эксплойтов, обход аутентификации и повышение прав. Результаты на одном наборе запросов:
- GPT-5.6-Cyber через Red - 95,0%
- GPT-5.5-Cyber, прошлая киберверсия - 57,3%
- GPT-5.6 Sol через Blue - 2,0%
- GPT-5.6 Sol с обычными ограничителями - 1,5%
Уровни различаются готовностью отвечать, а не силой модели. Исследователи жаловались, что прошлая киберверсия отказывала слишком часто, и OpenAI прямо называет эти жалобы поводом обучить новую.
Специализированная модель не везде сильнее
На внутреннем тесте по поиску уязвимостей и написанию отчёта GPT-5.6-Cyber уступил обычному GPT-5.6 Sol. Причину в OpenAI видят в отчётах - модель иногда пишет их короче и без деталей, а качество описания здесь оценивается наравне с самой находкой. На ExploitBench, где агент доводит уязвимость V8 до полноценного эксплойта при включённых защитах, Sol тоже оказался лучше и экономнее по токенам. Если поднять лимит шагов вдвое, разрыв сокращается.
По внутренней шкале готовности обе модели отнесены к высокому уровню киберспособностей и не дотягивают до критического. Системную карточку GPT-5.6-Cyber с подробными замерами OpenAI обещает опубликовать позже.
Аппаратные ключи с 1 сентября
Вместе с расширением Daybreak компания ужесточила правила самой программы. С 1 сентября все личные аккаунты в ней переходят на аппаратные ключи безопасности. Пользователей Codex подталкивают уйти с полного доступа на режим автоматической проверки, когда действия с повышенными правами оцениваются до выполнения, а рискованные блокируются. Остальные рекомендации привычные для отрасли - изолированная среда без выхода в интернет и к боевым системам, ограниченный набор разрешений, человек над агентом.
Осторожность объяснима. Лето 2026 года вышло тяжёлым: взлом Hugging Face, агент, забравшийся на сайт фитнес-клуба, отчёт британского института о девятнадцати выходах агентов за рамки задания. OpenAI отдельно оговаривает, что GPT-5.6-Cyber к истории с Hugging Face отношения не имеет.
Сканер кода работает без допуска
Инструментальная часть программы, Codex Security, доступна и без пропуска в Daybreak, в трёх вариантах: плагин к ChatGPT, облачное сканирование подключённых репозиториев GitHub и консольная утилита с открытым кодом для локальных проверок и конвейеров сборки. По счётчикам OpenAI через сканер прошло больше 30 млн коммитов и 30 тысяч кодовых баз, а исправлено свыше 500 тысяч находок.
Владельцу сайта или репозитория отсюда следует пара практических вещей. Проверять чужой код в зависимостях стало заметно дешевле ручного аудита, и это разумно делать до обновления, а не после инцидента. ИИ-помощнику, который правит боевой проект, лучше оставлять режим предварительной проверки действий вместо полного доступа.
Проверяемым остаётся одно CVE
Ключевые числа релиза - процент ответов, победы на тестах, четыреста уязвимостей в ядре - посчитала и опубликовала сама OpenAI, системной карточки ещё нет. Со стороны проверяется один факт, исправленная дыра в Chrome с номером CVE. Ближайшая понятная точка отсчёта - 1 сентября с переходом на аппаратные ключи и публикация системной карточки следом. До тех пор Daybreak Red держится на одном CVE и словах трёх партнёров.