OpenAI представила модель GPT‑5.6‑Cyber в рамках расширения плана сетевой безопасности Daybreak. Модель разделена на две команды: Daybreak Blue (синяя команда, оборона) и Daybreak Red (красная команда, исследования безопасности и моделирование атак).
OpenAI сосредоточилась в первую очередь на тренировке и оценке GPT‑5.6‑Cyber — модели красной команды. Она моделирует действия хакеров: ищет уязвимости и помогает командам безопасности заранее выявлять слабые места в системах. Синяя команда, в свою очередь, устраняет найденные уязвимости и повышает способность системы противостоять атакам.
В оценке Zero‑Day Discovery Eval GPT‑5.6‑Cyber удалось самостоятельно обнаружить новые нулевые уязвимости и подготовить отчёты о потенциальном ущербе, имея в распоряжении только исходный код репозитория. Качество обнаружения уязвимостей у GPT‑5.6‑Cyber оказалось выше, чем у GPT‑5.6 Sol, которая используется в Daybreak Blue.
С помощью GPT‑5.6‑Cyber были обнаружены:
* 2 ранее неизвестных уязвимости в V8 JavaScript‑движке Chrome;
* не менее 5 уязвимостей в популярной мобильной ОС (в том числе цепочка уязвимостей от недоверенного приложения до повышения локальных прав);
* 3 уязвимости уровня Critical в популярной базе данных;
* более 400 уязвимостей, способных привести к повышению прав, в ядре популярной ОС.
Уровень выполнения высокорисковых задач безопасности у красной команды достиг 95 %. GPT‑5.6‑Cyber не только находит уязвимости, но и оценивает возможность их использования. Например, в случае с V8 модель нашла два уязвимых места и определила, что их можно связать для продвижения атаки и выхода из sandbox V8 heap.
OpenAI снизила склонность GPT‑5.6‑Cyber к отказу при выполнении высокорисковых задач по безопасности — модель реже отказывается от выполнения таких запросов, как обход аутентификации, создание исполняемого эксплойта, повышение привилегий. В сравнении с другими моделями GPT‑5.6‑Cyber демонстрирует высокие результаты в выполнении высокоуровневых задач по сетевой безопасности:
* GPT‑5.6‑Cyber — 95 %;
* обычный GPT‑5.6 Sol — 1,5 %;
* GPT‑5.6 Sol в Daybreak Blue — 2,0 %;
* GPT‑5.5‑Cyber — 57,3 %.
Есть и нюансы: в тесте «обнаружение уязвимостей и составление отчётов» GPT‑5.6‑Cyber показал худший результат, чем GPT‑5.6 Sol, из‑за более кратких и менее детализированных отчётов. В ExploitBench при ограничении в 300 раундов лучше показал себя GPT‑5.6 Sol (выше эффективность токенов), но при увеличении лимита до 600 раундов разница между моделями сократилась. Пример эффективности GPT‑5.6‑Cyber — решение задачи по обходу авторизации macOS Keychain и расшифровке Chrome Cookies: в то время как GPT‑5.6 Sol (обычный и в Daybreak Blue) и GPT‑5.5‑Cyber отказались, GPT‑5.6‑Cyber предоставил техническое решение.
OpenAI не открывает GPT‑5.6‑Cyber для всех пользователей. Доступ к моделям ограничен: Daybreak Blue и Daybreak Red доступны только одобренным лицам и организациям, занимающимся безопасностью. Большинство специалистов по защите должны использовать Daybreak Blue, а доступ к Daybreak Red (и к моделям вроде GPT‑5.6‑Cyber) получают только команды, занимающиеся продвинутыми исследованиями уязвимостей, разработкой эксплойтов или тестированием «красной команды».
Кроме того, OpenAI применяет и другие меры безопасности:
* изоляция среды выполнения модели — рабочие процессы исследований безопасности рекомендуется развёртывать в «песочнице» или других изолированных средах, чтобы избежать контакта модели с чувствительными производственными системами и открытым интернетом;
* дополнительный контроль операций — при запросе действий, требующих повышения привилегий, система повторно оценивает риски и блокирует действия с высоким потенциалом ущерба.
Защитные меры Daybreak основаны на традиционных подходах в кибербезопасности: контроле доступа, изоляции в «песочнице» и мониторинге поведения. При этом OpenAI признаёт, что снижение ограничений безопасности в моделях повышает риски злоупотребления и потери контроля. Противники такого подхода указывают, что способности к имитации атак, необходимые защитникам, могут быть использованы для автоматизации настоящих атак. Вопрос о том, приведёт ли выбранный OpenAI подход к более быстрому развитию защиты по сравнению с атаками, остаётся открытым.
Подробнее о расширении Daybreak можно узнать на openai.com. Также доступны материалы конференций по ИИ: выступления экспертов, полные тексты докладов, разборы популярных статей, интервью с новыми исследователями.