7 августа (по местному времени) OpenAI объявила, что не может исключить возможность достижения моделью Astra уровня «Critical» (критический) по критериям безопасности Preparedness Framework — то есть способности выполнять серьёзные кибердействия без участия человека. В ходе недавних внутренних оценок выяснилось, что способности Astra в области кодирования и кибербезопасности значительно выросли; это подтвердили и внешние эксперты.
Astra — будущий основной модельный продукт компании. Ранее её внутреннюю версию использовали, чтобы попытаться решить 10 нерешённых задач в математике и теоретической информатике.
Preparedness Framework определяет уровень «Critical» как способность находить и разрабатывать эксплойты для уязвимостей нулевого дня в важных системах либо выстраивать и реализовывать новые стратегии атак на защищённые цели. Уровень «High» (высокий) — на ступень ниже.
В ответ на выявленные риски OpenAI ввела более строгие меры безопасности для высокопроизводительных моделей, временно приостановив связанные с Astra внутренние активности, которые ещё не соответствуют требованиям. Компания внедрила механизмы мониторинга и оценки процесса мышления модели, чтобы пресекать рискованные действия. В дальнейшем OpenAI планирует сотрудничать с правительственными органами и организациями по безопасности ИИ, чтобы проверить возможности модели и предложить партнёрам рекомендации по управлению безопасностью.
OpenAI подчеркнула, что Astra ещё не представлена на рынке и в текущих проектах не задействована. Сроки и формат выпуска модели пока не обозначены.
Версия 2 Preparedness Framework была обновлена в апреле 2025 года. Согласно её положениям, разработку следует приостановить до тех пор, пока не будут определены стандарты защиты и управления безопасностью для уровня «Critical». При этом акцент делается не на снижении возможностей модели, а на усилении контроля и мониторинга.
Ранее OpenAI уже ограничивала распространение модели из серии GPT-5.6: по просьбе правительства США доступ к ней сначала получили лишь несколько доверенных партнёров. Кроме того, в августе 2026 года федеральные органы просили установить механизм, который бы давал правительству возможность предварительно получить доступ к моделям с высокими киберспособностями — не более чем на 30 дней до широкого релиза.
В июле более 30 компаний, включая NVIDIA и Microsoft, создали альянс, рассматривающий открытые модели как инструмент киберзащиты. OpenAI в число основателей альянса не вошла, но развивает решения для защиты от угроз и считает, что модели с высокими киберспособностями должны помогать обнаруживать и устранять уязвимости раньше, чем это сделают злоумышленники.
81
GPT-5.6 Sol
7Hugging Face
202312
6
Open Secure AI Alliance
Daybreak