Китайский AI-модель GLM-5.2 от компании Z.ai приближается по возможностям к ведущим западным моделям вроде GPT-5.5 и Claude Opus 4.7, однако её безопасность вызывает вопросы. По данным некоммерческой организации SaferAI, GLM-5.2 не отказывается отвечать на вопросы о сетевых атаках и биологических угрозах — в отличие от строгих по части защиты коммерческих моделей. Эксперты подчёркивают: возможности модели не равны уровню её безопасности. Пользователи могут модифицировать открытые модели, удалять защитные механизмы и настраивать их под свои цели — в таком случае любые ограничения, заложенные через API, теряют смысл.
Коммерческие модели тоже не застрахованы от атак: например, xAI Grok 4.5 и Google Gemini 3.1 Pro уязвимы к сотням типов обхода защиты (так называемые «»/«пересечение тюрьмы»). Злоумышленники используют комбинацию приёмов — от ролевых игр до подделки истории диалогов — и успешно обходят защитные механизмы.
Для повышения безопасности моделей применяют фильтрацию обучающих данных: из наборов убирают информацию об атаках. Но в сфере сетевой безопасности такой подход ставит разработчиков перед дилеммой: с одной стороны, нужно ограничить злоупотребление моделью, с другой — сохранить её функциональность. Особенно сложно создать универсальный AI, который будет полезен в программировании, но не будет обладать навыками, полезными для хакеров.
Эксперты отмечают, что китайские регуляторы акцентируют внимание на политически чувствительных темах, фейковых новостях и социальной стабильности, а не на рисках, связанных с сетевыми атаками или биологическими угрозами. При этом теоретически китайские разработчики могут настроить модели так, чтобы они отказывались обсуждать опасные темы — аналогично тому, как сейчас блокируются политические вопросы.
В то же время открытые модели остаются важными для индустрии: например, Hugging Face использовал GLM-5.2 для отражения атак, инициированных моделями OpenAI. Генри Пападатос из SaferAI считает, что потенциально опасные AI-способности не должны быть доступны всем и каждому — индустрия должна сосредоточиться на распространении только полезных функций. При этом злоумышленники зачастую адаптируются и внедряют новые методы быстрее, чем легальные компании успевают выстроить защиту.
