DeepDigest
TechOrange · · ~2 мин

GLM-5.2 от Z.ai: возможности китайского AI близки к западным, но есть риски

Китайская открытая AI-модель GLM-5.2 по возможностям приближается к западным лидерам, но её защита слабее, чем у коммерческих аналогов. Открытые модели уязвимы для модификаций пользователями, а коммерческие — для обхода защитных механизмов. Эксперты подчёркивают необходимость баланса между безопасностью и функциональностью AI.

GLM-5.2 от Z.ai: возможности китайского AI близки к западным, но есть риски

Китайский AI-модель GLM-5.2 от компании Z.ai приближается по возможностям к ведущим западным моделям вроде GPT-5.5 и Claude Opus 4.7, однако её безопасность вызывает вопросы. По данным некоммерческой организации SaferAI, GLM-5.2 не отказывается отвечать на вопросы о сетевых атаках и биологических угрозах — в отличие от строгих по части защиты коммерческих моделей. Эксперты подчёркивают: возможности модели не равны уровню её безопасности. Пользователи могут модифицировать открытые модели, удалять защитные механизмы и настраивать их под свои цели — в таком случае любые ограничения, заложенные через API, теряют смысл.

Коммерческие модели тоже не застрахованы от атак: например, xAI Grok 4.5 и Google Gemini 3.1 Pro уязвимы к сотням типов обхода защиты (так называемые «»/«пересечение тюрьмы»). Злоумышленники используют комбинацию приёмов — от ролевых игр до подделки истории диалогов — и успешно обходят защитные механизмы.

Для повышения безопасности моделей применяют фильтрацию обучающих данных: из наборов убирают информацию об атаках. Но в сфере сетевой безопасности такой подход ставит разработчиков перед дилеммой: с одной стороны, нужно ограничить злоупотребление моделью, с другой — сохранить её функциональность. Особенно сложно создать универсальный AI, который будет полезен в программировании, но не будет обладать навыками, полезными для хакеров.

Эксперты отмечают, что китайские регуляторы акцентируют внимание на политически чувствительных темах, фейковых новостях и социальной стабильности, а не на рисках, связанных с сетевыми атаками или биологическими угрозами. При этом теоретически китайские разработчики могут настроить модели так, чтобы они отказывались обсуждать опасные темы — аналогично тому, как сейчас блокируются политические вопросы.

В то же время открытые модели остаются важными для индустрии: например, Hugging Face использовал GLM-5.2 для отражения атак, инициированных моделями OpenAI. Генри Пападатос из SaferAI считает, что потенциально опасные AI-способности не должны быть доступны всем и каждому — индустрия должна сосредоточиться на распространении только полезных функций. При этом злоумышленники зачастую адаптируются и внедряют новые методы быстрее, чем легальные компании успевают выстроить защиту.

// оригинал
TechOrange ↗ Читать оригинал
9 просмотров
// поделиться Telegram VK