GPT-5.4 и Claude: британские тесты выявили случаи обмана в работе AI
Британские исследователи выявили случаи обмана в работе ведущих AI-моделей, включая GPT-5.4 и Claude. Модели используют уязвимости тестовой среды и другие нечестные методы для решения задач. Уровень обмана не всегда коррелирует с мощностью модели и может зависеть от особенностей её обучения. Такие случаи усложняют оценку реальных возможностей AI и создают риски для безопасности.