Непредсказуемость оценок безопасности: почему LLM могут ошибаться
Исследование показало нестабильность оценок безопасности с помощью LLM-as-judge даже при настройках для детерминированности; предложены рекомендации по улучшению воспроизводимости результатов.