В июле 2026 года разгорелся спор вокруг открытого коллективного письма о публикации весов моделей ИИ. Инициатором выступил Хуан Жэньсюнь. В письме поддерживается идея публикации файлов моделей после обучения — это позволит разработчикам настраивать и использовать их дальше. Среди подписавших письмо — NVIDIA, Google, OpenAI, Meta*, Microsoft, Mistral, Hugging Face. Однако Anthropic отказалась присоединиться.
Представители Anthropic не отрицают пользу открытых моделей, но ставят вопросы о прозрачности других технологий. Например, Julian Schrittwieser из Anthropic интересуется, когда будут открыты CUDA и драйверы GPU от NVIDIA, а также Windows и Office от Microsoft.
Atharva Ingle привёл примеры открытых проектов NVIDIA (NCCL, CUTLASS, TensorRT-LLM) и Microsoft (.NET, TypeScript, ONNX Runtime, DeepSpeed). При этом у Anthropic есть открытый протокол MCP, но Claude не имеет открытых весов. Код Claude Code опубликован без использования распространённых открытых лицензий. В сети компанию критикуют за расхождения в позициях по вопросу открытости весов. На Reddit считают, что позиция Anthropic может привести к потере расположения сообщества разработчиков.
Обсуждения открытости моделей часто приводят к недопониманию из‑за разных трактовок на разных технических уровнях. Подписавшие письмо не требуют обязательной открытости всех больших моделей, а выступают за то, чтобы открытие весов оставалось допустимым способом публикации. При этом они не обещают раскрывать самые мощные модели — готовы передавать внешние пользователям только те модели, чьи возможности и риски понятны после оценки.
Открытие весов даёт разработчикам ряд возможностей:
* развернуть модель на собственных серверах;
* выполнить квантование (снизить требования к видеопамяти);
* провести дообучение (адаптировать модель под конкретные задачи);
* осуществить дистилляцию (перенести часть возможностей большой модели в меньшую).
Исследователи при этом могут фиксировать версию модели и тестировать изменения её возможностей и показателей безопасности.
Есть три технических аргумента в пользу открытия весов:
1. Подход к открытости должен зависеть от возможностей модели, а не только от факта раскрытия весов. Например, риски различаются у модели для обработки текста и у модели, выполняющей сложные сетевые операции.
2. Многие проблемы моделей становятся очевидны только после получения весов. При тестировании через API исследователи видят только итоговый ответ, а при наличии весов можно проверить, как модель изменится после квантования, дообучения или объединения с другими моделями (например, сохранится ли отказ от определённых запросов после дообучения, изменятся ли показатели безопасности при снижении точности до 4 бит).
3. Веса модели и системы безопасности можно частично разделять при развёртывании. Модель генерирует контент, а проверка ввода, фильтрация вывода, управление правами инструментов и мониторинг аномалий размещаются отдельно. После открытия весов можно добавлять классификаторы, ограничивать доступ модели к файлам, базам данных и внешним инструментам, фиксировать аномальные вызовы.
Anthropic опасается, что при открытом доступе к весам модели Claude будут утрачены меры безопасности, которые сейчас применяются на серверах компании. Среди них — проверка ввода и вывода, выявление аномальных запросов, ограничение вызовов аккаунтов, обновление классификаторов и замена версий модели. При открытом доступе внешние пользователи смогут удалять классификаторы, изменять системные подсказки, выполнять дообучение модели. Anthropic не сможет контролировать обработку запросов в таких копиях и требовать установки обновлений безопасности. Дообучение может ослабить изначальные механизмы отказа от выполнения запросов. Обновления для API можно централизованно применять, а уже опубликованные веса сложно отозвать. Ранние, квантованные и дообученные версии могут существовать долго, и разработчик не сможет подтвердить сохранение защиты.
Большинство компаний из списка подписантов считают возможным отбирать модели для открытия через оценку возможностей, а затем поручать внешним развёртывателям настройку фильтрации, разрешений и мониторинга. Anthropic же делает акцент на сохранении контроля над передовыми моделями со своей стороны. Вопрос, который нужно решить обеим сторонам: достаточно ли оценки перед публикацией, чтобы доверить веса модели для долгосрочного использования внешними пользователями. Julian подчёркивает, что «открытие» не является единым механизмом — влияние открытия весов, протоколов, среды выполнения и кода приложения различается.
Ссылки
* Meta Platforms Inc. признана экстремистской организацией, её деятельность запрещена на территории РФ.