DeepDigest
ITmedia AI+ · · ~1 мин

NVIDIA выпустила модель Nemotron 3.5 Lightning с 30B параметров

NVIDIA представила модель Nemotron 3.5 Lightning с 30B параметров, предназначенную для постоянно работающих AI-агентов. Модель использует архитектуру MoE и сочетает низкую стоимость с высокой производительностью. Искусственный анализ поставил ей 24 балла в рейтинге Intelligence Index — это сопоставимо с моделью GPT-OSS-120B от OpenAI.

LLM
NVIDIA выпустила модель Nemotron 3.5 Lightning с 30B параметров

NVIDIA 11 августа (по местному времени) представила открытую модель Nemotron 3.5 Lightning с 30 миллиардами (30B) параметров. Модель разработана для постоянно работающих AI-агентов, таких как OpenClaw и Hermes Agent. Производитель заявляет, что она сочетает невысокую стоимость, характерную для небольших моделей, и производительность, сопоставимую с крупными моделями.

В основе модели — архитектура MoE: в ней предусмотрено несколько обработчиков, и в зависимости от входных данных задействуется только часть из них — это повышает эффективность обработки. При этом во время вывода активны 3 миллиарда (3B) параметров.

Для сохранения точности при высокой скорости генерации в модели использованы методы «предположительного декодирования» (проверка результатов малых моделей с помощью крупных) и квантования (преобразование весов модели в низкобитные значения).

Сервис оценки производительности AI-моделей Artificial Analysis поставил Nemotron 3.5 Lightning 24 балла в Artificial Analysis Intelligence Index. Это сопоставимо с моделью GPT-OSS-120B от OpenAI, у которой примерно в 4 раза больше параметров. По сравнению с предыдущей версией Nemotron 3 Nano модель улучшила результат на 9 баллов. Скорость вывода составляет около 670 токенов в секунду — это значительно выше, чем у аналогичных моделей других разработчиков.

Веса модели, обучающие данные и рецепты распространяются под лицензией OpenMDW-1.1 на платформах вроде Hugging Face.

// оригинал
ITmedia AI+ ↗ Читать оригинал
3 просмотров
// поделиться Telegram VK