DeepDigest
← все статьи
LLM

LLM

724 статьи по теме

cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Новый взгляд на обучение нейросетей: как модели выбирают простые решения

Исследователи объяснили, почему глубокие нейросети с мономиальными активациями склонны упрощаться в процессе обучения — за счёт появления неактивных нейронов.

читать →
~1 мин 506 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

RADIANT-ПЭТ: ИИ помогает точнее выявлять поражения при ПЭТ/КТ

Фреймворк RADIANT-PET использует LLM и обучение с подкреплением для точной сегментации поражений при ПЭТ/КТ — лучше отсеивает ложные срабатывания и согласовывает прогнозы с клинической интерпретацией.

читать →
~1 мин 492 просмотра
Google DeepMind

Nano Banana 2 Lite и Gemini Omni Flash: новые инструменты от Google

Google выпустил модели Nano Banana 2 Lite для генерации изображений и Gemini Omni Flash для создания и редактирования видео. Первая отличается высокой скоростью и экономичностью, вторая позволяет комбинировать разные типы данных для работы с видео. Разработчики могут объединять модели в единый рабочий процесс.

читать →
~2 мин 784 просмотра
Analytics Vidhya

ChatGPT Plus, Claude Pro и Gemini Pro: сравнение подписок за 20 долларов

Сравнение подписок ChatGPT Plus, Claude Pro и Gemini Pro за 20 долларов в месяц. Каждая модель имеет свои сильные стороны: Claude хорош для написания текстов, ChatGPT — для изображений и безопасности, Gemini — для интеграции с сервисами Google и создания видео. Выбор зависит от конкретных задач пользователя.

LLM
читать →
~1 мин 273 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

VirtueMap: как оценить этические принципы больших языковых моделей

VirtueMap — структура для оценки LLM через призму аристотелевской этики: оценка ответов на этические дилеммы и формирование профилей моделей по добродетелям. Есть интерактивный сайт.

читать →
~1 мин 460 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый подход к анализу текстов: усреднённые SAE упрощают работу с длинными контекстами

Авторы предложили усреднённые по ходу движения SAE — метод, который упрощает анализ длинных текстов в языковых моделях, фиксируя характеристики фрагментов, а не отдельных токенов.

читать →
~1 мин 455 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

ModernBERT научился разбираться в юридических документах

ModernBERT адаптировали для юридической сферы — обучили на судебных решениях США. Модель лучше обрабатывает юридические тексты, работает с последовательностями до 8192 токенов. Модель выложена в открытый доступ.

читать →
~1 мин 479 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый способ оценить объяснения работы нейросетей: прорыв в компьютерном зрении

Предложены новые метрики для оценки XAI-методов в CNN в реальных условиях с использованием особых возмущений данных; протестировано в медицинских и визуальных приложениях.

читать →
~1 мин 425 просмотра
Leiphone

OpenAI меняет стратегию: от пользователей к бизнесу через плагины

OpenAI меняет стратегию — от ориентации на обычных пользователей к работе с бизнесом. Компания интегрирует в ChatGPT Codex и шесть плагинов для разных сценариев, добавляет функции аннотаций и сайтов. Параллельно она стремится создать платформу наподобие App Store, в то время как Anthropic фокусируется на способности агентов выполнять конкретные задачи.

читать →
~2 мин 452 просмотра
AI Supremacy

Neo Labs: возможности ИИ в математике и естественных науках

Статья посвящена роли ИИ в науке, в частности в математике и естественных науках. Обсуждаются новые стартапы в сфере ИИ — Neo Labs — и их вклад в развитие технологий. Также рассматривается нерешённая математическая задача, поставленная Паулем Эрдешем, и роль ИИ в её возможном решении.

читать →
~2 мин 309 просмотра
QbitAI

Claude Code: пять новых ролей в эпоху ИИ от Бориса Чёрного

Борис Чёрный из Anthropic выделил пять новых ролей в эпоху ИИ — от инженера‑прототипа до сопровождающего. По его мнению, искусственный интеллект стирает границы между профессиями, создавая возможности для специалистов широкого профиля. Годовой доход Claude Code превысил 2,5 млрд долларов, а инструмент обеспечил 4% публичных коммитов на GitHub.

читать →
~2 мин 484 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

IMCBench: новый тест для ИИ в медицинских диалогах с использованием изображений

IMCBench — тест для оценки ИИ-моделей в медицинских диалогах с изображениями; тестировались Claude, GPT, Nova, Llama; лучший результат у Claude Opus 4.6 (3,61 балла).

читать →
~1 мин 438 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Виртуальные пациенты и набор данных для обучения медиков: новый инструмент от исследователей

Создан набор данных и система виртуальных пациентов для обучения медиков с использованием LLM; есть интерактивный прототип для практики и обратной связи.

читать →
~1 мин 448 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Большие языковые модели: как они понимают убеждения и ситуации

Учёные изучили, как LLM (Olmo2, Pythia) понимают убеждения и ситуации: эффективность зависит от размера модели и тренировок, есть противоречия в ответах.

читать →
~1 мин 413 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Новый фильтр Калмана: агенты смогут точнее оценивать данные в сложных условиях

Создан новый фильтр Калмана (CA-NKCF) для распределённой оценки данных: он эффективнее аналогов и не требует точных данных о шуме, хорошо работает в сложных условиях.

читать →
~1 мин 395 просмотра
Leiphone

AXera Edge-Day: Aixin Yuanzhi представила решения для edge AI

В Шэньчжэне прошёл салон разработчиков AXera Edge-Day, организованный Aixin Yuanzhi. На мероприятии обсудили создание базы вычислительных мощностей для физического ИИ и коммерциализацию edge AI. Партнёры компании продемонстрировали реальные кейсы применения edge computing в разных сферах — от голосового взаимодействия до умной розничной торговли.

читать →
~3 мин 492 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый метод извлекает знания из арабско‑английского словаря

Разработан метод автоматического извлечения лексической информации из словаря Al‑Mawrid с помощью n‑граммового анализа, KWIC и правил; показана высокая точность извлечения разных типов данных.

читать →
~1 мин 436 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый подход к генерации текста: как справиться с «галлюцинациями» ИИ

Учёные разработали модель генерации текста, которая допускает ошибки, но сохраняет высокую точность; подход приближает ИИ к реальным условиям работы с языком.

читать →
~1 мин 478 просмотра
Leiphone

Су Вэйцзе присоединился к OpenAI: математика в эпоху после масштабирования

Су Вэйцзе, известный статистик и лауреат премии COPSS, присоединился к OpenAI, чтобы решать актуальные проблемы индустрии ИИ. Он считает, что в будущем теоретические навыки будут играть ключевую роль в разработке моделей искусственного интеллекта. В интервью учёный обсудил проблемы закона масштабирования, использования синтетических данных и другие вызовы отрасли.

LLM
читать →
~2 мин 460 просмотра