DeepDigest
← все статьи
Research

Research

432 статьи по теме

cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Квантовая модель генерирует данные лучше классических аналогов

QDiffusion-TS — квантовая модель для синтеза временных рядов: сокращает число параметров и точнее генерирует данные, чем классические аналоги.

читать →
~1 мин 487 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

LaViD: как языковая модель учит компьютер «видеть»

LaViD — платформа для передачи знаний от LLM к моделям компьютерного зрения. Превосходит существующие методы, повышает точность распознавания объектов.

читать →
~1 мин 423 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

НормАкт: как ИИ справляется со скрытыми социальными нормами

Создан тест NormAct для оценки способности MLLM учитывать скрытые социальные нормы; предложен NormPerceptor, повышающий успешность задач с 24,2% до 46,7%.

читать →
~1 мин 469 просмотра
Leiphone

Kuaishou на ICML 2026: представлены исследования по ИИ

Техническая команда Kuaishou представит ряд исследований на ICML 2026. Работы охватывают ключевые направления ИИ, включая большие языковые модели, обучение с подкреплением и компьютерное зрение. Конференция пройдёт с 6 по 11 июля в Сеуле.

читать →
~3 мин 466 просмотра
Leiphone

AIVELA и Oura: новый подход к умным кольцам

Ли Донхао основал бренд AIVELA, который стремится занять нишу на рынке носимых устройств с ИИ. AIVELA Ring Pro отличается расширенным функционалом и новым подходом к взаимодействию с пользователем — в отличие от «строгого» стиля Oura, AIVELA использует «материнский» подход. Рынок смарт-колец демонстрирует высокие темпы роста, и AIVELA нацелена занять свою нишу, опираясь на возможности ИИ.

читать →
~3 мин 475 просмотра
The Sequence

GPT-5.6, Claude Tag и Кубок LayerLens Stratix: новости ИИ за неделю

На прошлой неделе OpenAI выпустила пакет моделей GPT-5.6, Anthropic представила функцию Claude Tag, а General Intuition продвигает использование видеоигр для обучения ИИ. Кубок LayerLens Stratix стал испытанием моделей в игровой среде. Кроме того, ряд компаний и исследовательских групп представили новые разработки и привлекли финансирование.

читать →
~2 мин 308 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Новый подход к прогнозированию: агенты LLM научатся предвидеть последствия решений

Разработан трёхэтапный метод обучения агентов LLM для более точного прогнозирования последствий действий — он эффективнее базовых подходов в задачах поиска и математического анализа.

читать →
~1 мин 477 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый подход к управлению памятью в LLM: как избежать ошибок в диалогах

Выявлена проблема использования устаревшей информации агентами LLM в диалогах. Создана среда Supersede для обучения моделей работать с актуальными данными — точность ответов выросла почти вдвое.

читать →
~1 мин 479 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Как нейросети осваивают язык: неожиданные открытия о работе трансформаторов

Учёные выяснили, что трансформеры сначала усваивают общие языковые правила, а затем — локальные зависимости; предложена новая концепция обучения NLM.

читать →
~1 мин 450 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Новый подход к прогнозированию выбросов CO2: как точнее считать давление в хранилищах углерода

Учёные нашли лучший метод прогнозирования давления и выбросов CO2 в геологических хранилищах — постепенный модификатор с коррекцией проницаемости снижает погрешность до менее 3,7%.

читать →
~1 мин 527 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Aloe-Vision: новые модели для анализа медданных по изображениям

Созданы модели Aloe-Vision для анализа медданных по изображениям, набор данных Aloe-Vision-Data и тест CareQA-Vision. Модели открыты, протестированы и готовы к использованию.

читать →
~1 мин 492 просмотра
Leiphone

Cursor: почему оценка в 60 млрд долларов сохраняется при падении доли рынка

Доля рынка Cursor сократилась с 41 % до 26 %, однако компания сохраняет оценку в 60 млрд долларов. Маск приобрёл Cursor за акции SpaceX — сделка имеет стратегическое значение, поскольку данные, генерируемые Cursor, ценны для обучения моделей ИИ. Эксперты отмечают, что продукт стал частью «мышечной памяти» разработчиков, что затрудняет его замену.

читать →
~2 мин 470 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Тайные взаимодействия в GPT-2: новый взгляд на работу языковых моделей

Авторы показали, что при анализе языковых моделей нужно учитывать скрытые эффекты взаимодействия компонентов — это влияет на интерпретацию их работы.

читать →
~1 мин 477 просмотра
Import AI

NVIDIA ENPIRE и ARGUS от Tencent: самосовершенствование роботов и обучение ИИ

NVIDIA представила ПО ENPIRE для автономного обучения роботов, а Tencent — систему ARGUS для отслеживания и анализа при обучении ИИ на больших наборах данных. Исследователи из Калифорнийского университета в Беркли создали корпус данных LOCUS с местными постановлениями США для работы с ИИ. Эти разработки показывают прогресс в автоматизации обучения и анализа данных.

читать →
~2 мин 290 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

EntMTP: новый способ ускорить работу больших языковых моделей

EntMTP — метод ускорения работы LLM за счёт адаптивного многотокенного прогнозирования с учётом энтропии; даёт ускорение в 1,15–1,36 раза в ряде тестов.

читать →
~1 мин 478 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый трансформатор: быстрее и эффективнее стандартных моделей

Представлена новая архитектура нейронной сети context-ready transformer, которая быстрее и эффективнее стандартных трансформаторов за счёт предварительной контекстуализации токенов. Модель хорошо работает с длинными текстами.

читать →
~1 мин 463 просмотра