DeepDigest
← все статьи
Research

Research

432 статьи по теме

cs.CV
arXiv
Cornell University Library
arXiv cs.CV

ReWorld: новый подход к обучению моделей автономного вождения

ReWorld — платформа для оптимизации представлений в моделях автономного вождения; улучшила качество генерации видео и производительность моделей на датасетах nuScenes и NAVSIM.

читать →
~1 мин 486 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый тест DMV-Bench: как проверить зрительную память ИИ-агентов

DMV-Bench — тест для оценки зрительной памяти ИИ-агентов на основе каталога товаров; архитектура DualMem превзошла другие мультимодальные системы.

читать →
~1 мин 453 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

MER-R1: новая система распознаёт эмоции с помощью «медленного» и «быстрого» мышления

MER-R1 объединяет «быстрое» и «медленное» мышление для точного распознавания эмоций; показала лучшую производительность на MER-UniBench и MME-Emotion.

читать →
~1 мин 436 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

ToE: новая система борьбы с фейковыми новостями

Система ToE автоматически проверяет факты, выстраивая дерево аргументов и собирая доказательства из разных источников. Улучшает точность на 4–24 п. п. по сравнению с аналогами.

читать →
~1 мин 484 просмотра
Leiphone

Agentic vCloud: эволюция видео-облака в эпоху агентов

Видео-облако трансформируется из инфраструктуры контента в инфраструктуру агентов. Аудио и видео становятся инструментом взаимодействия между людьми и ИИ. Volcano Engine развивает Agentic vCloud, внедряя мультимодальную связь и AI MediaKit для выполнения задач агентами в реальном времени. По данным IDC, сегмент взаимодействия аудио- и видеоматериалов с помощью ИИ в первой половине 2025 года достиг порядка 440 млн долларов.

читать →
~3 мин 491 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

GPT-4.1 Mini раскрывает финансовые связи: многоязычный подход к анализу причинно-следственных связей

Команда HSA_CORAL в рамках FinCausal 2026 сравнила разные модели для извлечения причинно-следственных связей из финансовых текстов на двух языках. Лучшая система — GPT-4.1 Mini — показала высокие результаты.

читать →
~1 мин 466 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

ИИ помогает диагностировать аутизм по домашним видео: новый метод на базе Gemini 2.5 Pro

Модель Gemini 2.5 Pro адаптирована для диагностики РАС по видео: точность оценки врачей выросла на 40%, диагностика по F1 — на 53%.

читать →
~1 мин 446 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

PairSAE: новый инструмент для расшифровки работы моделей в структурной биологии

PairSAE — метод, помогающий понять работу моделей в структурной биологии: он выделяет понятные характеристики данных и позволяет избежать ошибок прежних подходов.

читать →
~1 мин 450 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Darts получил новые возможности: унифицированный подход к прогнозированию временных рядов

Для библиотеки Darts создана унифицированная коллекция моделей (Chronos-2, TimesFM 2.5, TiRex, PatchTST-FM) — это упрощает интеграцию и использование базовых моделей для прогнозирования временных рядов.

читать →
~1 мин 474 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

DysLexLens: платформа на базе LLM поможет анализировать опыт учащихся с дислексией в онлайн-форумах

DysLexLens — платформа на базе LLM для анализа опыта учащихся с дислексией в онлайн-форумах. Фильтрует данные, объединяет семантический анализ и анализ на основе KG, оценивает ответы и даёт рекомендации по проверке их качества.

читать →
~1 мин 443 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

ODYSSEY: новый подход к созданию проверяемых ИИ‑моделей

Представлена структура ODYSSEY для создания проверяемых локальных ИИ‑моделей с набором компонентов и инструментов (UFL, FSQL, TICKET); система успешно протестирована.

читать →
~1 мин 439 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Личностные черты LLM влияют на работу команд — новое исследование

Учёные выяснили, что личностные черты LLM по‑разному влияют на работу мультиагентных команд в зависимости от типа задачи — от незначительного эффекта в кодировании до сильного снижения производительности в переговорах и сотрудничестве.

читать →
~1 мин 489 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

OverFlowLight: система для борьбы с пробками в реальном времени

Платформа OverFlowLight в реальном времени обнаруживает заторы и корректирует работу светофоров, снижая количество инцидентов с переполнением на 60,4% и увеличивая пропускную способность сети на 18,2%.

читать →
~1 мин 477 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Путаница в терминологии: как правильно «забывать» данные в LLM

Авторы критикуют нечёткое использование термина «машинное переобучение» в LLM и предлагают ввести строгую терминологию для разных задач «забывания» данных.

читать →
~1 мин 506 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый способ оценить «мышление» ИИ: обнаружены серьёзные ограничения LLM

Разработана система оценки «мышления» LLM: выявлены структурные ограничения моделей на основе четырёх аксиом; протестировано на 23 логических задачах.

читать →
~1 мин 495 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

AI-ModelNet: сеть ИИ-моделей — новый шаг к их взаимодействию

Предложена концепция AI‑ModelNet — сети ИИ‑моделей для их взаимодействия и совместного решения задач, что может упростить практическое применение ИИ.

читать →
~1 мин 503 просмотра
Leiphone

Vivo X Fold6: складной экран для «телефона-агента»

Vivo готовит к выпуску модель X Fold6 со складным экраном — она должна стать «телефоном-агентом», активно понимающим потребности пользователя. Компания внедряет новые функции на базе ИИ для многозадачности и работы с данными. При общем падении рынка смартфонов сегмент складных устройств демонстрирует рост.

читать →
~2 мин 447 просмотра
TechCrunch AI

Ford нанимает опытных инженеров после проблем с ИИ

Ford нанял 350 опытных инженеров после того, как ИИ и автоматизированные системы не оправдали ожиданий в обеспечении качества. Нанятые специалисты будут обучать молодёжь и перепрограммировать инструменты ИИ. Компания рассчитывает сэкономить 1 млрд долларов и уже заняла первое место в опросе JD Power.

читать →
~1 мин 366 просмотра

Логистическая регрессия превзошла XGBoost в прогнозировании результатов матчей

Ари Джури сравнил несколько моделей машинного обучения для прогнозирования результатов футбольных матчей. Логистическая регрессия превзошла XGBoost благодаря лучшему балансу смещения и дисперсии в условиях ограниченного объёма данных. Проблема XGBoost — неверная калибровка из‑за чрезмерной уверенности в ошибочных прогнозах.

читать →
~2 мин 313 просмотра