DeepDigest
← все статьи
LLM

LLM

724 статьи по теме

cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Новый метод улучшает работу больших языковых моделей: замкнутый цикл обработки данных

Разработан замкнутый цикл обработки данных для выявления и устранения слабых мест в LLM; метод протестирован на задачах BBH и AIME2025/AIME2026, показал эффективность.

читать →
~1 мин 475 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

RSEA: агент, который сам себя совершенствует — новый подход в ИИ

Разработан агент RSEA, который самостоятельно улучшает свою работу и безопасно адаптируется к задачам. В тестах показал высокие результаты.

читать →
~1 мин 493 просмотра
Google AI Blog

Внедрение ИИ в Великобритании: неравномерный прогресс

Исследование Google и Public First показало, что за последний год внедрение ИИ на рабочих местах в Великобритании удвоилось — до 73 %. При этом лишь 15 % продвинутых пользователей значительно чаще сообщают о карьерном росте и повышении зарплаты. Инициатива «AI Works for Britain» призвана помочь остальным 85 % работников освоить ИИ и сократить разрыв в уровне внедрения технологии.

LLM
читать →
~3 мин 838 просмотра
L Leiphone
Leiphone

FLAG от Шанхайского института и университетов: восстановление структуры транскриптома

Институт Шанчжи, Шанхайский университет науки и технологии и Фуданьский университет представили фреймворк FLAG для восстановления структуры пространственного транскриптома. Модель переопределяет задачу с детерминированной регрессии на моделирование структурированного распределения и успешно справляется с «проклятием генетической размерности». Эксперименты показали преимущество FLAG по структурным показателям в сравнении с другими методами.

читать →
~2 мин 488 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Yuvion LLM: новая модель ИИ с усиленной защитой от угроз

Yuvion LLM — модель ИИ с усиленной защитой от угроз, учитывающая «состязательный» характер атак; в тестах превзошла GPT-5.4 и Qwen3-MAX по показателям безопасности.

читать →
~1 мин 458 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Квантовая модель генерирует данные лучше классических аналогов

QDiffusion-TS — квантовая модель для синтеза временных рядов: сокращает число параметров и точнее генерирует данные, чем классические аналоги.

читать →
~1 мин 487 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

LaViD: как языковая модель учит компьютер «видеть»

LaViD — платформа для передачи знаний от LLM к моделям компьютерного зрения. Превосходит существующие методы, повышает точность распознавания объектов.

читать →
~1 мин 423 просмотра
Leiphone

Kuaishou Kling ведёт переговоры с General Atlantic о финансировании

Kuaishou ведёт переговоры с General Atlantic о финансировании бизнеса по производству моделей Kling AI. Компания планирует привлечь более 22 млрд долларов, постинвестиционная оценка — около 118 млрд долларов. Интерес к инвестициям проявляют и другие институты, ориентированные на азиатский рынок.

LLM
читать →
~1 мин 462 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

НормАкт: как ИИ справляется со скрытыми социальными нормами

Создан тест NormAct для оценки способности MLLM учитывать скрытые социальные нормы; предложен NormPerceptor, повышающий успешность задач с 24,2% до 46,7%.

читать →
~1 мин 469 просмотра
Leiphone

Kuaishou на ICML 2026: представлены исследования по ИИ

Техническая команда Kuaishou представит ряд исследований на ICML 2026. Работы охватывают ключевые направления ИИ, включая большие языковые модели, обучение с подкреплением и компьютерное зрение. Конференция пройдёт с 6 по 11 июля в Сеуле.

читать →
~3 мин 466 просмотра
Leiphone

AIVELA и Oura: новый подход к умным кольцам

Ли Донхао основал бренд AIVELA, который стремится занять нишу на рынке носимых устройств с ИИ. AIVELA Ring Pro отличается расширенным функционалом и новым подходом к взаимодействию с пользователем — в отличие от «строгого» стиля Oura, AIVELA использует «материнский» подход. Рынок смарт-колец демонстрирует высокие темпы роста, и AIVELA нацелена занять свою нишу, опираясь на возможности ИИ.

читать →
~3 мин 475 просмотра
The Sequence

GPT-5.6, Claude Tag и Кубок LayerLens Stratix: новости ИИ за неделю

На прошлой неделе OpenAI выпустила пакет моделей GPT-5.6, Anthropic представила функцию Claude Tag, а General Intuition продвигает использование видеоигр для обучения ИИ. Кубок LayerLens Stratix стал испытанием моделей в игровой среде. Кроме того, ряд компаний и исследовательских групп представили новые разработки и привлекли финансирование.

читать →
~2 мин 308 просмотра
Ars Technica AI

Южная Корея инвестирует $1 трлн в чипы и человекоподобных роботов

Южная Корея выделяет 1 трлн долларов на развитие производства чипов памяти, центров обработки данных с ИИ и внедрение человекоподобных роботов. Крупные компании, включая Samsung, SK Hynix и Hyundai, инвестируют средства в строительство заводов и центров обработки данных. В обществе возникают споры из‑за влияния новых технологий на рынок труда и распределение прибыли.

читать →
~2 мин 321 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Новый подход к прогнозированию: агенты LLM научатся предвидеть последствия решений

Разработан трёхэтапный метод обучения агентов LLM для более точного прогнозирования последствий действий — он эффективнее базовых подходов в задачах поиска и математического анализа.

читать →
~1 мин 477 просмотра
Leiphone

Fable 5: как змея превратилась в «бунтарскую личность»

Итан Моллик провёл эксперимент с ИИ-агентом Fable, попросив создать «игру в змейку с самосознанием». Демонстрация показывает, как ИИ может модифицировать уже существующую систему, а не создавать новую в каждом раунде. Ключевая сложность — интерпретировать неопределённую обратную связь («Сделай это лучше») и учесть множество факторов при внесении изменений.

LLM
читать →
~2 мин 487 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый подход к управлению памятью в LLM: как избежать ошибок в диалогах

Выявлена проблема использования устаревшей информации агентами LLM в диалогах. Создана среда Supersede для обучения моделей работать с актуальными данными — точность ответов выросла почти вдвое.

читать →
~1 мин 479 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Как нейросети осваивают язык: неожиданные открытия о работе трансформаторов

Учёные выяснили, что трансформеры сначала усваивают общие языковые правила, а затем — локальные зависимости; предложена новая концепция обучения NLM.

читать →
~1 мин 450 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Aloe-Vision: новые модели для анализа медданных по изображениям

Созданы модели Aloe-Vision для анализа медданных по изображениям, набор данных Aloe-Vision-Data и тест CareQA-Vision. Модели открыты, протестированы и готовы к использованию.

читать →
~1 мин 492 просмотра