DeepDigest
← все статьи
LLM

LLM

724 статьи по теме

Leiphone

Cursor: почему оценка в 60 млрд долларов сохраняется при падении доли рынка

Доля рынка Cursor сократилась с 41 % до 26 %, однако компания сохраняет оценку в 60 млрд долларов. Маск приобрёл Cursor за акции SpaceX — сделка имеет стратегическое значение, поскольку данные, генерируемые Cursor, ценны для обучения моделей ИИ. Эксперты отмечают, что продукт стал частью «мышечной памяти» разработчиков, что затрудняет его замену.

читать →
~2 мин 470 просмотра
LangChain Blog

Динамические субагенты в Deep Agents: новая схема работы

В Deep Agents внедрены динамические субагенты, которые помогают агентам решать масштабные задачи за счёт программной оркестровки: вместо прямых вызовов инструментов агент пишет скрипт для организации работы субагентов. Механизм обеспечивает детерминированный охват и надёжную оркестровку сложных процессов. В материале описаны практические сценарии использования и шаблоны оркестровки.

читать →
~1 мин 468 просмотра
Google AI Blog

Полный стек ИИ: объяснение от эксперта Google

Эксперт Google Ричард Серотер объяснил, что подход к ИИ с использованием «полного стека» объединяет все уровни технологий в единую систему. Такой подход повышает надёжность, снижает затраты и упрощает разработку. Google предлагает инструменты для работы с ИИ — от создания прототипов до автоматизации процессов.

LLM
читать →
~3 мин 863 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Тайные взаимодействия в GPT-2: новый взгляд на работу языковых моделей

Авторы показали, что при анализе языковых моделей нужно учитывать скрытые эффекты взаимодействия компонентов — это влияет на интерпретацию их работы.

читать →
~1 мин 477 просмотра
Leiphone

Документ Karpathy: 4 принципа для корректного написания кода с ИИ

Файл Markdown из 65 строк (проект andrej-karpathy-skills) набрал 176 000 звёздочек на GitHub и стал одной из самых обсуждаемых практик разработки ИИ. В документе сформулированы четыре принципа, которые помогают избежать систематических ошибок при написании кода с помощью ИИ. Тенденция породила ряд исследовательских проектов, в том числе систему автоматической оптимизации правил ИИ.

LLM
читать →
~3 мин 449 просмотра
Import AI

NVIDIA ENPIRE и ARGUS от Tencent: самосовершенствование роботов и обучение ИИ

NVIDIA представила ПО ENPIRE для автономного обучения роботов, а Tencent — систему ARGUS для отслеживания и анализа при обучении ИИ на больших наборах данных. Исследователи из Калифорнийского университета в Беркли создали корпус данных LOCUS с местными постановлениями США для работы с ИИ. Эти разработки показывают прогресс в автоматизации обучения и анализа данных.

читать →
~2 мин 290 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

EntMTP: новый способ ускорить работу больших языковых моделей

EntMTP — метод ускорения работы LLM за счёт адаптивного многотокенного прогнозирования с учётом энтропии; даёт ускорение в 1,15–1,36 раза в ряде тестов.

читать →
~1 мин 478 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый трансформатор: быстрее и эффективнее стандартных моделей

Представлена новая архитектура нейронной сети context-ready transformer, которая быстрее и эффективнее стандартных трансформаторов за счёт предварительной контекстуализации токенов. Модель хорошо работает с длинными текстами.

читать →
~1 мин 463 просмотра
Leiphone

Youdao Dictionary Pen X8: подписка на ИИ в словарных ручках

Netease Youdao представила словарную ручку X8 с моделью подписки на ИИ‑сервисы. Базовые функции доступны бесплатно, продвинутые — за доплату. Такой подход меняет логику конкуренции в сегменте обучающего оборудования: теперь важнее не технические параметры устройства, а возможности ИИ‑сервисов.

LLM
читать →
~2 мин 414 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

MER-R1: новая система распознаёт эмоции с помощью «медленного» и «быстрого» мышления

MER-R1 объединяет «быстрое» и «медленное» мышление для точного распознавания эмоций; показала лучшую производительность на MER-UniBench и MME-Emotion.

читать →
~1 мин 436 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

ToE: новая система борьбы с фейковыми новостями

Система ToE автоматически проверяет факты, выстраивая дерево аргументов и собирая доказательства из разных источников. Улучшает точность на 4–24 п. п. по сравнению с аналогами.

читать →
~1 мин 484 просмотра
Leiphone

Agentic vCloud: эволюция видео-облака в эпоху агентов

Видео-облако трансформируется из инфраструктуры контента в инфраструктуру агентов. Аудио и видео становятся инструментом взаимодействия между людьми и ИИ. Volcano Engine развивает Agentic vCloud, внедряя мультимодальную связь и AI MediaKit для выполнения задач агентами в реальном времени. По данным IDC, сегмент взаимодействия аудио- и видеоматериалов с помощью ИИ в первой половине 2025 года достиг порядка 440 млн долларов.

читать →
~3 мин 491 просмотра
Leiphone

DeepSeek и Пекинский университет: DSpark ускоряет работу с пользователем на 60–85%

DeepSeek совместно с Пекинским университетом выпустили платформу DSpark и платформу DeepSpec для ускорения логического вывода и спекулятивного декодирования. Скорость генерации данных одним пользователем в моделях DeepSeek-V4 увеличилась на 57–85%. DSpark решает ключевые проблемы спекулятивного декодирования с помощью полуавтоматической регрессии и динамического планирования.

LLM
читать →
~2 мин 453 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

GPT-4.1 Mini раскрывает финансовые связи: многоязычный подход к анализу причинно-следственных связей

Команда HSA_CORAL в рамках FinCausal 2026 сравнила разные модели для извлечения причинно-следственных связей из финансовых текстов на двух языках. Лучшая система — GPT-4.1 Mini — показала высокие результаты.

читать →
~1 мин 466 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

ИИ помогает диагностировать аутизм по домашним видео: новый метод на базе Gemini 2.5 Pro

Модель Gemini 2.5 Pro адаптирована для диагностики РАС по видео: точность оценки врачей выросла на 40%, диагностика по F1 — на 53%.

читать →
~1 мин 446 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Darts получил новые возможности: унифицированный подход к прогнозированию временных рядов

Для библиотеки Darts создана унифицированная коллекция моделей (Chronos-2, TimesFM 2.5, TiRex, PatchTST-FM) — это упрощает интеграцию и использование базовых моделей для прогнозирования временных рядов.

читать →
~1 мин 474 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

DysLexLens: платформа на базе LLM поможет анализировать опыт учащихся с дислексией в онлайн-форумах

DysLexLens — платформа на базе LLM для анализа опыта учащихся с дислексией в онлайн-форумах. Фильтрует данные, объединяет семантический анализ и анализ на основе KG, оценивает ответы и даёт рекомендации по проверке их качества.

читать →
~1 мин 443 просмотра