DeepDigest
← все статьи
Research

Research

432 статьи по теме

Корпоративный RAG: философия построения системы на основе экспертных знаний

Анджела Ши описывает философию построения корпоративных систем RAG, подчёркивая, что такие системы должны усиливать, а не заменять экспертов. В основе архитектуры — четыре элемента (синтаксический анализ, анализ вопросов, поиск, генерация), каждый из которых должен отражать действия эксперта. Автор выделяет четыре условия и три принципа для эффективной реализации системы.

читать →
~2 мин 330 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

NebulaExp-8B: новый способ дообучения больших языковых моделей

Разработан конвейер постобучения NebulaExp для LLM на базе Qwen3-8B: он улучшает показатели модели за счёт детальной обработки данных и оптимизации настроек.

читать →
~1 мин 498 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

ИИ автоматически превращает инструкции в проверенные политики — прорыв в безопасности агентов

Система на базе LLM автоматически превращает текстовые инструкции в формальные проверенные политики для агентов (на языке Cedar). В тестах MedAgentBench превзошла ручное кодирование.

читать →
~1 мин 504 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

ИИ-диспетчер отправит письма вместо вас: автоматизация общения в вузе

Система на базе LLM автоматически отправляет письма через WhatsApp в вузе, анализируя их содержание и определяя получателей без размеченных данных.

читать →
~1 мин 523 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

ИИ-планирование наблюдений за космосом: новая система проверки решений

Разработана система для проверки решений ИИ в планировании работы телескопов — она повышает надёжность наблюдений и сокращает потери времени.

читать →
~1 мин 493 просмотра
LangChain Blog

LangSmith: новые возможности и мероприятия в июне 2026

LangChain представила обновления LangSmith, включая новые шаблоны агентов и интерфейсы для работы с аудио и трассировкой. Запущен курс по развёртыванию LangSmith и учебное пособие по добавлению голоса в LangGraph Agents. Анонсированы мероприятия в разных городах в июне–августе 2026 года.

читать →
~2 мин 539 просмотра

GPT-агенты и маршрутизация: ловушка Парето при оптимизации затрат

Команда сократила расходы на ИИ за счёт маршрутизации запросов между дешёвой и дорогой моделями, но через несколько месяцев заметила падение удовлетворённости клиентов и рост оттока. Проблема в том, что существующая система измерений не позволяла отследить разрыв в качестве на разных уровнях маршрутизации. В качестве решения предложен каскадный подход к обработке запросов.

читать →
~2 мин 339 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

EvoOptiGraph: новый подход к оптимизации с помощью графов и ИИ

EvoOptiGraph — платформа для оптимизации с помощью графов и LLM: создаёт разнообразные обучающие данные и улучшает работу моделей, показывая лучшие результаты по сравнению с аналогами.

читать →
~1 мин 520 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

NeuraDock Agent: новый агент для анализа ЭЭГ с контролем качества данных

NeuraDock Agent — система для анализа ЭЭГ с контролем качества данных; разделяет движок и языковой уровень, обеспечивает стабильность и безопасность данных.

читать →
~1 мин 1222 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Как понять мысли ИИ: новый подход к интерпретируемости

Авторы предложили метод интерпретации ИИ как агентов, разработав критерии и тесты для понимания «убеждений» и «желаний» моделей с учётом их взаимосвязи.

читать →
~1 мин 1749 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

NeuraDock Agent: новый инструмент для анализа когнитивной нагрузки в реальном времени

Учебное пособие по NeuraDock Agent — инструменту для обработки ЭЭГ и анализа когнитивной нагрузки в реальном времени с контролем качества данных и интеграцией LLM.

читать →
~1 мин 1644 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

DiCoBench: новый тест выявил слабые места мультимодальных моделей в анализе изображений

DiCoBench — тест для оценки способности MLLM анализировать несколько изображений высокого разрешения; выявил значительный разрыв в точности между моделями и человеком.

читать →
~1 мин 1675 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

TempoWave: новый способ улучшить прогнозы с помощью LLM

TempoWave — интерфейс для LLM, который повышает точность прогнозов временных рядов за счёт особого представления числовых данных с использованием вейвлетов.

читать →
~1 мин 982 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Новый инструментарий поможет управлять медицинским ИИ

Предложен инструментарий для управляемых медицинских экосистем ИИ — он позволяет отслеживать и контролировать ИИ‑решения в медицине, пример применения — уход за пациентами с остеопорозом.

читать →
~1 мин 1113 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Новый метод поможет сделать языковые модели безопаснее: разреженные автоэнкодеры выявляют слабые места

Разработан метод оценки надёжности LLM с помощью разреженных автоэнкодеров; предложена стратегия тонкой настройки для повышения безопасности языковых моделей.

читать →
~1 мин 1486 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

SOLAR: автоматический анализ производительности ИИ-моделей

SOLAR — фреймворк для автоматического расчёта предельной производительности ИИ-моделей на разном оборудовании. Помогает оптимизировать ПО, алгоритмы и железо.

читать →
~1 мин 1226 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый метод извлекает задачи и методы из научных статей с высокой точностью

Новый метод извлекает из научных статей задачи и методы с помощью десенсибилизации шаблонов и контекстно-зависимого преобразователя, улучшая F1 на 2,67–3,71%.

читать →
~1 мин 1777 просмотра