DynaSteer: система, которая ведёт LLM к истине
Создана система DynaSteer, которая улучшает рассуждения LLM: она динамически корректирует траектории рассуждений, используя кластеризацию и Fisher-LDA.
432 статьи по теме
Создана система DynaSteer, которая улучшает рассуждения LLM: она динамически корректирует траектории рассуждений, используя кластеризацию и Fisher-LDA.
ModernBERT адаптировали для юридической сферы — обучили на судебных решениях США. Модель лучше обрабатывает юридические тексты, работает с последовательностями до 8192 токенов. Модель выложена в открытый доступ.
Topo4Vec — платформа GeoAI для автоматической проверки геоданных: выявляет ошибки (перекрытие полигонов, проблемы в уличной сети), заменяет ручной труд, показала высокую точность в тестах.
Предложены новые метрики для оценки XAI-методов в CNN в реальных условиях с использованием особых возмущений данных; протестировано в медицинских и визуальных приложениях.
Статья посвящена роли ИИ в науке, в частности в математике и естественных науках. Обсуждаются новые стартапы в сфере ИИ — Neo Labs — и их вклад в развитие технологий. Также рассматривается нерешённая математическая задача, поставленная Паулем Эрдешем, и роль ИИ в её возможном решении.
Борис Чёрный из Anthropic выделил пять новых ролей в эпоху ИИ — от инженера‑прототипа до сопровождающего. По его мнению, искусственный интеллект стирает границы между профессиями, создавая возможности для специалистов широкого профиля. Годовой доход Claude Code превысил 2,5 млрд долларов, а инструмент обеспечил 4% публичных коммитов на GitHub.
IMCBench — тест для оценки ИИ-моделей в медицинских диалогах с изображениями; тестировались Claude, GPT, Nova, Llama; лучший результат у Claude Opus 4.6 (3,61 балла).
Создан набор данных и система виртуальных пациентов для обучения медиков с использованием LLM; есть интерактивный прототип для практики и обратной связи.
Учёные изучили, как LLM (Olmo2, Pythia) понимают убеждения и ситуации: эффективность зависит от размера модели и тренировок, есть противоречия в ответах.
Система SoccerNet 2026 анализирует футбольные матчи, отслеживая действия игроков; за счёт новых алгоритмов показатель Macro-F1 вырос с 48,6 до 58,94.
Авторы статьи разграничивают два способа использования симуляторов в обучении с подкреплением и указывают на риски их смешения.
Создан новый фильтр Калмана (CA-NKCF) для распределённой оценки данных: он эффективнее аналогов и не требует точных данных о шуме, хорошо работает в сложных условиях.
Разработан метод автоматического извлечения лексической информации из словаря Al‑Mawrid с помощью n‑граммового анализа, KWIC и правил; показана высокая точность извлечения разных типов данных.
Разработан неконтролируемый метод распознавания действий по данным IMU с использованием автоэнкодера и LSTM; точность на DaLiAc и PAMAP2 — 96,6% и 98,4%.
Учёные разработали модель генерации текста, которая допускает ошибки, но сохраняет высокую точность; подход приближает ИИ к реальным условиям работы с языком.
Представлен тест SciDraw-Bench для оценки научных рисунков, сгенерированных ИИ. Он проверяет корректность надписей, изображений и соблюдение правил. Система SciDraw AI лучше общих моделей.
Разработан замкнутый цикл обработки данных для выявления и устранения слабых мест в LLM; метод протестирован на задачах BBH и AIME2025/AIME2026, показал эффективность.
Разработан агент RSEA, который самостоятельно улучшает свою работу и безопасно адаптируется к задачам. В тестах показал высокие результаты.
Институт Шанчжи, Шанхайский университет науки и технологии и Фуданьский университет представили фреймворк FLAG для восстановления структуры пространственного транскриптома. Модель переопределяет задачу с детерминированной регрессии на моделирование структурированного распределения и успешно справляется с «проклятием генетической размерности». Эксперименты показали преимущество FLAG по структурным показателям в сравнении с другими методами.
Yuvion LLM — модель ИИ с усиленной защитой от угроз, учитывающая «состязательный» характер атак; в тестах превзошла GPT-5.4 и Qwen3-MAX по показателям безопасности.