DeepDigest

// 50+ источников об ИИ в одном месте

Всё важное об ИИ — в одной ленте

▸ LIVE: OpenAI расширяет Daybreak: новые уровни защиты и модель GPT-5.6-Cyber
@deepdigest
Статьи об ИИ в Telegram — подпишитесь
Подписаться →
@deepdigest · Макс
Статьи об ИИ в Макс — подпишитесь
Подписаться →
Дзен
deepdigest · Дзен
Статьи об ИИ в Яндекс Дзен — подпишитесь
Подписаться →
// самые читаемые
#1
Ускорение Gemini Nano на Pixel с мультитокеновым прогнозированием
3262 просм.
#2
Викторина по вводу-выводу 2026 от Google AI Studio
3154 просм.
#3
Конфиденциальные данные в эпоху ИИ: как классифицировать актив...
3126 просм.
#4
Управляемое обучение с Gemini в Сьерра-Леоне: результаты иссле...
3073 просм.
#5
Google: дорожная карта управления ИИ для безопасности агентов
2932 просм.
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Новый подход к прогнозированию выбросов CO2: как точнее считать давление в хранилищах углерода

Учёные нашли лучший метод прогнозирования давления и выбросов CO2 в геологических хранилищах — постепенный модификатор с коррекцией проницаемости снижает погрешность до менее 3,7%.

читать →
~1 мин 515 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Aloe-Vision: новые модели для анализа медданных по изображениям

Созданы модели Aloe-Vision для анализа медданных по изображениям, набор данных Aloe-Vision-Data и тест CareQA-Vision. Модели открыты, протестированы и готовы к использованию.

читать →
~1 мин 488 просмотра
Leiphone

Cursor: почему оценка в 60 млрд долларов сохраняется при падении доли рынка

Доля рынка Cursor сократилась с 41 % до 26 %, однако компания сохраняет оценку в 60 млрд долларов. Маск приобрёл Cursor за акции SpaceX — сделка имеет стратегическое значение, поскольку данные, генерируемые Cursor, ценны для обучения моделей ИИ. Эксперты отмечают, что продукт стал частью «мышечной памяти» разработчиков, что затрудняет его замену.

читать →
~2 мин 459 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Тайные взаимодействия в GPT-2: новый взгляд на работу языковых моделей

Авторы показали, что при анализе языковых моделей нужно учитывать скрытые эффекты взаимодействия компонентов — это влияет на интерпретацию их работы.

читать →
~1 мин 471 просмотра
Import AI

NVIDIA ENPIRE и ARGUS от Tencent: самосовершенствование роботов и обучение ИИ

NVIDIA представила ПО ENPIRE для автономного обучения роботов, а Tencent — систему ARGUS для отслеживания и анализа при обучении ИИ на больших наборах данных. Исследователи из Калифорнийского университета в Беркли создали корпус данных LOCUS с местными постановлениями США для работы с ИИ. Эти разработки показывают прогресс в автоматизации обучения и анализа данных.

читать →
~2 мин 285 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

EntMTP: новый способ ускорить работу больших языковых моделей

EntMTP — метод ускорения работы LLM за счёт адаптивного многотокенного прогнозирования с учётом энтропии; даёт ускорение в 1,15–1,36 раза в ряде тестов.

читать →
~1 мин 465 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый трансформатор: быстрее и эффективнее стандартных моделей

Представлена новая архитектура нейронной сети context-ready transformer, которая быстрее и эффективнее стандартных трансформаторов за счёт предварительной контекстуализации токенов. Модель хорошо работает с длинными текстами.

читать →
~1 мин 455 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

ReWorld: новый подход к обучению моделей автономного вождения

ReWorld — платформа для оптимизации представлений в моделях автономного вождения; улучшила качество генерации видео и производительность моделей на датасетах nuScenes и NAVSIM.

читать →
~1 мин 481 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый тест DMV-Bench: как проверить зрительную память ИИ-агентов

DMV-Bench — тест для оценки зрительной памяти ИИ-агентов на основе каталога товаров; архитектура DualMem превзошла другие мультимодальные системы.

читать →
~1 мин 444 просмотра
// еженедельный дайджест на email
темы:
// помочь проекту