DeepDigest

// 50+ источников об ИИ в одном месте

Всё важное об ИИ — в одной ленте

▸ LIVE: Databricks: стоимость задачи важнее цены за токен в AI-моделях
@deepdigest
Статьи об ИИ в Telegram — подпишитесь
Подписаться →
@deepdigest · Макс
Статьи об ИИ в Макс — подпишитесь
Подписаться →
Дзен
deepdigest · Дзен
Статьи об ИИ в Яндекс Дзен — подпишитесь
Подписаться →
// самые читаемые
#1
Ускорение Gemini Nano на Pixel с мультитокеновым прогнозированием
3244 просм.
#2
Викторина по вводу-выводу 2026 от Google AI Studio
3131 просм.
#3
Конфиденциальные данные в эпоху ИИ: как классифицировать актив...
3107 просм.
#4
Управляемое обучение с Gemini в Сьерра-Леоне: результаты иссле...
3051 просм.
#5
Google: дорожная карта управления ИИ для безопасности агентов
2909 просм.

Контекстная инженерия в RAG: четыре фрагмента данных для ответа

Статья посвящена контекстной инженерии в RAG — подходу к сбору контекста для ответов LLM. Описана архитектура из четырёх блоков (анализ документов, анализ вопросов, поиск, генерация) и четыре фрагмента полезной нагрузки для одного документа. Подход позволяет оптимизировать затраты и упростить аудит работы системы.

LLM
читать →
~2 мин 295 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый подход к разреженному вниманию: интервал Фибоначчи даёт преимущество

Предложен новый метод разреженного внимания с интервалом Фибоначчи: статическое смещение слоя эффективнее других подходов, хотя и требует больше времени на тренировку.

читать →
~1 мин 423 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Новый взгляд на обучение нейросетей: как модели выбирают простые решения

Исследователи объяснили, почему глубокие нейросети с мономиальными активациями склонны упрощаться в процессе обучения — за счёт появления неактивных нейронов.

читать →
~1 мин 491 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

RADIANT-ПЭТ: ИИ помогает точнее выявлять поражения при ПЭТ/КТ

Фреймворк RADIANT-PET использует LLM и обучение с подкреплением для точной сегментации поражений при ПЭТ/КТ — лучше отсеивает ложные срабатывания и согласовывает прогнозы с клинической интерпретацией.

читать →
~1 мин 477 просмотра
Google DeepMind

Nano Banana 2 Lite и Gemini Omni Flash: новые инструменты от Google

Google выпустил модели Nano Banana 2 Lite для генерации изображений и Gemini Omni Flash для создания и редактирования видео. Первая отличается высокой скоростью и экономичностью, вторая позволяет комбинировать разные типы данных для работы с видео. Разработчики могут объединять модели в единый рабочий процесс.

читать →
~2 мин 745 просмотра
Analytics Vidhya

ChatGPT Plus, Claude Pro и Gemini Pro: сравнение подписок за 20 долларов

Сравнение подписок ChatGPT Plus, Claude Pro и Gemini Pro за 20 долларов в месяц. Каждая модель имеет свои сильные стороны: Claude хорош для написания текстов, ChatGPT — для изображений и безопасности, Gemini — для интеграции с сервисами Google и создания видео. Выбор зависит от конкретных задач пользователя.

LLM
читать →
~1 мин 262 просмотра

Как пройти поведенческое интервью для специалиста по обработке данных

Хейден Пеллетье даёт три совета, как пройти поведенческое интервью для специалиста по обработке данных: научиться рассказывать о бизнес‑ценности своей работы, заранее изучить особенности собеседований в конкретной компании и подготовить примеры ситуаций для ответов на вопросы. Для структурирования ответов рекомендуется использовать метод STAR.

читать →
~3 мин 286 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

VirtueMap: как оценить этические принципы больших языковых моделей

VirtueMap — структура для оценки LLM через призму аристотелевской этики: оценка ответов на этические дилеммы и формирование профилей моделей по добродетелям. Есть интерактивный сайт.

читать →
~1 мин 441 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый подход к анализу текстов: усреднённые SAE упрощают работу с длинными контекстами

Авторы предложили усреднённые по ходу движения SAE — метод, который упрощает анализ длинных текстов в языковых моделях, фиксируя характеристики фрагментов, а не отдельных токенов.

читать →
~1 мин 436 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

ModernBERT научился разбираться в юридических документах

ModernBERT адаптировали для юридической сферы — обучили на судебных решениях США. Модель лучше обрабатывает юридические тексты, работает с последовательностями до 8192 токенов. Модель выложена в открытый доступ.

читать →
~1 мин 464 просмотра
// еженедельный дайджест на email
темы:
// помочь проекту