DeepDigest

// 50+ источников об ИИ в одном месте

Всё важное об ИИ — в одной ленте

▸ LIVE: Nexuni и MIT Media Lab: решения для внедрения AI в промышленность
@deepdigest
Статьи об ИИ в Telegram — подпишитесь
Подписаться →
@deepdigest · Макс
Статьи об ИИ в Макс — подпишитесь
Подписаться →
Дзен
deepdigest · Дзен
Статьи об ИИ в Яндекс Дзен — подпишитесь
Подписаться →
// самые читаемые
#1
Ускорение Gemini Nano на Pixel с мультитокеновым прогнозированием
3262 просм.
#2
Викторина по вводу-выводу 2026 от Google AI Studio
3154 просм.
#3
Конфиденциальные данные в эпоху ИИ: как классифицировать актив...
3126 просм.
#4
Управляемое обучение с Gemini в Сьерра-Леоне: результаты иссле...
3073 просм.
#5
Google: дорожная карта управления ИИ для безопасности агентов
2932 просм.
Leiphone

MVA: как видеомодели помогут роботам действовать

Ли Фэйфэй и Илун Ду работают над методом MVA, который позволяет роботам использовать видеомодели для управления действиями. Метод преобразует действия в пиксельные маскированные траектории и выполняет прямое и обратное преобразование. Микронастройка на 15 часах данных позволяет роботам переходить от управления одной рукой к управлению двойной рукой.

читать →
~5 мин 120 просмотра
Leiphone

Huawei на IJCAI 2026: переход к плотности проектирования в AI

Huawei представила на IJCAI 2026 ряд технических решений, отражающих переход от «плотности масштаба» к «плотности проектирования» в AI. Среди разработок — увеличение масштаба иерархического ViT до 30 млрд параметров, метод LFS для оптимизации обработки видео и фреймворк RaMod для улучшения работы больших языковых моделей. Метод перевода речи с переключением кодов превзошёл существующие решения.

читать →
~4 мин 75 просмотра

PRISM2 от Microsoft и Tempus: ИИ для патологии

Модель PRISM2, разработанная Microsoft Research и Tempus, — это фундаментальная модель для патологии, обученная на изображениях тканей и текстовых данных из отчётов. В тестах она показала эффективность в обнаружении разных видов рака без необходимости создавать отдельные модели для каждой задачи. Подход PRISM2 связывает визуальные данные с диагностическим языком.

читать →
~2 мин 175 просмотра
TechOrange

Sony и Mitsubishi Electric: совместный проект в сфере физического ИИ

Sony и Mitsubishi Electric создадут совместное предприятие для разработки решений в сфере физического ИИ, нацеленных на автоматизацию производств. Система позволит анализировать визуальные данные на уровне сенсоров и интегрировать их с другими производственными данными. Проект призван помочь компаниям внедрять автоматизацию без глубоких знаний в области оптики и ИИ.

читать →
~2 мин 157 просмотра
TechNews / AI

LinkedIn: снимки головы с ИИ популярны, но подлинность важнее

Репортёр Business Insider провела эксперимент в LinkedIn: разместила рядом реальное фото и изображение, сгенерированное ИИ, и попросила пользователей определить подлинность. Около двух третей участников предпочли фото с ИИ. LinkedIn разрешает использовать ИИ для редактирования снимков, но требует сохранять истинный облик. Эксперты считают, что подлинность важнее изысканности.

читать →
~2 мин 407 просмотра

VLM-модели: как работают GPT-4o, Gemini, Claude Vision и Qwen-VL

Современные модели Vision Language (VLM) объединяют понимание визуального контента и языка. Модели GPT-4o, Gemini, Claude Vision и Qwen-VL применяются в разных сферах — от образования до автоматизации. Они способны анализировать изображения, документы, диаграммы, вести мультимодальные диалоги, но имеют ограничения — например, могут пропускать детали или давать неверные ответы.

читать →
~2 мин 245 просмотра
Computerwoche

11 инструментов с открытым исходным кодом для разработчиков

Статья представляет 11 инструментов с открытым исходным кодом в области ИИ, которые помогают разработчикам упростить создание программного обеспечения — от оптимизации изображений до автоматизации повседневных задач.

читать →
~8 мин 281 просмотра

Творческая генерация изображений, которая удаляет «Икири» с помощью модели

Предложен новый метод креативной генерации изображений с использованием диффузионных моделей, позволяющий получать редкие и оригинальные визуальные результаты за счёт вычисления распределения вероятностей сгенерированных изображений. Метод демонстрирует эффективность в создании новаторского визуального контента.

читать →
~28 мин 261 просмотра
Leiphone

Vidu S1, который подталкивает поколение видео к новой эре взаимодействия в реальном времени

Компания Biotech запустила модель Vidu S1 для интерактивных видеосценариев в реальном времени. Модель позволяет генерировать видео нового поколения с возможностью непрерывного взаимодействия, включая голосовое управление и видеозвонки.

читать →
~10 мин 413 просмотра
Computerwoche

19 способов дать новую жизнь старым устройствам Android

Старые устройства Android часто выбрасывают, хотя им можно найти применение. В статье — 19 идей, как использовать вышедшие из эксплуатации смартфоны и планшеты: от трекпада и камеры видеонаблюдения до навигационной системы и цифрового календаря. Среди вариантов — участие в научных исследованиях, создание медиасервера или использование устройства как инструмента для обучения детей.

читать →
~4 мин 276 просмотра

Выставка выпускников BAIR 2026 года: достижения в ИИ

В Беркли прошла выставка выпускников BAIR 2026 года. Аспиранты представили результаты исследований в разных областях ИИ — от робототехники и компьютерного зрения до безопасности ИИ и взаимодействия человека и машины. Выпускники уже влияют на индустрию, работая в лабораториях, стартапах и крупных компаниях.

читать →
~7 мин 444 просмотра
// еженедельный дайджест на email
темы:
// помочь проекту