DeepDigest

// 50+ источников об ИИ в одном месте

Всё важное об ИИ — в одной ленте

▸ LIVE: Nexuni и MIT Media Lab: решения для внедрения AI в промышленность
@deepdigest
Статьи об ИИ в Telegram — подпишитесь
Подписаться →
@deepdigest · Макс
Статьи об ИИ в Макс — подпишитесь
Подписаться →
Дзен
deepdigest · Дзен
Статьи об ИИ в Яндекс Дзен — подпишитесь
Подписаться →
// самые читаемые
#1
Ускорение Gemini Nano на Pixel с мультитокеновым прогнозированием
3262 просм.
#2
Викторина по вводу-выводу 2026 от Google AI Studio
3154 просм.
#3
Конфиденциальные данные в эпоху ИИ: как классифицировать актив...
3126 просм.
#4
Управляемое обучение с Gemini в Сьерра-Леоне: результаты иссле...
3073 просм.
#5
Google: дорожная карта управления ИИ для безопасности агентов
2932 просм.
Leiphone

Vivo X Fold6: складной экран для «телефона-агента»

Vivo готовит к выпуску модель X Fold6 со складным экраном — она должна стать «телефоном-агентом», активно понимающим потребности пользователя. Компания внедряет новые функции на базе ИИ для многозадачности и работы с данными. При общем падении рынка смартфонов сегмент складных устройств демонстрирует рост.

читать →
~2 мин 443 просмотра
Leiphone

Vivo X Fold6: складной флагман с ИИ-функциями

Vivo выпустила складной флагман X Fold6 с расширенными возможностями ИИ. Устройство оснащено системой OriginOS 6Fold и функцией Atomic workbench для работы с многозадачностью на большом экране. Среди других особенностей — мощный чип Blue Crystal× DNT 9500 Super Edition, ИИ-менеджер файлов и ассистент для конференций.

читать →
~3 мин 474 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый взгляд на взаимодействие зрения и языка в ИИ: систематизированный обзор мультимодальных моделей

Авторы представили систематический обзор объединения зрительного восприятия и языкового мышления в MLLM, ввели пятиэтапную таксономию и обозначили перспективы создания унифицированного мультимодального интеллекта.

читать →
~1 мин 1229 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

ИИ для языков с ограниченными ресурсами: новый подход на основе WordNet

Разработан метод создания диалоговых ИИ‑систем для языков с ограниченными ресурсами на базе WordNet: преобразовали Hindi WordNet в 1,25 млн пар «инструкция‑ответ», настроили языковую модель — эффективность достигла 91,0.

читать →
~1 мин 1264 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Эмоциональные аватары на языке жестов: новый способ общения на непальском

Создан мультимодальный фреймворк NEST-V1: он превращает непальские слова в жесты аватаров с учётом эмоций. Точность распознавания речи — 81,1%, эмоций — 79,21%.

читать →
~1 мин 1480 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый метод найдёт метановые шлейфы на спутниковых снимках

Разработана мультимодальная модель для обнаружения метановых шлейфов на спутниковых снимках: она эффективнее аналогов и требует меньше ресурсов.

читать →
~1 мин 1376 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

DinoLink: в 139 раз меньше данных — новое решение для связи автомобиля с инфраструктурой

DinoLink — платформа для сжатия данных в системах V2X: снижает объём передаваемой информации в 139 раз, сохраняет качество данных, ускоряет работу в узкополосных средах.

читать →
~1 мин 1795 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Пробелы в оценке мультимодальных ИИ: что мешает оценить реальные возможности моделей?

Исследование выявило пробелы в оценке мультимодальных ИИ-моделей (MLLM): нынешние методы не показывают, как модели объединяют данные из разных источников (текст, фото, аудио и др.).

читать →
~1 мин 1772 просмотра

Apple представила третье поколение моделей Apple Foundation Models

Apple представила третье поколение моделей Apple Foundation Models — семейство из пяти моделей для устройств и облачных вычислений. В него входят встроенные и серверные модели с мультимодальными возможностями. Архитектура моделей позволяет преодолевать ограничения по объёму памяти и обеспечивать конфиденциальность данных.

читать →
~3 мин 1316 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

COrigami: ИИ поможет создать узнаваемое оригами

Система COrigami на базе ИИ создаёт шаблоны оригами по текстовому описанию, объединяя алгоритмическую оптимизацию и эстетическую оценку — помощник для художников в проектировании сложных форм.

читать →
~1 мин 1832 просмотра
Google AI Blog

Google I/O 2026: главные новинки — от Gemini до интеллектуальных очков

На Google I/O 2026 компания представила новые модели ИИ (Gemini Omni, Gemini 3.5 Flash), информационных агентов в поиске, обновлённый интерфейс Gemini (Neural Expressive), персонального ИИ‑агента Gemini Spark и другие разработки. Среди новинок — ежедневная сводка в приложении Gemini, универсальная корзина покупок и интеллектуальные очки для Android XR.

читать →
~3 мин 1646 просмотра
// еженедельный дайджест на email
темы:
// помочь проекту