DeepDigest

// 50+ источников об ИИ в одном месте

Всё важное об ИИ — в одной ленте

▸ LIVE: Nexuni и MIT Media Lab: решения для внедрения AI в промышленность
@deepdigest
Статьи об ИИ в Telegram — подпишитесь
Подписаться →
@deepdigest · Макс
Статьи об ИИ в Макс — подпишитесь
Подписаться →
Дзен
deepdigest · Дзен
Статьи об ИИ в Яндекс Дзен — подпишитесь
Подписаться →
// самые читаемые
#1
Ускорение Gemini Nano на Pixel с мультитокеновым прогнозированием
3262 просм.
#2
Викторина по вводу-выводу 2026 от Google AI Studio
3154 просм.
#3
Конфиденциальные данные в эпоху ИИ: как классифицировать актив...
3126 просм.
#4
Управляемое обучение с Gemini в Сьерра-Леоне: результаты иссле...
3073 просм.
#5
Google: дорожная карта управления ИИ для безопасности агентов
2932 просм.
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

PhyEditBench: новый тест для проверки «физического мышления» моделей редактирования фото

PhyEditBench — тест для оценки физического понимания моделей редактирования изображений. Включает 238 реальных и 35 синтетических примеров. Представлена программа PhyWorld, превосходящая аналоги.

читать →
~1 мин 1642 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

ForeAgent: агент, который учится распознавать поддельные ИИ‑изображения

ForeAgent — система для выявления поддельных ИИ‑изображений, которая постоянно учится и показывает высокую точность в тестах (до 93,3%)

читать →
~1 мин 1903 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

CRISP: новый способ проверить, насколько ИИ понимает пространство и образы

CRISP — метод оценки визуально‑пространственного интеллекта ИИ с помощью 3D‑графиков и протокола oracle, позволяющий отделить логическое мышление от проблем восприятия.

читать →
~1 мин 1151 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый метод создаёт длинные видеоролики: забывание и адаптация в деле

Разработана сеть FFN для обработки многочасовых видеороликов: модель адаптируется, работая всего с тремя кадрами, и использует новую метрику для оптимизации обработки. Создан датасет EpicTours (до 3 часов).

читать →
~1 мин 1619 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый метод борьбы с ошибками в мультимодальных ИИ-моделях

Система VIGIL улучшает связь между текстом и изображениями в мультимодальных ИИ-моделях, снижая число ошибок и галлюцинаций. Требует меньше данных, чем аналоги.

читать →
~1 мин 1162 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый метод отслеживания объектов: APRTrack справляется с искажениями в реальном мире

APRTrack — система для надёжного отслеживания объектов в сложных условиях (при искажениях и неполных данных), проверена на нескольких датасетах.

читать →
~1 мин 1548 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый метод найдёт метановые шлейфы на спутниковых снимках

Разработана мультимодальная модель для обнаружения метановых шлейфов на спутниковых снимках: она эффективнее аналогов и требует меньше ресурсов.

читать →
~1 мин 1376 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый метод изучает 3D‑физику по видео: прорыв в компьютерном зрении

Система изучает 3D‑физику по видео: переводит анализ из 2D в 3D, моделирует поведение объектов с учётом физических законов, успешно прошла тесты.

читать →
~1 мин 924 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

DinoLink: в 139 раз меньше данных — новое решение для связи автомобиля с инфраструктурой

DinoLink — платформа для сжатия данных в системах V2X: снижает объём передаваемой информации в 139 раз, сохраняет качество данных, ускоряет работу в узкополосных средах.

читать →
~1 мин 1795 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Тесты на Deepfake: почему они могут вводить в заблуждение?

Аудит тестов на Deepfake показал, что они могут не отражать реальные угрозы — универсальные модели приближаются по эффективности к специализированным детекторам.

читать →
~1 мин 1408 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

Новый набор данных и метрика помогут улучшить зрение подводных роботов

Создан набор данных TUB и метрика PCD для оценки потери информации в мутной подводной среде — это улучшит работу моделей компьютерного зрения.

читать →
~1 мин 2247 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

GeMoE: новый способ оптимизировать работу больших моделей VisionLanguage

GeMoE — метод адаптивной маршрутизации для моделей VisionLanguage на базе MoE: повышает эффективность использования ресурсов, сохраняя производительность и увеличивая частоту активации экспертов.

читать →
~1 мин 2292 просмотра
// еженедельный дайджест на email
темы:
// помочь проекту