DeepDigest

// 50+ источников об ИИ в одном месте

Всё важное об ИИ — в одной ленте

▸ LIVE: Nexuni и MIT Media Lab: решения для внедрения AI в промышленность
@deepdigest
Статьи об ИИ в Telegram — подпишитесь
Подписаться →
@deepdigest · Макс
Статьи об ИИ в Макс — подпишитесь
Подписаться →
Дзен
deepdigest · Дзен
Статьи об ИИ в Яндекс Дзен — подпишитесь
Подписаться →
// самые читаемые
#1
Ускорение Gemini Nano на Pixel с мультитокеновым прогнозированием
3262 просм.
#2
Викторина по вводу-выводу 2026 от Google AI Studio
3154 просм.
#3
Конфиденциальные данные в эпоху ИИ: как классифицировать актив...
3126 просм.
#4
Управляемое обучение с Gemini в Сьерра-Леоне: результаты иссле...
3073 просм.
#5
Google: дорожная карта управления ИИ для безопасности агентов
2932 просм.
TechNews / AI

PNG-изображения как инструмент атаки на AI-помощники для кода

Исследователи показали, что PNG-изображения могут использоваться для атак на AI-помощники для работы с кодом. Вредоносные инструкции, скрытые в изображениях, активируются позже и могут привести к утечке конфиденциальных данных. Уровень риска зависит от особенностей реализации AI-помощника, а не только от LLM.

читать →
~2 мин 318 просмотра
QbitAI

Unisonmind: демонстрация Physical AGI в Цинхуа

В Цинхуа университете показали возможности системы Unisonmind на примере робота-собаки «Сяо Тянь». Система демонстрирует Physical AGI: способна ориентироваться в пространстве, координировать действия людей и решать неожиданные задачи. Один и тот же когнитивный фундамент может работать на разных физических платформах.

читать →
~2 мин 334 просмотра
L Leiphone
Leiphone

Alipay и WeChat: шаг к коммерциализации ИИ-агентов в Китае

Alipay и WeChat делают шаги к коммерциализации ИИ‑агентов в Китае. За последние три месяца обе платформы запустили ряд продуктов и сервисов с использованием искусственного интеллекта. Эксперты считают, что текущий год может стать первым годом коммерциализации агентов.

читать →
~3 мин 422 просмотра
Leiphone

RoboBrain Orca: ИИ прогнозирует следующее состояние мира

RoboBrain Orca — мультимодальная модель, которая формирует представление о состоянии мира и моделирует его эволюцию. Она обрабатывает разные типы данных (текст, изображения, видео) и учится на неосознанном и сознательном опыте. Модель использует 125 000 часов видео и 160 млн аннотаций к событиям и может стать основой для сложных когнитивных систем.

читать →
~2 мин 368 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Система предскажет фейковые новости и вспышки насилия: мультимодальный подход

Мультимодальная система на базе XLM-RoBERTa и CLIP с точностью 98 % выявляет фейковые новости и признаки насилия, учитывая текст, изображения и геоданные.

читать →
~1 мин 373 просмотра
Leiphone

Agentic от Volcano Engine: новая система оптимизации качества видео

Система Agentic от Volcano Engine оптимизирует качество видео с помощью агентной системы, заменяя человеческий конвейер постобработки. Она учитывает разные типы видео и их требования, используя модели оценки восприятия и набор инструментов для обработки. Ключевой оператор GenVR нацелен на охват различных типов контента и снижение затрат на моделирование сцен.

читать →
~4 мин 380 просмотра

VLM-модели: как работают GPT-4o, Gemini, Claude Vision и Qwen-VL

Современные модели Vision Language (VLM) объединяют понимание визуального контента и языка. Модели GPT-4o, Gemini, Claude Vision и Qwen-VL применяются в разных сферах — от образования до автоматизации. Они способны анализировать изображения, документы, диаграммы, вести мультимодальные диалоги, но имеют ограничения — например, могут пропускать детали или давать неверные ответы.

читать →
~2 мин 245 просмотра
QbitAI

Физический ИИ, как сказал Вонг Ин Хун, был введен в лабораторию наук о жизни этим китайским трансграничным игроком

Китайская компания Da Chi-Son запустила в Шанхае лабораторию искусственного интеллекта и представила системы ProtoPilot и BioLab Bench для проведения экспериментов в области наук о жизни. В статье также рассматривается проблема интеграции ИИ в лабораторные процессы и роль крупных игроков из Кремниевой долины в этой сфере.

читать →
~18 мин 452 просмотра
Leiphone

Vidu S1, который подталкивает поколение видео к новой эре взаимодействия в реальном времени

Компания Biotech запустила модель Vidu S1 для интерактивных видеосценариев в реальном времени. Модель позволяет генерировать видео нового поколения с возможностью непрерывного взаимодействия, включая голосовое управление и видеозвонки.

читать →
~10 мин 413 просмотра
QbitAI

Карта записи Dingding A1 отмечена в отчёте Gartner о носимых ИИ-устройствах

Gartner включила карту записи Dingding A1 в отчёт о носимых устройствах с ИИ. Устройство помогает сотрудникам эффективно записывать информацию и получать аналитические данные в реальном времени. Ключевое отличие Dingding A1 — тесная интеграция с корпоративным суперприложением Dingding.

читать →
~2 мин 472 просмотра
Leiphone

AI MediaKit от Volcano Engine: автоматизация создания видеоконтента

AI MediaKit от Volcano Engine автоматизирует создание и обработку аудио- и видеоконтента с помощью агентов. Набор инструментов объединяет множество функций (более 100) для редактирования, улучшения качества, транскодирования и других задач. Концепция «подключи и играй» упрощает разработку приложений и позволяет агентам эффективно выполнять рабочие процессы — от понимания контента до его доставки на платформы.

читать →
~4 мин 427 просмотра
ITmedia AI+

Sakana Fugu: Sakana AI использует Google Cloud для мультиагентной системы

Sakana AI создала мультиагентную систему Sakana Fugu на базе платформы Gemini Enterprise Agent Platform от Google Cloud. Система включает три слоя и объединяет несколько моделей ИИ. По заявлению разработчиков, версия Fugu Ultra в некоторых задачах превосходит американские модели Claude Mythos Preview и Claude Fable 5.

читать →
~2 мин 426 просмотра
// еженедельный дайджест на email
темы:
// помочь проекту