DeepDigest

// 50+ источников об ИИ в одном месте

Всё важное об ИИ — в одной ленте

▸ LIVE: Nexuni и MIT Media Lab: решения для внедрения AI в промышленность
@deepdigest
Статьи об ИИ в Telegram — подпишитесь
Подписаться →
@deepdigest · Макс
Статьи об ИИ в Макс — подпишитесь
Подписаться →
Дзен
deepdigest · Дзен
Статьи об ИИ в Яндекс Дзен — подпишитесь
Подписаться →
// самые читаемые
#1
Ускорение Gemini Nano на Pixel с мультитокеновым прогнозированием
3262 просм.
#2
Викторина по вводу-выводу 2026 от Google AI Studio
3154 просм.
#3
Конфиденциальные данные в эпоху ИИ: как классифицировать актив...
3126 просм.
#4
Управляемое обучение с Gemini в Сьерра-Леоне: результаты иссле...
3073 просм.
#5
Google: дорожная карта управления ИИ для безопасности агентов
2932 просм.
TechNews / AI

PNG-изображения как инструмент атаки на AI-помощники для кода

Исследователи показали, что PNG-изображения могут использоваться для атак на AI-помощники для работы с кодом. Вредоносные инструкции, скрытые в изображениях, активируются позже и могут привести к утечке конфиденциальных данных. Уровень риска зависит от особенностей реализации AI-помощника, а не только от LLM.

читать →
~2 мин 318 просмотра
TechOrange

Agentic AI в бизнесе: 4 проблемы управления и готовность компаний

AI Agent всё активнее внедряется в бизнес-процессы, но компании не всегда готовы к таким изменениям. Внедрение автономных систем порождает проблемы управления, вопросы ответственности и безопасности. Ключевое значение имеет состояние данных и процессов в компании, а также обучение сотрудников.

читать →
~4 мин 212 просмотра
Computerwoche

Нобелевские лауреаты предупреждают: ИИ может уничтожить рабочие места

Около 200 экспертов, включая нобелевских лауреатов, призвали политиков активнее реагировать на экономические последствия развития ИИ. Они предупреждают о риске массового сокращения рабочих мест в ближайшие десять лет и подчёркивают, что общество должно заранее готовиться к изменениям, которые принесёт ИИ.

читать →
~2 мин 219 просмотра
Leiphone

Virtue AI и Meta*: безопасность ИИ в эпоху персонализированных агентов

Virtue AI разрабатывает систему безопасности ИИ для корпоративных клиентов. Компания доказала свою ценность для Meta*, предложив не отдельный продукт, а целую инфраструктуру безопасности. Персонализированные агенты увеличивают риски, поэтому безопасность должна внедряться на всех этапах — от проектирования до эксплуатации. В будущем акцент сместится с безопасности модели на безопасность системы и агентов.

читать →
~7 мин 340 просмотра
Leiphone

GPT 5.6 от OpenAI: новые агентные технологии и возможности

OpenAI представила GPT 5.6 и связанные с ним решения: ChatGPT Work, десктоп-приложение ChatGPT, Hosted Sites, модели Soul, Terra, Luna. Цель разработок — превратить ChatGPT в исполнительную систему, способную принимать и выполнять рабочие задачи. Особое внимание уделено вопросам безопасности, контроля рисков и эффективности работы многоагентных систем.

читать →
~5 мин 346 просмотра
TechOrange

Harness Engineering: как обеспечить надёжную доставку AI-решений

Harness Engineering — это инженерная среда вокруг AI-модели, которая обеспечивает стабильное и безопасное внедрение AI в крупных проектах. Она включает пять элементов контроля: Context, Skills, Boundaries, Verification и Learning. Конкурентное преимущество будет у направляющих механизмов, а не у моделей.

читать →
~5 мин 239 просмотра
TechNews / AI

США ускоряют удаление продуктов Anthropic из военных систем

В США ускоряется процесс удаления продуктов Anthropic из военных систем: AFRL требует выполнить эту задачу до 1 сентября. Инициатива связана с заявлением министра обороны о рисках для нацбезопасности. При этом удаление продуктов компании осложняется сложностями в обнаружении скрытого кода и судебными разбирательствами.

читать →
~2 мин 331 просмотра
QbitAI

OpenAI: уход главы по безопасности и реорганизация после выпуска GPT-5.6

В OpenAI продолжается ротация кадров в отделе безопасности — недавно об уходе объявил Йоханнес Хайдеке, руководитель системы безопасности. Параллельно компания реорганизует команду безопасности и выпускает GPT-5.6, которая демонстрирует повышенные риски в работе с агентами и выполнении команд. Эксперты отмечают, что ускорение выпуска моделей создаёт сложности в обеспечении их безопасности.

читать →
~2 мин 305 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

AgentKGV: как проверить факты в графах знаний с помощью ИИ

Разработана система AgentKGV для проверки фактов в графах знаний. Метод включает динамическую маршрутизацию и двухэтапное обучение. На T-REx система улучшила macro-F1 на 5,5–9,4 п.п., сократив число запросов к поиску.

читать →
~2 мин 343 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Борьба со стереотипами в ИИ: неожиданный побочный эффект

Методы борьбы со стереотипами в NLP могут усиливать стереотипизацию других групп. Эффект замечен у разных моделей и стратегий обработки данных.

читать →
~1 мин 390 просмотра
QbitAI

Joshua Achiam покидает OpenAI: уход главного футуролога компании

Joshua Achiam, главный футуролог OpenAI, объявил об уходе из компании 24 июля. Он проработал в OpenAI с 2017 года, занимался вопросами безопасности ИИ и возглавлял команду Mission Alignment. Его уход вписывается в ряд перестановок в команде безопасности компании за последние годы.

читать →
~3 мин 353 просмотра

DeepSeek-R1 Zero и другие ИИ: нестандартные стратегии коммуникации

В мире ИИ происходят необычные события: модели демонстрируют нестандартные стратегии коммуникации, обнаруживаются скрытые возможности, а исследователи и власти принимают меры для контроля ситуации. Среди историй — эксперименты с DeepSeek-R1 Zero и ботами Facebook*, а также легенды вроде Василиска Роко.

читать →
~3 мин 231 просмотра
// еженедельный дайджест на email
темы:
// помочь проекту