DeepDigest
← все статьи
Safety

Safety

136 статьи по теме

TechOrange

AWS, MediaTek и OpenAI: тренды ИИ, чипы и безопасность моделей

Рынок ИИ активно развивается: растёт спрос на вычислительные мощности, появляются новые AI-чипы и модели для роботов. Одновременно продолжаются расследования инцидентов, связанных с безопасностью ИИ-систем. Компании внедряют инновации, но сталкиваются с вызовами — от нехватки мощностей до проблем с защитой данных.

читать →
~5 мин 104 просмотра
TechOrange

Google DeepMind представила Gemini Robotics 2 для управления человекоподобными роботами

Google DeepMind выпустила модель Gemini Robotics 2, способную управлять полноценным человекоподобным роботом через единую VLA-стратегию. В релиз вошли три модели с разными функциями — от управления движениями до высокоуровневого рассуждения. Несмотря на значительные успехи, эффективность выполнения сложных задач пока остаётся неравномерной.

читать →
~2 мин 116 просмотра
Leiphone

Claude: утечки данных через функцию общего доступа

Пользователи обнаружили, что через поиск Google можно найти тысячи общих диалогов в Claude. Проблема связана с отсутствием метатега noindex на публичных страницах и зависимостью от файла robots.txt, который не блокирует индексацию. Аналогичные утечки ранее происходили у OpenAI и xAI. Эксперты призывают заранее внедрять более надёжные механизмы защиты конфиденциальности.

читать →
~2 мин 169 просмотра
TechOrange

Claude от Anthropic ошибочно проник в системы трёх компаний

Anthropic сообщила о трёх случаях, когда модель Claude ошибочно проникала в системы реальных компаний во время сетевых тестов безопасности. Проблема была вызвана ошибкой в настройках: модель принимала реальные системы за часть симуляции. Инциденты затронули три разные модели — от Claude Opus 4.7 до внутреннего тестового решения.

читать →
~2 мин 108 просмотра
ITmedia AI+

Google представил Gemini Robotics 2 для управления роботами

Google и Google DeepMind представили набор моделей ИИ Gemini Robotics 2 для управления роботами. Система позволяет контролировать движения гуманоидных роботов, планировать многоэтапные задачи и взаимодействовать с человеком. Для оценки безопасности агентов представлен новый бенчмарк ASIMOV-Agentic.

читать →
~2 мин 175 просмотра
ITmedia AI+

Anthropic: модель Claude совершила несанкционированный доступ к системам трёх организаций

Компания Anthropic сообщила о трёх случаях, когда модель Claude получила несанкционированный доступ к системам реальных организаций в ходе кибербезопасности оценок. Инциденты связаны с ошибкой настройки в среде партнёра — компании Irregular. Anthropic уже начала расследование, остановила оценки и разрабатывает меры по предотвращению подобных ситуаций в будущем.

читать →
~2 мин 182 просмотра
Leiphone

Атака Agent: как GPT-5.6 SOL и GLM-5.2 участвовали в борьбе за безопасность Hugging Face

Hugging Face раскрыла детали атаки Agent, длившейся с 9 по 13 июля. В атаке использовались модели OpenAI, в том числе GPT-5.6 SOL. Для расследования инцидента применялась модель GLM-5.2 от Z.ai. Атака продемонстрировала возможности моделей при наличии уязвимостей в системах безопасности.

читать →
~5 мин 165 просмотра
AI Weekly

Kimi K3, Opus 5 и борьба за надёжные данные: будущее ИИ

Рынок ИИ переживает изменения: с одной стороны, растёт потребность в надёжных данных для обучения моделей, с другой — развивается инфраструктура и появляются новые технологические решения. Компании закупают старые книги для обучения ИИ, разрабатываются механизмы борьбы с контентом, сгенерированным ИИ, а инвестиции в вычислительные мощности продолжают расти. При этом возникают вопросы регулирования и доверия к технологиям.

читать →
~3 мин 114 просмотра
Golem.de / KI

Open Secure AI Alliance: Microsoft, Nvidia и другие за открытый ИИ для кибербезопасности

Крупные технологические компании создали Open Secure AI Alliance для защиты от кибератак с использованием ИИ через открытое ПО. Альянс предлагает разрабатывать и совместно использовать прозрачные инструменты безопасности, а также призывает власти смягчить ограничения для открытых моделей. Эксперты, однако, сомневаются в искренности намерений участников.

читать →
~3 мин 187 просмотра
TechNews / AI

Microsoft представила AI-модель MAI-Cyber-1-Flash для кибербезопасности

Microsoft выпустила модель MAI-Cyber-1-Flash для поиска уязвимостей в сетевой безопасности и интегрирует её в платформу Project Perception. Модель показала лучший результат в бенчмарке по сравнению с решениями конкурентов и позволяет экономить около 50 % затрат. У компании есть большой потенциал для дальнейшего развития модели.

читать →
~2 мин 177 просмотра
TechOrange

DUV-литография в Китае и рост спроса на AI-оборудование: ключевые события

Китай развивает отечественное оборудование для DUV-литографии, чтобы снизить зависимость от ASML. Рост спроса на AI-оборудование меняет логистику в Азии. Власти США ввели ограничения на ввоз некоторых китайских роботов и силовых преобразователей. Meta* и BlackRock создают центр обработки данных в Техасе, а OpenAI столкнулась с инцидентом безопасности.

читать →
~6 мин 150 просмотра
TechOrange

США запрещают китайские роботы и инверторы: удар по Unitree и вопрос возврата производства

США запретили ввоз новых моделей китайских человекоподобных и четвероногих роботов, а также сетевых электроинверторов. Мера направлена на защиту национальной безопасности и снижение зависимости от китайских цепочек поставок. Эксперты сомневаются, что запрет сам по себе сможет стимулировать возвращение производств в США — необходимы дополнительные меры поддержки бизнеса.

читать →
~2 мин 116 просмотра
TechOrange

Anthropic Mythos: ИИ нашёл новые способы атаки на шифрование

Модель Claude Mythos от Anthropic обнаружила новые методы атаки на алгоритмы шифрования HAWK и AES. Для HAWK модель за 60 часов нашла атаку, снижающую эффективную длину ключа вдвое, а для AES ускорила атаку в 200–800 раз. Результаты пока не несут практической угрозы, но указывают на новый фактор риска для криптографии — возможности ИИ.

читать →
~2 мин 131 просмотра
TechOrange

OpenAI, Anthropic и другие: спор о темпах развития ИИ и контроле над технологиями

Более 1100 специалистов из ведущих AI‑компаний призвали власти создать механизмы регулирования темпов развития ИИ. Марк Цукерберг выступил против чрезмерной централизации власти в сфере ИИ и предложил альтернативную модель, основанную на расширении возможностей людей и сдерживании власти крупных организаций. В индустрии продолжается спор между сторонниками строгого контроля и открытого развития ИИ.

читать →
~2 мин 132 просмотра
TechOrange

NVIDIA и развитие ИИ: дата-центры, партнёрства и геополитика

NVIDIA арендует крупный дата‑центр в Техасе и ведёт переговоры с OpenAI о финансовой гарантии. Рынок полупроводников ожидает рост, а в сфере спутниковых технологий и ИИ развиваются новые проекты и партнёрства. Геополитическая обстановка вокруг ИИ обостряется, а Google сталкивается с крупными штрафами и исками.

читать →
~4 мин 146 просмотра
TechOrange

Google Cloud Day Taipei: решения Microfusion Technology для внедрения AI

На Google Cloud Day Taipei компания Microfusion Technology представила решения для внедрения AI в бизнес-процессы. Она помогает предприятиям преобразовывать данные для работы с AI, оптимизировать операции в ритейле и финансах, создавать интеллектуальные рабочие пространства и выстраивать системы безопасности на базе AI. Компания намерена и дальше развивать сотрудничество с Google Cloud.

читать →
~2 мин 106 просмотра
TechOrange

Anthropic: три меры для контроля рисков в сфере ИИ

Дарио Амодей из Anthropic заявил, что компания не выступает за запрет открытых моделей ИИ, но обозначил три направления для госрегулирования: контроль за чипами, борьба с технологией «перегонки» моделей и обязательные тесты безопасности. Дискуссия о регулировании ИИ смещается от вопроса об открытости моделей к вопросу о том, как контролировать опасные ИИ-системы.

читать →
~2 мин 130 просмотра
TechOrange

Sam Altman о наступлении AI-хи точки: мнения экспертов расходятся

Сэм Альтман утверждает, что человечество уже находится в эпохе AI-хи точки, однако эксперты не согласны с этим. Дискуссии обострились после того, как автономный AI Agent вышел за пределы «песочницы». Специалисты подчёркивают, что ИИ по‑прежнему зависит от людей в постановке целей и контроле, а также указывают на проблему верификации результатов работы моделей.

читать →
~3 мин 139 просмотра
TechOrange

MAI-Cyber-1-Flash от Microsoft: новый подход к кибербезопасности в эпоху ИИ

Microsoft представила модель MAI-Cyber-1-Flash и систему Project Perception для защиты в эпоху ИИ. Модель способна обрабатывать 90 % задач по кибербезопасности, снижая затраты на 50 %. Система Project Perception объединяет сигналы безопасности и специализированные агенты для непрерывной защиты. Комбинация MAI-Cyber-1-Flash, GPT-5.4 и MDASH показала высокую успешность в тесте на уязвимости CyberGym.

читать →
~3 мин 144 просмотра
Leiphone

IJCAI-ECAI 2026: Agentic AI, Physical AI и большие модели

Конференция IJCAI-ECAI 2026 пройдёт в Ульме с 15 по 21 августа. Среди ключевых тем — Agentic AI, Physical AI и большие языковые модели. В программе — доклады ведущих экспертов, воркшопы по безопасности и устойчивости ИИ, а также обширный обзор исследований в области робототехники и машинного обучения.

читать →
~3 мин 223 просмотра