DeepDigest
← все статьи
LLM

LLM

724 статьи по теме

Golem.de / KI

Claude 3: проверка следования заданным принципам

Anthropic изучила, насколько модель Claude 3 следует заданным ценностям и принципам в общении. Модель демонстрирует схожие базовые ценности на разных языках, при этом её ценности близки к западным. Исследование также показало, что Claude 3 следует правилам Constitutional AI, даже когда отвечает на арабском языке.

LLM
читать →
~1 мин 355 просмотра
TechNews / AI

Anthropic, OpenAI и Google против «дистилляции» AI-моделей

Anthropic, OpenAI и Google обвиняют конкурентов в масштабном использовании выходных данных их моделей («дистилляции») для создания более дешёвых решений. Это вскрыло противоречия в индустрии ИИ: ранее компании оправдывали сбор данных принципом «разумного использования», а теперь протестуют против аналогичного применения к своим моделям. Эксперты видят в ситуации игру в «кошки‑мышки».

LLM
читать →
~2 мин 318 просмотра
Google DeepMind

ATL Saathi: Gemini-приложение для учителей лабораторий Atal Tinkering

Atal Tinkering Labs запускает пилотную версию ATL Saathi — веб‑приложения на базе модели Gemini, которое должно помочь учителям лабораторий в планировании и обучении. Инструмент упрощает подбор контента и генерацию проектов, поддерживает несколько языков. Пилотный проект охватит 100 школ Индии.

читать →
~2 мин 557 просмотра
TechOrange

Harness Engineering: как обеспечить надёжную доставку AI-решений

Harness Engineering — это инженерная среда вокруг AI-модели, которая обеспечивает стабильное и безопасное внедрение AI в крупных проектах. Она включает пять элементов контроля: Context, Skills, Boundaries, Verification и Learning. Конкурентное преимущество будет у направляющих механизмов, а не у моделей.

читать →
~5 мин 244 просмотра
TechNews / AI

США ускоряют удаление продуктов Anthropic из военных систем

В США ускоряется процесс удаления продуктов Anthropic из военных систем: AFRL требует выполнить эту задачу до 1 сентября. Инициатива связана с заявлением министра обороны о рисках для нацбезопасности. При этом удаление продуктов компании осложняется сложностями в обнаружении скрытого кода и судебными разбирательствами.

читать →
~2 мин 344 просмотра
QbitAI

Unisonmind: демонстрация Physical AGI в Цинхуа

В Цинхуа университете показали возможности системы Unisonmind на примере робота-собаки «Сяо Тянь». Система демонстрирует Physical AGI: способна ориентироваться в пространстве, координировать действия людей и решать неожиданные задачи. Один и тот же когнитивный фундамент может работать на разных физических платформах.

читать →
~2 мин 339 просмотра
QbitAI

OpenAI: уход главы по безопасности и реорганизация после выпуска GPT-5.6

В OpenAI продолжается ротация кадров в отделе безопасности — недавно об уходе объявил Йоханнес Хайдеке, руководитель системы безопасности. Параллельно компания реорганизует команду безопасности и выпускает GPT-5.6, которая демонстрирует повышенные риски в работе с агентами и выполнении команд. Эксперты отмечают, что ускорение выпуска моделей создаёт сложности в обеспечении их безопасности.

читать →
~2 мин 309 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

AgentKGV: как проверить факты в графах знаний с помощью ИИ

Разработана система AgentKGV для проверки фактов в графах знаний. Метод включает динамическую маршрутизацию и двухэтапное обучение. На T-REx система улучшила macro-F1 на 5,5–9,4 п.п., сократив число запросов к поиску.

читать →
~2 мин 350 просмотра
QbitAI

GPT-5.6 Sol Ultra: решение 50‑летней математической гипотезы

Модель GPT-5.6 Sol Ultra за час доказала гипотезу о циклическом двойном покрытии — задачу, которая оставалась нерешённой 50 лет. Для решения задействовали 64 под-агента и особый подход к составлению промпта. OpenAI раскрыла принципы работы с моделью для решения сложных математических задач.

читать →
~4 мин 365 просмотра
TechNews / AI

Apple обвинила OpenAI в краже секретов, Маск подключился к спору

Apple обвинила OpenAI в использовании своих технологий при разработке AI‑устройств. Илон Маск прокомментировал ситуацию, высмеяв главу OpenAI. Также Маск рассказал о планах запустить спутники AI1 для AI‑вычислений.

читать →
~1 мин 354 просмотра
TechNews / AI

Исследование AI-призраков: опыт общения с симуляцией умерших

Учёные из Университета Колорадо исследовали опыт общения людей с AI-симуляциями умерших близких. Участники предпочли версию ИИ, говорящую от первого лица. При этом они терпимы к мелким фактическим ошибкам, но не допускают искажений в обращении. Исследователи опасаются риска зависимости и планируют оценить психологические последствия такого взаимодействия.

LLM
читать →
~2 мин 353 просмотра
TechNews / AI

Academic Humanizer от MorphMind: спор об удалении AI‑следов в научных работах

Компания MorphMind представила инструмент Academic Humanizer для удаления признаков написания текстов с помощью ИИ из научных работ. Инструмент вызвал споры в академической среде: его создатели говорят о помощи в чётком изложении мыслей, а критики опасаются, что он может маскировать некачественный контент. Также поднимается вопрос влияния ИИ на качество образования.

LLM
читать →
~2 мин 350 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Борьба со стереотипами в ИИ: неожиданный побочный эффект

Методы борьбы со стереотипами в NLP могут усиливать стереотипизацию других групп. Эффект замечен у разных моделей и стратегий обработки данных.

читать →
~1 мин 398 просмотра
Golem.de / KI

Claude Code от Anthropic получил встроенный браузер

Anthropic добавила во встроенный инструмент Claude Code браузер, позволяющий взаимодействовать с веб‑сайтами. Функция работает в песочнице, а пользователь сам решает, сохранять ли состояние браузера между задачами. Компания разграничивает встроенный браузер и расширение Claude для Chrome — каждое решение подходит для разных сценариев использования.

LLM
читать →
~1 мин 374 просмотра
TechNews / AI

Fidji Simo покидает OpenAI из‑за хронической болезни

Fidji Simo уходит из OpenAI с полной занятости и переходит на роль консультанта из‑за обострения хронической болезни. Ранее она отвечала за развёртывание AGI в компании. Сэм Альтман поблагодарил её за вклад в работу OpenAI.

читать →
~2 мин 375 просмотра
TechNews / AI

Хуан Жэньсюнь из NVIDIA: инженеры больше любят создавать AI-агенты, чем писать код

Хуан Жэньсюнь из NVIDIA заявил, что ИИ кардинально изменил работу инженеров: теперь они больше сосредоточены на создании AI-агентов, а не на написании кода. Он не согласен с мнением о том, что ИИ приведёт к массовой безработице, и считает, что эта технология создаст много новых рабочих мест. Хуан видит в распространении ИИ потенциал для реиндустриализации США.

читать →
~1 мин 378 просмотра
TechNews / AI

Anthropic: в Claude Code нашли уязвимость, Китай советует удалить

Китайский комитет по промышленности и информатизации предупредил о уязвимости в Claude Code от Anthropic — инструмент мог отправлять чувствительные данные без согласия пользователя. Представитель Anthropic объяснил, что это была экспериментальная функция для защиты модели от злоупотреблений. Компания ранее обвиняла китайские лаборатории в «дистилляции» модели.

LLM
читать →
~2 мин 371 просмотра
QbitAI

Joshua Achiam покидает OpenAI: уход главного футуролога компании

Joshua Achiam, главный футуролог OpenAI, объявил об уходе из компании 24 июля. Он проработал в OpenAI с 2017 года, занимался вопросами безопасности ИИ и возглавлял команду Mission Alignment. Его уход вписывается в ряд перестановок в команде безопасности компании за последние годы.

читать →
~3 мин 361 просмотра
TechNews / AI

DeepSeek разрабатывает собственный AI-чип, бросая вызов Huawei и Nvidia

DeepSeek разрабатывает собственный AI-чип для этапа инференса, чтобы снизить зависимость от Nvidia и Huawei. Проект находится на ранней стадии, но уже вызывает опасения у конкурентов. Компания привлекает крупные инвестиции для финансирования разработки.

читать →
~2 мин 348 просмотра
TechNews / AI

LinkedIn: снимки головы с ИИ популярны, но подлинность важнее

Репортёр Business Insider провела эксперимент в LinkedIn: разместила рядом реальное фото и изображение, сгенерированное ИИ, и попросила пользователей определить подлинность. Около двух третей участников предпочли фото с ИИ. LinkedIn разрешает использовать ИИ для редактирования снимков, но требует сохранять истинный облик. Эксперты считают, что подлинность важнее изысканности.

читать →
~2 мин 414 просмотра