DeepDigest
← все статьи
LLM

LLM

724 статьи по теме

Google AI Blog

Как поиск в Google поможет найти винтажные вещи

Инструменты Google помогут найти винтажные вещи и распорядиться вещами из своего гардероба. С помощью ИИ, Google Lens и других функций можно спланировать покупки, узнать больше о предмете, найти похожие товары и даже виртуально примерить одежду. Также Lens поможет оценить, какие вещи из вашего шкафа можно перепродать.

LLM
читать →
~2 мин 1617 просмотра
Google AI Blog

AMIE от Google: ИИ для долгосрочного управления заболеваниями

В журнале Nature вышло исследование системы AMIE от Google — ИИ для долгосрочного управления заболеваниями. Система сравнялась с врачами по общему подходу к лечению и превзошла их по точности планирования и согласованности рекомендаций. Сейчас идёт общенациональное исследование применения AMIE в виртуальной медицинской помощи.

LLM
читать →
~1 мин 2638 просмотра
Google DeepMind

Google: дорожная карта управления ИИ для безопасности агентов

Google представила дорожную карту управления ИИ, чтобы обеспечить безопасность агентов по мере роста их возможностей. Подход включает систему моделирования угроз на основе MITRE ATT&CK, средства контроля ИИ и измерение ключевых показателей производительности. Компания также опубликовала техническое руководство для разработчиков политики «Три уровня безопасности агентов».

читать →
~3 мин 2948 просмотра
Google DeepMind

Управляемое обучение с Gemini в Сьерра-Леоне: результаты исследования

Представлены результаты РКИ влияния управляемого обучения с Gemini на успеваемость школьников в Сьерра-Леоне. Учащиеся, использовавшие инструмент, улучшили показатели по математике: прирост составил +0,258 стандартных отклонений по сравнению с контрольной группой. Исследование также выявило высокую вовлечённость учеников и профессиональный рост учителей.

LLM
читать →
~2 мин 3087 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

LLM сталкиваются с трудностями при решении инженерных задач с диаграммами

Исследование показало: LLM хорошо решают текстовые инженерные задачи, но ошибаются при работе с диаграммами и многоэтапным анализом из‑за сложностей в рассуждениях.

читать →
~1 мин 1426 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Обучение на полезность может лишить ИИ сострадания: новое исследование

Обучение языковых моделей на полезность может снижать уровень сострадания и моральных рассуждений, тогда как обучение кодированию лучше сохраняет ценности. Исследование проведено на Llama 3.1 8B с критериями AHB и MORU.

читать →
~1 мин 2312 просмотра
Google Research

Ускорение Gemini Nano на Pixel с мультитокеновым прогнозированием

Google представила метод ускорения моделей Gemini Nano на устройствах Pixel — адаптацию прогнозирования с использованием нескольких токенов (MTP) к «замороженным» моделям Gemini Nano v3. Новая архитектура устраняет «узкое место» авторегрессивной генерации текста и оптимизирует использование памяти на мобильных устройствах. В экспериментах на Pixel 9 скорость работы выросла на 50 % и более.

LLM
читать →
~2 мин 3287 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Chisao: новый оптимизатор на GPU ускорит решение сложных задач

Chisao — оптимизатор на GPU для решения сложных задач оптимизации, работает параллельно и ускоряет вычисления в 34–39 раз. Доступен как открытый пакет Python.

читать →
~1 мин 1201 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Персонаж в чате влияет на отказ: новое открытие в работе ИИ-моделей

Учёные доказали: поведение ИИ-моделей (в т. ч. склонность к отказу) зависит от заданного образа персонажа; эксперименты с Qwen и Llama показали резкое снижение отказов при покладистом образе.

читать →
~1 мин 1857 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

AlgoEvolve: LLM научили совершенствовать торговые алгоритмы

Платформа AlgoEvolve с помощью LLM генерирует и улучшает торговые алгоритмы в виде Python‑кода, адаптируясь к рыночным условиям и превосходя человеческие разработки.

читать →
~1 мин 2188 просмотра
cs.LG
arXiv
Cornell University Library
arXiv cs.LG

Как оптимизировать генеративные состязательные сети: новый обзор методов

Анализ методов NAS для GAN: сравнение подходов, выявление преимуществ и ограничений, указание на важность новых показателей оценки и наборов данных.

читать →
~1 мин 974 просмотра
cs.CV
arXiv
Cornell University Library
arXiv cs.CV

DocArena: как превратить документы в обучающую среду для поисковых агентов

DocArena — система для создания обучающих сред из документов для агентов поиска; включает набор данных DocArena-79K и инфраструктуру Doc-Search agent; показывает высокие результаты в поиске и контроле качества.

читать →
~1 мин 1162 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Новый взгляд на оценку ИИ: что скрывается за максимальной точностью?

Авторы предложили оценивать ИИ-агентов не только по точности, но и по другим параметрам (надёжность, эффективность и др.), представив обновлённый тест CORE-Bench и выявив ускорение решения задач при взаимодействии человека и агента.

читать →
~1 мин 2167 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Новый метод борется с подхалимажем в языковых моделях

Разработан метод выявления и устранения подхалимажа в языковых моделях с помощью каскадных линейных функций — он эффективнее базовых подходов и требует меньше вычислений.

читать →
~1 мин 2071 просмотра
The Verge AI

Anthropic и Белый дом: конфликт из-за моделей Mythos и Fable

Компания Anthropic отключила модели Mythos после ультиматума администрации Трампа, требующего ограничить доступ к ним для неграждан США. Переговоры между Anthropic и властями продвигаются медленно из‑за отсутствия чёткой правовой базы для экспортного контроля ИИ-систем. Ситуация создаёт риски для американской индустрии ИИ и влияет на мировой рынок технологий.

читать →
~3 мин 1533 просмотра
TechCrunch AI

Amazon инвестирует 13 млрд долларов в ИИ и облачные технологии в Индии

Amazon планирует вложить 13 млрд долларов в развитие ИИ и облачных технологий в Индии до 2030 года. Инвестиции пойдут на расширение центров обработки данных AWS в Мумбаи и Хайдарабаде. Это часть волны вложений глобальных IT-компаний в индийскую инфраструктуру для продуктов искусственного интеллекта.

читать →
~2 мин 1515 просмотра
TechCrunch AI

Netris привлекла 15 млн долларов от a16z для работы с нео-облаками

Стартап Netris предлагает решение для ускорения запуска сервисов в нео-облаках — ПО и платформу для автоматизации настройки сетевых коммутаторов. Компания привлекла 15 млн долларов в раунде серии А от a16z. Её решения уже работают более чем на 35 графических кластерах по всему миру.

читать →
~3 мин 1509 просмотра
WIRED AI

Как отказаться от обучения ИИ на данных в Google Поиске

Google внедряет новые настройки конфиденциальности: мультимедийные данные пользователей могут использоваться для обучения моделей ИИ. Чтобы отказаться от участия, нужно снять флажок «Сохранить медиа» на странице «История поисковых сервисов». Эксперты отмечают, что такие изменения возлагают на пользователей дополнительную нагрузку по защите личных данных.

LLM
читать →
~2 мин 1532 просмотра