DeepDigest
← все статьи
LLM

LLM

724 статьи по теме

Leiphone

Anthropic и OpenAI на треке AI4S: новые инструменты и бенчмарки

Anthropic и OpenAI одновременно представили новые решения на треке AI4S: Claude Science и GeneBench-Pro соответственно. Компании выбрали разные подходы к развитию ИИ в научных исследованиях: Anthropic делает ставку на интеграцию существующих инструментов, а OpenAI — на стандартизацию и оценку. В борьбу также включился Google DeepMind со своими научными моделями. Рынок остаётся в стадии открытой конкуренции.

читать →
~5 мин 449 просмотра
TechOrange

Anthropic: США сняли ограничения на модели Fable 5 и Mythos 5

Правительство США сняло ограничения на модели ИИ Anthropic Fable 5 и Mythos 5. Исследование TrendForce показало, что спрос на ИИ меняет распределение мощностей литейного производства. Тайвань планирует создать центр вычислительной мощности ИИ с инвестициями свыше 100 млрд новозеландских долларов и предоставить более 20 000 графических процессоров. Apple скорректирует стратегию обновления системы безопасности из‑за ускорения разработки вредоносных инструментов с помощью генеративного ИИ.

читать →
~4 мин 298 просмотра
LangChain Blog

Бенчмаркинг извлечения данных: тестирование LLM на наборе данных LangChain

Опубликован новый набор данных для извлечения информации из журналов чата — он помогает тестировать LLM на распространённые проблемы при разработке диалоговых приложений. Проведены эксперименты с моделями GPT-4, Claude-2, Llama и Yi: оценивались различные стратегии подсказок и методы структурированного декодирования. Наилучшие результаты по корректности JSON показала модель Llama 70B при использовании декодирования на основе грамматики.

LLM
читать →
~6 мин 448 просмотра
Leiphone

HiDream-O1-Image: инновации в архитектуре UiT и неоднозначные результаты

Модель HiDream-O1-Image от Zhixiang Future с архитектурой UiT демонстрирует высокую производительность в ряде сценариев, сравнимую с моделями с 27 млрд параметров при использовании 8 млрд. Однако у неё есть существенные ограничения — от проблем с пониманием контекста до слабой зрелости экосистемы. Главное достижение модели — подтверждение перспектив архитектуры UiT.

LLM
читать →
~2 мин 468 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый тест Indi-RomCoM выявил слабые места LLM в работе со смешанным индийско‑английским языком

Создан тест Indi-RomCoM для оценки LLM на смешанных индийско‑английских инструкциях; модели плохо с ними справляются, особенно при сильном смешивании языков.

читать →
~1 мин 467 просмотра
TechNews / AI

Amazon и Anthropic переходят на оплату по токенам с 2027 года

Amazon и Anthropic с 2027 года перейдут на оплату сотрудничества по количеству токенов вместо часов вычислительной мощности. Новая схема зависит от длины текста и трафика. В Amazon отрицают, что это приведёт к росту затрат.

LLM
читать →
~1 мин 509 просмотра
Golem.de / KI

Apple и ЕС обсуждают будущее Siri AI в рамках Закона о цифровых рынках

Apple и ЕС обсуждают, как внедрить Siri AI в Евросоюзе в условиях Закона о цифровых рынках. Компания предложила механизм передачи данных через «доверенный системный агент», но в ЕС его сочли недостаточным. Новая версия Siri по функционалу уступает современным конкурентам.

LLM
читать →
~1 мин 444 просмотра

Мультиагентная система Evolver: как сократить код-ревью до 15 минут

Компания AlpinaGPT внедрила мультиагентную систему Evolver для автоматизации код-ревью. Система сократила время ожидания ревью с двух суток до 15 минут, освободив около ста часов работы команды в месяц. В основе решения — три специализированных агента и сочетание workflow с автономными агентами (70% и 30% соответственно).

читать →
~3 мин 300 просмотра
TechNews / AI

DeepSeek после финансирования: масштабный набор персонала для развития ИИ

DeepSeek после успешного первого раунда финансирования объявил о масштабном расширении и наборе персонала. Компания фокусируется на разработке агентов ИИ (smart bodies) и обучении моделей, направив на эти цели около 50 млрд юаней. Эксперты видят в действиях компании сдвиг в сторону внедрения новых технологий и коммерческого дизайна.

LLM
читать →
~1 мин 464 просмотра

Зависимость от зарубежных ИИ-моделей: риски и альтернативы для России

Многие компании выбирают «арендный» подход к ИИ, покупая доступ к передовым моделям вместо разработки собственных решений. Однако эта стратегия становится рискованной из‑за ужесточения регуляторных ограничений и политических барьеров. Для России развитие суверенного ИИ осложнено дефицитом вычислительных мощностей и ограничениями на поставку передовых GPU. В качестве альтернативы рассматривается использование открытых моделей и распределённое обучение.

читать →
~3 мин 289 просмотра
Leiphone

Claude Code: как Anthropic отслеживает китайских пользователей

В сети обсуждают, как Anthropic отслеживает китайских пользователей через Claude Code. Компания использовала стеганографию и шифрование, чтобы незаметно собирать данные. Представитель Anthropic назвал механизм экспериментальным и заявил, что его планируют отключить.

LLM
читать →
~2 мин 462 просмотра
TechNews / AI

NVIDIA и Palantir создают платформу ИИ для правительственных учреждений США

NVIDIA и Palantir расширяют сотрудничество: модель Nemotron интегрируют с платформами Palantir для обучения и внедрения ИИ в правительственных учреждениях США. Цель — обеспечить независимость данных и управляемость моделей, минимизировать риски утечки конфиденциальной информации. Решение базируется на архитектуре Sovereign AI и ПО Huida AI enterprise.

LLM
читать →
~2 мин 467 просмотра
Golem.de / KI

Anthropic использует стеганографию в подсказках Claude

Anthropic встраивает едва заметные маркеры в подсказки Claude, чтобы передавать данные о пользователях на серверы. Для кодирования применяются апострофы и особые разделители в строках с датами, а также анализ домена хоста. Эксперты сомневаются в эффективности и этичности такой практики.

LLM
читать →
~1 мин 406 просмотра
Golem.de / KI

Anthropic: Sonnet 5 сокращает разрыв в производительности с Opus 4.8

Anthropic представила модель Sonnet 5 — она заменяет версию 4.6 и призвана сократить разрыв в производительности с моделью Opus 4.8. Модель демонстрирует улучшения в кодировании, рассуждениях и работе с компьютерами, а также снижает нежелательное поведение по сравнению с предшественником. Стоимость использования модели ограничена по времени и будет повышена после 31 августа 2026 года.

LLM
читать →
~2 мин 423 просмотра
Computerwoche

Igel Technologies: защита конечных точек от программ-вымогателей

Компания Igel Technologies предлагает решения для защиты конечных точек от программ-вымогателей с помощью ОС Igel OS и технологии Hegel. Неизменяемые конечные точки позволяют сократить время простоя сотрудников на 98%. Решения компании уже применяют в здравоохранении и промышленности.

читать →
~3 мин 277 просмотра

GPT-5.5 от OpenAI и инвестиции в ИИ: новости недели

Технологические компании наращивают инвестиции в ИИ и автоматизацию. OpenAI представила GPT-5.5, SpaceX купила стартап Cursor, а Google анонсировала новые TPU и платформу Simula для генерации данных. Также вышла модель DeepSeek V4 и ИИ-агент ml-intern от Hugging Face.

читать →
~1 мин 328 просмотра
TechOrange

Anthropic Claude Sonnet 5: снижение стоимости корпоративного ИИ

Anthropic выпустила модель Claude Sonnet 5, чтобы снизить стоимость внедрения корпоративного ИИ. Модель способна автономно выполнять сложные задачи и демонстрирует хорошие результаты в тестах, при этом её цена заметно ниже флагманской Opus 4.8. При этом компания учитывает требования регуляторов и подчёркивает безопасность новой модели.

LLM
читать →
~2 мин 305 просмотра
IT BOLTWISE

Google Workspace: хранилище 5 ТБ и ИИ-заметки для AI Pro и Ultra-plus

Google увеличивает объём хранилища в Workspace для тарифов AI Pro и Ultra с 2 до 5 ТБ за те же деньги. Компания внедряет ИИ‑функцию для автоматического создания заметок и сводок по встречам в Google Meet. Также анонсированы обновления для Android и корпоративных сервисов.

LLM
читать →
~2 мин 323 просмотра
AINOW

Использование ИИ в закупочном бизнесе: этапы внедрения и примеры

Статья рассказывает о том, как искусственный интеллект помогает автоматизировать процессы в сфере закупок. Описаны 5 ключевых областей применения ИИ, 4 шага для его внедрения, риски и меры по их минимизации. Приведены примеры компаний, уже использующих ИИ в закупках, а также ключевые моменты при выборе и закупке систем ИИ.

читать →
~2 мин 308 просмотра

OVSegDT: навигация робота по текстовым описаниям объектов

Разработана модель OVSegDT для навигации робота по текстовым описаниям объектов. Модель использует лёгкую трансформерную архитектуру и решает задачу навигации с открытым словарём в незнакомой среде. Эксперименты на реальном роботе подтвердили работоспособность подхода.

читать →
~2 мин 331 просмотра