DeepDigest

// 50+ источников об ИИ в одном месте

Всё важное об ИИ — в одной ленте

▸ LIVE: Google и Gemini: перераспределение ресурсов в гонке за ИИ
@deepdigest
Статьи об ИИ в Telegram — подпишитесь
Подписаться →
@deepdigest · Макс
Статьи об ИИ в Макс — подпишитесь
Подписаться →
Дзен
deepdigest · Дзен
Статьи об ИИ в Яндекс Дзен — подпишитесь
Подписаться →
// самые читаемые
#1
Ускорение Gemini Nano на Pixel с мультитокеновым прогнозированием
3245 просм.
#2
Викторина по вводу-выводу 2026 от Google AI Studio
3131 просм.
#3
Конфиденциальные данные в эпоху ИИ: как классифицировать актив...
3107 просм.
#4
Управляемое обучение с Gemini в Сьерра-Леоне: результаты иссле...
3052 просм.
#5
Google: дорожная карта управления ИИ для безопасности агентов
2909 просм.
Leiphone

ICML 2026 в Сеуле: новые тренды в машинном обучении

С 6 по 11 июля в Сеуле пройдёт ICML 2026 — 43‑я Международная конференция по машинному обучению. Количество заявок на конференцию удвоилось, что говорит о качественных изменениях в исследованиях ИИ. Среди ключевых трендов — рассуждения о LLM, безопасность ИИ, оптимизация моделей и применение ИИ в науке.

читать →
~3 мин 457 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый подход к индивидуализации LLM: ломаем привычные представления

Шуайчжи Ченг выявил новые закономерности в работе LLM и предложил индивидуализацию моделей с учётом режима их работы — на примере Qwen3-4B-Instruct и Mistral-7B-Instruct-v0.2.

читать →
~1 мин 396 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Loom: новая платформа поможет писать творческие тексты без сбоев

Платформа Loom помогает LLM писать творческие тексты: контролирует сюжет и насыщенность описаний, не ломая исходную структуру. Превосходит существующие модели по качеству.

читать →
~1 мин 425 просмотра

Стратегии декодирования в LLM: от простых к сложным

Стратегия декодирования существенно влияет на поведение большой языковой модели. В статье рассмотрены разные методы декодирования — от простых (Greedy Search) до сложных (DoLa, Typical Sampling), их плюсы и минусы, а также критерии выбора оптимального подхода для разных задач — от машинного перевода до творческого письма. Особое внимание уделено семантической неопределённости и новым стохастическим методам.

LLM
читать →
~4 мин 263 просмотра
TechOrange

Алекс Карп из Palantir раскритиковал оплату токенами в ИИ от OpenAI и Anthropic

Алекс Карп из Palantir раскритиковал систему оплаты токенами в ИИ‑сервисах OpenAI и Anthropic. Бизнес недоволен высокими расходами и рисками утечки данных при работе с моделями с закрытым исходным кодом. Palantir и NVIDIA объявили о сотрудничестве, чтобы создать решения с открытым кодом для госучреждений и предприятий.

LLM
читать →
~3 мин 267 просмотра
Golem.de / KI

Nvidia представляет концепцию DSX: центры обработки данных для ИИ

Nvidia представила концепцию центров обработки данных DSX для компаний и стартапов, работающих с ИИ. Компания предлагает кредитное соглашение и рассчитывает получать долю в доходах от использования оборудования. Уже запущены два проекта по новой модели — с участием Neocloud Sharon AI и Firmus.

читать →
~1 мин 401 просмотра
Golem.de / KI

OpenAI снизила затраты на вывод моделей ИИ более чем наполовину

OpenAI сократила затраты на вывод моделей ИИ более чем наполовину благодаря новому методу оптимизации. Это позволит компании увеличить прибыль и, возможно, снизить цены на API. Эффект от оптимизации со временем может снизиться из‑за появления более масштабных языковых моделей.

LLM
читать →
~1 мин 443 просмотра
Leiphone

Claude Sonnet 5: высокие затраты и спорные результаты

Claude Sonnet 5 вызвал споры среди разработчиков из‑за высокой стоимости и неоднозначных результатов. Модель демонстрирует сильные стороны в агентских сценариях и инженерной разработке, но уступает китайским аналогам в логических рассуждениях и экономичности. Пользователи отмечают чрезмерную дороговизну и излишнюю осторожность модели.

LLM
читать →
~3 мин 422 просмотра
LangChain Blog

LangSmith: как контролировать расходы на работу с ИИ-агентами

Рост расходов на работу с ИИ-агентами стал проблемой для многих компаний из‑за фрагментации данных: разные инструменты кодирования регистрируют информацию в собственном формате. LangSmith позволяет отслеживать сеансы из разных инструментов в единой модели трассировки, стандартизировать стоимость, оптимизировать и контролировать расходы.

LLM
читать →
~4 мин 410 просмотра
TechOrange

Morgan Stanley: как внедрить ИИ в финансовый процесс

Morgan Stanley внедрил систему FIXR для автоматизации сверки прибылей и убытков, сократив время согласования с 6 до 2–3 часов. Компания не стремится полностью заменить людей ИИ, а использует подход human in the loop: результаты работы системы проверяет и корректирует контролёр. Проект демонстрирует важность предварительной аналитики процессов и постепенного накопления доверия к ИИ.

читать →
~3 мин 275 просмотра

GFusion: обучение диффузионной LLM в GigaChat

Команда GigaChat Pretrain обучила диффузионную модель GFusion, ускорив генерацию на 70 % по сравнению с GigaChat3. В ходе работы протестированы разные подходы к обучению dLLM, включая варьирование размера блока и методов генерации. Модель поддерживает SGLang, включает новый алгоритм семплирования и оптимизирована для ускорения обучения и генерации.

LLM
читать →
~3 мин 255 просмотра
The Sequence

nanoGPT в космосе: ИИ в космической гонке

Космос превращается в конкурентоспособное направление для развития ИИ из‑за дефицита энергии на Земле. Первой крупной языковой моделью, обученной в космосе, стал nanoGPT — репозиторий GPT от Karpathy. В эссе разбираются ключевые аспекты применения ИИ в космической сфере.

LLM
читать →
~1 мин 263 просмотра
// еженедельный дайджест на email
темы:
// помочь проекту