DeepDigest
← все статьи
LLM

LLM

724 статьи по теме

cs.AI
arXiv
Cornell University Library
arXiv cs.AI

ODYSSEY: новый подход к созданию проверяемых ИИ‑моделей

Представлена структура ODYSSEY для создания проверяемых локальных ИИ‑моделей с набором компонентов и инструментов (UFL, FSQL, TICKET); система успешно протестирована.

читать →
~1 мин 439 просмотра
QbitAI

DeepSeek: финансирование, рост команды и адаптация чипов Huawei

DeepSeek получила финансирование и удвоила набор персонала. Компания активно адаптирует отечественные чипы Huawei и продолжает развивать модели ИИ. Флагманская модель V4 за месяц вошла в тройку лидеров на платформе Vercel AI Gateway.

LLM
читать →
~2 мин 463 просмотра
Analytics Vidhya

GraphRAG и Vector RAG: сравнение методов поиска

Статья сравнивает методы поиска GraphRAG и Vector RAG. Vector RAG эффективен для прямых фактологических вопросов, а GraphRAG лучше подходит для многоступенчатых рассуждений и анализа взаимосвязей в большом объёме данных. На практике часто используют гибридный подход, объединяющий оба метода.

LLM
читать →
~3 мин 270 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

Личностные черты LLM влияют на работу команд — новое исследование

Учёные выяснили, что личностные черты LLM по‑разному влияют на работу мультиагентных команд в зависимости от типа задачи — от незначительного эффекта в кодировании до сильного снижения производительности в переговорах и сотрудничестве.

читать →
~1 мин 489 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Путаница в терминологии: как правильно «забывать» данные в LLM

Авторы критикуют нечёткое использование термина «машинное переобучение» в LLM и предлагают ввести строгую терминологию для разных задач «забывания» данных.

читать →
~1 мин 506 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Новый способ оценить «мышление» ИИ: обнаружены серьёзные ограничения LLM

Разработана система оценки «мышления» LLM: выявлены структурные ограничения моделей на основе четырёх аксиом; протестировано на 23 логических задачах.

читать →
~1 мин 495 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

AI-ModelNet: сеть ИИ-моделей — новый шаг к их взаимодействию

Предложена концепция AI‑ModelNet — сети ИИ‑моделей для их взаимодействия и совместного решения задач, что может упростить практическое применение ИИ.

читать →
~1 мин 503 просмотра
Leiphone

Apple и Changxin, DeepSeek и DSpark: главные новости технологий

Apple стремится купить чипы памяти у Changxin, чтобы смягчить рост закупочных цен; DeepSeek представила платформу DSpark для ускорения рассуждений в LLM; Midea выпустила энергоэффективный кондиционер True Warm MAX. Среди других новостей — планы BYD по использованию чипа Xuanji A3, масштабные сокращения в Volkswagen и жалобы Micron на ценовую политику Apple.

читать →
~2 мин 504 просмотра
Leiphone

NVIDIA NitroGen и новинки ICML 2026: достижения в ИИ

NVIDIA NitroGen номинирована на премию CVPR 2026. На конференциях CVPR и ICML 2026 представлены новые наборы данных, модели и исследования в области ИИ — от мультимодального кода до логических рассуждений LLM. Компания Runway выпустила модель видеогенерации Gen-4.5, а Mistral AI укрепляет позиции на рынке ИИ-услуг.

читать →
~2 мин 479 просмотра
Leiphone

Vivo X Fold6: складной экран для «телефона-агента»

Vivo готовит к выпуску модель X Fold6 со складным экраном — она должна стать «телефоном-агентом», активно понимающим потребности пользователя. Компания внедряет новые функции на базе ИИ для многозадачности и работы с данными. При общем падении рынка смартфонов сегмент складных устройств демонстрирует рост.

читать →
~2 мин 447 просмотра
Leiphone

Vivo X Fold6: складной флагман с ИИ-функциями

Vivo выпустила складной флагман X Fold6 с расширенными возможностями ИИ. Устройство оснащено системой OriginOS 6Fold и функцией Atomic workbench для работы с многозадачностью на большом экране. Среди других особенностей — мощный чип Blue Crystal× DNT 9500 Super Edition, ИИ-менеджер файлов и ассистент для конференций.

читать →
~3 мин 479 просмотра
TechCrunch AI

Ford нанимает опытных инженеров после проблем с ИИ

Ford нанял 350 опытных инженеров после того, как ИИ и автоматизированные системы не оправдали ожиданий в обеспечении качества. Нанятые специалисты будут обучать молодёжь и перепрограммировать инструменты ИИ. Компания рассчитывает сэкономить 1 млрд долларов и уже заняла первое место в опросе JD Power.

читать →
~1 мин 366 просмотра
QbitAI

OpenAI выпустила три модели серии GPT-5.6: Sol, Terra и Luna

OpenAI выпустила три модели серии GPT-5.6 — Sol, Terra и Luna, каждая из которых ориентирована на разные задачи. Доступ к моделям пока ограничен, они доступны лишь партнёрам компании. В моделях внедрена многоуровневая система безопасности и новая функция предсказуемого кэширования запросов.

LLM
читать →
~2 мин 458 просмотра

Корпоративный RAG: философия построения системы на основе экспертных знаний

Анджела Ши описывает философию построения корпоративных систем RAG, подчёркивая, что такие системы должны усиливать, а не заменять экспертов. В основе архитектуры — четыре элемента (синтаксический анализ, анализ вопросов, поиск, генерация), каждый из которых должен отражать действия эксперта. Автор выделяет четыре условия и три принципа для эффективной реализации системы.

читать →
~2 мин 330 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

NebulaExp-8B: новый способ дообучения больших языковых моделей

Разработан конвейер постобучения NebulaExp для LLM на базе Qwen3-8B: он улучшает показатели модели за счёт детальной обработки данных и оптимизации настроек.

читать →
~1 мин 498 просмотра

Gemma 4: от локального LLM до агента с инструментами

Пост посвящён созданию локального ИИ-агента с использованием различных инструментов. В качестве LLM задействована модель Gemma 4, для обслуживания модели применяется Ollama, среда выполнения агента строится на OpenAI Agents SDK, а в качестве внешнего инструмента — Tavily MCP. В результате получится агент, способный искать информацию в сети и синтезировать ответы.

LLM
читать →
~1 мин 311 просмотра

GPT-5.6 от OpenAI: поэтапный релиз по требованию властей США

OpenAI анонсировала GPT-5.6 в трёх версиях — Sol, Terra и Luna. Из‑за требований правительства США модель будет запускаться поэтапно: сначала доступ получат партнёры в США. В компании заявили о намерении в дальнейшем сделать GPT-5.6 общедоступной.

LLM
читать →
~1 мин 302 просмотра
cs.AI
arXiv
Cornell University Library
arXiv cs.AI

ИИ автоматически превращает инструкции в проверенные политики — прорыв в безопасности агентов

Система на базе LLM автоматически превращает текстовые инструкции в формальные проверенные политики для агентов (на языке Cedar). В тестах MedAgentBench превзошла ручное кодирование.

читать →
~1 мин 504 просмотра

Как создать базу знаний на базе LLM

Статья посвящена созданию базы знаний на базе LLM. Автор объясняет, почему такие базы становятся всё мощнее благодаря технологиям LLM, и описывает способы автоматического внесения и активного использования информации. Рассмотрены два подхода к работе с базой: активный запрос и пассивное использование инструментом в процессе работы.

LLM
читать →
~2 мин 332 просмотра