ODYSSEY: новый подход к созданию проверяемых ИИ‑моделей
Представлена структура ODYSSEY для создания проверяемых локальных ИИ‑моделей с набором компонентов и инструментов (UFL, FSQL, TICKET); система успешно протестирована.
724 статьи по теме
Представлена структура ODYSSEY для создания проверяемых локальных ИИ‑моделей с набором компонентов и инструментов (UFL, FSQL, TICKET); система успешно протестирована.
DeepSeek получила финансирование и удвоила набор персонала. Компания активно адаптирует отечественные чипы Huawei и продолжает развивать модели ИИ. Флагманская модель V4 за месяц вошла в тройку лидеров на платформе Vercel AI Gateway.
Статья сравнивает методы поиска GraphRAG и Vector RAG. Vector RAG эффективен для прямых фактологических вопросов, а GraphRAG лучше подходит для многоступенчатых рассуждений и анализа взаимосвязей в большом объёме данных. На практике часто используют гибридный подход, объединяющий оба метода.
Учёные выяснили, что личностные черты LLM по‑разному влияют на работу мультиагентных команд в зависимости от типа задачи — от незначительного эффекта в кодировании до сильного снижения производительности в переговорах и сотрудничестве.
Авторы критикуют нечёткое использование термина «машинное переобучение» в LLM и предлагают ввести строгую терминологию для разных задач «забывания» данных.
Разработана система оценки «мышления» LLM: выявлены структурные ограничения моделей на основе четырёх аксиом; протестировано на 23 логических задачах.
Предложена концепция AI‑ModelNet — сети ИИ‑моделей для их взаимодействия и совместного решения задач, что может упростить практическое применение ИИ.
Apple стремится купить чипы памяти у Changxin, чтобы смягчить рост закупочных цен; DeepSeek представила платформу DSpark для ускорения рассуждений в LLM; Midea выпустила энергоэффективный кондиционер True Warm MAX. Среди других новостей — планы BYD по использованию чипа Xuanji A3, масштабные сокращения в Volkswagen и жалобы Micron на ценовую политику Apple.
NVIDIA NitroGen номинирована на премию CVPR 2026. На конференциях CVPR и ICML 2026 представлены новые наборы данных, модели и исследования в области ИИ — от мультимодального кода до логических рассуждений LLM. Компания Runway выпустила модель видеогенерации Gen-4.5, а Mistral AI укрепляет позиции на рынке ИИ-услуг.
Vivo готовит к выпуску модель X Fold6 со складным экраном — она должна стать «телефоном-агентом», активно понимающим потребности пользователя. Компания внедряет новые функции на базе ИИ для многозадачности и работы с данными. При общем падении рынка смартфонов сегмент складных устройств демонстрирует рост.
Vivo выпустила складной флагман X Fold6 с расширенными возможностями ИИ. Устройство оснащено системой OriginOS 6Fold и функцией Atomic workbench для работы с многозадачностью на большом экране. Среди других особенностей — мощный чип Blue Crystal× DNT 9500 Super Edition, ИИ-менеджер файлов и ассистент для конференций.
Ford нанял 350 опытных инженеров после того, как ИИ и автоматизированные системы не оправдали ожиданий в обеспечении качества. Нанятые специалисты будут обучать молодёжь и перепрограммировать инструменты ИИ. Компания рассчитывает сэкономить 1 млрд долларов и уже заняла первое место в опросе JD Power.
OpenAI выпустила три модели серии GPT-5.6 — Sol, Terra и Luna, каждая из которых ориентирована на разные задачи. Доступ к моделям пока ограничен, они доступны лишь партнёрам компании. В моделях внедрена многоуровневая система безопасности и новая функция предсказуемого кэширования запросов.
Анджела Ши описывает философию построения корпоративных систем RAG, подчёркивая, что такие системы должны усиливать, а не заменять экспертов. В основе архитектуры — четыре элемента (синтаксический анализ, анализ вопросов, поиск, генерация), каждый из которых должен отражать действия эксперта. Автор выделяет четыре условия и три принципа для эффективной реализации системы.
Разработан конвейер постобучения NebulaExp для LLM на базе Qwen3-8B: он улучшает показатели модели за счёт детальной обработки данных и оптимизации настроек.
Пост посвящён созданию локального ИИ-агента с использованием различных инструментов. В качестве LLM задействована модель Gemma 4, для обслуживания модели применяется Ollama, среда выполнения агента строится на OpenAI Agents SDK, а в качестве внешнего инструмента — Tavily MCP. В результате получится агент, способный искать информацию в сети и синтезировать ответы.
OpenAI анонсировала GPT-5.6 в трёх версиях — Sol, Terra и Luna. Из‑за требований правительства США модель будет запускаться поэтапно: сначала доступ получат партнёры в США. В компании заявили о намерении в дальнейшем сделать GPT-5.6 общедоступной.
Новая система на базе LLM и с участием экспертов анализирует отзывы о госуслугах, выявляя скрытые проблемы и неравенство в обслуживании.
Система на базе LLM автоматически превращает текстовые инструкции в формальные проверенные политики для агентов (на языке Cedar). В тестах MedAgentBench превзошла ручное кодирование.
Статья посвящена созданию базы знаний на базе LLM. Автор объясняет, почему такие базы становятся всё мощнее благодаря технологиям LLM, и описывает способы автоматического внесения и активного использования информации. Рассмотрены два подхода к работе с базой: активный запрос и пассивное использование инструментом в процессе работы.