DeepDigest
← все статьи
LLM

LLM

724 статьи по теме

LangChain Blog

LangSmith и анализ трассировок: как улучшить работу агентов

Анализ трассировок помогает понять и улучшить поведение агентов. Платформа LangSmith от LangChain Labs позволяет отлаживать решения агентов и оценивать изменения. В Terminal Bench 2.0 с помощью трассировок удалось повысить эффективность на 13,7 %. Данные станут ключевым фактором развития агентов.

читать →
~3 мин 373 просмотра
Golem.de / KI

Anthropic: решение Вашингтона ограничить модели ИИ

Вашингтон потребовал от Anthropic отключить две мощные модели ИИ за пределами США. Решение восприняли как предупреждение. Эксперты считают, что для эффективности такого шага нужен чёткий план действий.

LLM
читать →
~1 мин 398 просмотра
Leiphone

Alipay AI: открытая платформа для агентских сетей

Alipay запустила открытую платформу Alipay AI, которая создаёт универсальный узел взаимодействия для агентов. Первыми доступ получили KFC, Didi, Gaode Taxi и другие компании. Платформа упрощает переход продавцов к управлению с помощью ИИ и меняет логику привлечения клиентов. Для надёжной инфраструктуры Alipay AI будет сотрудничать с Agentar и использовать новые протоколы.

LLM
читать →
~2 мин 405 просмотра
Google AI Blog

Новые возможности управляемых агентов в API Gemini от Google

Google расширил возможности управляемых агентов в API Gemini: теперь доступны фоновые задачи, удалённая интеграция MCP‑сервера, вызов пользовательских функций и обновление учётных данных. Агенты могут асинхронно выполнять задачи и подключаться к удалённым серверам, сочетая внешние инструменты со встроенными возможностями песочницы.

LLM
читать →
~2 мин 652 просмотра

OKF от Google: структурированный подход к знаниям для ИИ-агентов

Google представила OKF — спецификацию для организации знаний агентами ИИ. OKF хранит данные в виде взаимосвязанных концептуальных файлов Markdown с метаданными YAML. Подход дополняет RAG: вместе они позволяют сочетать точность и структурированность с масштабируемостью. Для сложных систем рекомендуется гибридная архитектура.

читать →
~8 мин 229 просмотра
Computerwoche

История ИИ: от идей Лейбница до ChatGPT и AlphaGo

История ИИ насчитывает несколько веков — от философских идей и механических автоматов до современных систем машинного обучения. Ключевые вехи включают тест Тьюринга, конференцию в Дартмуте 1956 года, создание экспертных систем и прорывные победы ИИ в играх (Deep Blue, AlphaGo). В последние годы ИИ активно коммерциализируется — примером служит ChatGPT.

читать →
~7 мин 228 просмотра
Leiphone

ICML 2026: достижения в ИИ — от диффузионных моделей до борьбы с цензурой

На ICML 2026 в Сеуле собрались более 11 000 исследователей. Конгресс отметился новыми рекордами по количеству заявок и докладов. Среди ключевых достижений — разработка JustGRPO для моделей диффузионного языка, асинхронная платформа A3C от DeepMind и ряд других значимых работ в области ИИ.

читать →
~6 мин 411 просмотра
Leiphone

GPT-5.6: борьба за лидерство в обработке длительных задач

GPT-5.6 может быть опубликован 7 июля 2026 года с вероятностью 68%. Модель стремится превзойти Fable 5 в обработке длительных задач, но сталкивается с проблемами в поддержании целостности логических цепочек и стабильности работы. При этом она уже показывает высокие результаты в тестах и превосходит ряд конкурентов.

LLM
читать →
~4 мин 344 просмотра
Leiphone

Kimi K2.7: поиск багов, 3D-игры и рефакторинг кода

Модель Kimi K2.7 успешно справляется с поиском багов, созданием 3D‑игр и рефакторингом кода. В ходе тестирования она сократила объём кода на 55 %, исправила скрытые ошибки в проекте MiniDB и создала рабочую версию 3D‑игры в петанк. При этом остаются сложности при внедрении в масштабные проекты.

читать →
~5 мин 378 просмотра
TechOrange

Project Genesis от Hon Hai: мультиагентная платформа для умного производства

Hon Hai Technology Group запустила платформу Project Genesis для превращения традиционных фабрик в интеллектуальные производственные площадки. Проект использует мультиагентную архитектуру, чтобы преобразовать опыт мастеров в цифровые активы. Платформа уже имеет шесть рабочих решений и иерархическую систему для распространения интеллектуальных приложений.

читать →
~2 мин 241 просмотра
TechOrange

OpenAI, Google и Anthropic: война субсидий для стартапов

OpenAI, Anthropic и Google предлагают стартапам крупные субсидии и бесплатные квоты, чтобы вовлечь их в свои экосистемы. Компании усиливают конкуренцию за молодых клиентов, предоставляя значительные скидки и кредиты. При этом эксперты предупреждают о рисках для стартапов при использовании таких предложений.

читать →
~2 мин 224 просмотра
TechNews / AI

OpenAI подала заявку на IPO с оценкой более 1 трлн долларов

OpenAI подала заявку на IPO, ожидается, что оценка компании превысит 1 трлн долларов. Рынок сомневается в способности инвесторов справиться с волной крупных размещений акций. Наряду с OpenAI к публичному размещению готовятся SpaceX и Anthropic.

читать →
~1 мин 408 просмотра
TechNews / AI

Claude от Anthropic: спонтанное формирование J-пространства

Компания Anthropic обнаружила в ИИ‑модели Claude структуру («J‑space»), похожую на глобальное рабочее пространство человеческого мозга. J‑пространство сформировалось спонтанно и активируется при решении сложных задач. Открытие вызвало дискуссии о наличии сознания у ИИ.

LLM
читать →
~2 мин 416 просмотра
Leiphone

ICML 2026: новые разработки в ИИ — от верификации кода до управления нейронами

На конференции ICML 2026 представлены новые разработки в области искусственного интеллекта: от тестов для верификации кода до систем управления нейронной микросредой. Среди новинок — система RFM для онлайн‑обучения, тест DRPBench для оценки понимания параллельного кода, технология встраиваемого перевода и другие решения.

читать →
~4 мин 366 просмотра
Leiphone

Fable 5 от Anthropic: система безопасности и методы обхода ограничений

Fable 5 от Anthropic обладает усиленной системой безопасности с классификатором и буферной зоной. Пользователи нашли способы обхода ограничений модели, хотя большинство уязвимостей касаются лишь буферной зоны. Модель демонстрирует высокие результаты в долгосрочных задачах и генерации контента, но её стоимость и агрессивная стратегия защиты вызывают споры.

читать →
~4 мин 390 просмотра
Leiphone

Claude Code + Obsidian: система второго мозга на базе LLM

Андрей Карпати в апреле 2026 года предложил систему LLM Wiki для управления исследовательскими знаниями. Разработчик RGK реализовал идею с помощью Claude Code + Obsidian — получилась исполняемая версия «системы второго мозга». Система решает проблемы хранения данных, управления контекстом и интеграции ИИ в рабочие процессы.

LLM
читать →
~5 мин 426 просмотра
Leiphone

WAIC 2026: форум MemTensor о долгосрочном интеллекте ИИ

17 июля 2026 года на WAIC 2026 пройдёт форум MemTensor о переходе от агента и терминала ИИ к долгосрочному интеллекту. На мероприятии выступят эксперты из разных компаний и академической среды. Обсудят архитектуру больших моделей, инфраструктуру ИИ и кросс‑модальную персонализацию. MemTensor подготовит билеты для партнёров и установит стенды на выставке.

читать →
~4 мин 372 просмотра
Golem.de / KI

Anthropic обнаружила структуру J-Space в модели Клод

Anthropic обнаружила в модели Клод внутреннюю структуру J-пространство, которая составляет менее 10 % нейронной активности модели. Для её изучения разработан инструмент J-Lens. J-пространство действует как рабочее пространство для обработки концепций без их явного вывода. Открытие относится к «сознанию доступа», а не к феноменальному сознанию.

LLM
читать →
~2 мин 393 просмотра
TechOrange

Ascend 950PR: стратегия Huawei на рынке ИИ Южной Кореи

Huawei планирует выйти на южнокорейский рынок ИИ с чипами Ascend и интегрированными решениями Atlas 950 SuperPod. Компания предлагает стратегию «de-Huida», нацеленную на привлечение покупателей ценой, масштабами поставок и совместимостью ПО. При этом внедрение китайских технологий в Южной Корее сопряжено с рисками информационной безопасности и геополитическими вызовами.

читать →
~4 мин 263 просмотра
Leiphone

Baidu поручила развитие базовых моделей молодому специалисту Сунь Тяньсяну

Baidu назначила Сунь Тяньсяна главой отдела разработки базовых моделей (BMU). Перед ним стоят задачи по перестройке базы модели и переработке данных. Назначение молодого специалиста отражает стратегию компании по омоложению команды разработчиков.

LLM
читать →
~1 мин 433 просмотра