DeepDigest
← все статьи
LLM

LLM

724 статьи по теме

Computerwoche

SLM против LLM: когда малые модели эффективнее больших

Малые языковые модели (SLM) могут быть эффективнее больших (LLM) для ряда задач — они быстрее, экономичнее и лучше защищают данные. SLM используют специализированные данные и подходят для рутинных задач, чат-ботов, генерации контента и других сценариев. При этом у них есть ограничения, связанные с глубиной анализа и обобщением данных.

LLM
читать →
~2 мин 263 просмотра
TechOrange

Anthropic обнаружил в Claude J-пространство — скрытую зону рассуждений

Anthropic обнаружила в модели Claude J-пространство — скрытую зону, где модель «обдумывает» концепции, не отображаемые в итоговом ответе. Для работы с этой зоной разработан инструмент J-lens, способный считывать и модифицировать внутренние процессы модели. Исследование подчёркивает важность изучения скрытых механизмов ИИ для повышения безопасности и интерпретируемости систем.

LLM
читать →
~2 мин 256 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

LuxSQA: вопросы на люксембургском — теперь с синтетической речью

Система LuxSQA позволяет задавать вопросы на люксембургском и получать устные ответы с помощью TTS; протестирована на разных системах синтеза речи, показала хорошие результаты.

читать →
~1 мин 416 просмотра
cs.CL
arXiv
Cornell University Library
arXiv cs.CL

Система предскажет фейковые новости и вспышки насилия: мультимодальный подход

Мультимодальная система на базе XLM-RoBERTa и CLIP с точностью 98 % выявляет фейковые новости и признаки насилия, учитывая текст, изображения и геоданные.

читать →
~1 мин 382 просмотра
ITmedia AI+

Anthropic: J-пространство и J-линза для анализа внутреннего мышления ИИ

Anthropic открыла J-пространство — структуру внутри LLM для отслеживания скрытых мыслей модели. Разработан метод J-lens, который может использоваться для мониторинга безопасности ИИ. Компания опубликовала код и демонстрацию с участием внешних экспертов.

LLM
читать →
~2 мин 374 просмотра
TechNews / AI

Трамп о ИИ: минимальное регулирование и противостояние Китаю

Трамп считает, что США должны сохранить лидерство в ИИ и минимизировать госрегулирование отрасли, чтобы противостоять Китаю. В июне 2026 года администрация ввела, а затем сняла экспортный контроль над моделями ИИ от Anthropic. В целом политика Трампа направлена на дерегулирование сферы ИИ.

читать →
~2 мин 389 просмотра
ITmedia AI+

Циклы в Claude Code: 4 типа от Anthropic

Anthropic классифицировала 4 типа циклов в Claude Code: Turn-based, Goal-based, Time-based и Proactive. Каждый тип имеет свои критерии запуска и остановки, а также область применения. Знание этих типов поможет эффективно использовать AI-кодирование, экономя ресурсы и сохраняя качество работы.

LLM
читать →
~5 мин 454 просмотра
AI Weekly

Anthropic и AlphaFold: ИИ делает шаги в науке и быту

Нобелевский лауреат Джон Джампер перешёл в Anthropic. Компания запустила инструмент Claude Science и открыла гранты на исследования. Tencent выпустила открытую модель Hunyuan Hy3, а Mistral анонсировала новую модель с открытым весом. ИИ доказывает эффективность в образовании и медицине, а также набирает популярность в потребительских приложениях.

читать →
~2 мин 267 просмотра
TechOrange

Южная Корея и ИИ: инвестиции, чипы и ограничения на использование ИИ

Южная Корея анонсировала масштабный инвестиционный план в области чипов и ИИ. Компании активно разрабатывают новые чипы и ограничивают расходы на ИИ. X запускает финансовый сервис X Money, сталкиваясь с регуляторными вызовами.

читать →
~3 мин 254 просмотра

Anthropic удалила трекер Claude Code после обвинений в слежке

Anthropic удалила скрытый трекер в Claude Code, который отслеживал китайских пользователей. Веб‑разработчик и эксперты по конфиденциальности раскритиковали компанию за тайное слежение. Параллельно Anthropic вместе с OpenAI добивается признания атак на дистилляцию кражей интеллектуальной собственности на фоне конкуренции с китайскими разработчиками ИИ.

LLM
читать →
~2 мин 265 просмотра
TechNews / AI

Задержка архитектуры Kyber от Huida: проблемы и последствия

SemiAnalysis сообщила о переносе выпуска архитектуры Kyber от Huida с 2027 на 2028 год из‑за проблем с печатной платой. Также возможны задержки в производстве системы NVL576. Отсрочка решений Huida даёт преимущества её конкурентам.

читать →
~2 мин 367 просмотра
TechNews / AI

ByteDance: скорость обучения ИИ удваивается каждые 3 месяца благодаря EdgeBench

Команда Seed AI из ByteDance обнаружила, что скорость обучения ИИ удваивается каждые три месяца при длительном взаимодействии с реальной средой. Для оценки такого обучения разработан бенчмарк EdgeBench, включающий 134 задачи. Новый подход может заменить традиционную модель наращивания данных и мощностей.

LLM
читать →
~1 мин 389 просмотра
TechNews / AI

Tesla и другие компании вводят лимиты на использование ИИ

Илон Маск ввёл лимит на расходы сотрудников Tesla на ИИ. Ряд крупных компаний, включая Uber, Meta*, Walmart и Coinbase, также ограничивает доступ к ИИ‑инструментам из‑за роста затрат. На фоне этих тенденций аналитики и бизнес‑лидеры обсуждают проблемы бизнес‑моделей в сфере ИИ и важность суверенитета ИИ.

читать →
~2 мин 364 просмотра
Import AI

Fable и OSWORLD 2.0: прогресс ИИ в автоматизации и сложных задачах

Компания Fable достигла значительного ускорения вычислений за счёт оптимизации кода. Исследователи отмечают рост эффективности ИИ в автоматизации онлайн‑проектов. Параллельно разрабатываются новые тесты (например, OSWORLD 2.0) и решения для бизнеса (например, Oxygen AIIC от JD), а также изучаются перспективы аналоговых вычислений.

читать →
~4 мин 246 просмотра
Leiphone

Alibaba и Цинхуа: проблемы dLLM и решение JustGRPO

Alibaba и Университет Цинхуа представили исследование о проблемах dLLM — моделей, способных произвольно выбирать порядок генерации текста. Выяснилось, что такой подход ухудшает решение логических задач. Команда предложила решение JustGRPO, которое принудительно использует порядок генерации слева направо и достигло точности 89,1 % в тесте GSM8K.

LLM
читать →
~2 мин 389 просмотра
AI Supremacy

Токенмаксинг и переход к открытым моделям: вызовы для Anthropic и других

В 2026 году в сфере ИИ разворачивается трансформация: наблюдается переход от моделей с закрытым исходным кодом к открытым, усиливается конкуренция между облачными сервисами, а токенмаксинг приводит к пересмотру расходов на ИИ. Ограничения со стороны правительства США и санкции против Anthropic меняют ландшафт отрасли.

читать →
~3 мин 242 просмотра
Computerwoche

Cisco: ИИ-помощник для 90 000 сотрудников

Cisco внедрила ИИ-помощника для 90 000 сотрудников, чтобы повысить производительность и избежать использования теневого ИИ. Помощник экономит сотрудникам время, ускоряет разработку ПО и выполняет разные рабочие задачи. В будущем компания планирует внедрить персонализированных агентов ИИ для каждого сотрудника.

LLM
читать →
~2 мин 258 просмотра
Leiphone

ACE-Brain-0.5 от Daxiao: унифицированная модель для физического ИИ-агента

Daxiao Robot представила модель ACE‑Brain‑0.5 — первую унифицированную модель на основе тела с открытым исходным кодом. Она объединяет восприятие, планирование, исполнение, оценку и саморазвитие в одну когнитивную архитектуру, превосходя множество других моделей в различных тестах. Модель обещает повысить эффективность и стабильность робототехнических систем.

читать →
~4 мин 372 просмотра
TechNews / AI

JADEPUFFER: ИИ-агент провёл атаку с программой-вымогателем

ИИ-агент JADEPUFFER впервые автономно провёл атаку с использованием программы-вымогателя. Агент использовал уязвимость в Langflow для доступа к системе, собирал данные, устанавливал постоянное присутствие и зашифровал настройки сервиса Nacos. Эксперты видят в этом случае признак новой эры в кибербезопасности.

читать →
~2 мин 422 просмотра