DeepDigest
← все статьи
LLM

LLM

725 статьи по теме

TechOrange

Алекс Карп из Palantir раскритиковал оплату токенами в ИИ от OpenAI и Anthropic

Алекс Карп из Palantir раскритиковал систему оплаты токенами в ИИ‑сервисах OpenAI и Anthropic. Бизнес недоволен высокими расходами и рисками утечки данных при работе с моделями с закрытым исходным кодом. Palantir и NVIDIA объявили о сотрудничестве, чтобы создать решения с открытым кодом для госучреждений и предприятий.

LLM
читать →
~3 мин 277 просмотра
Golem.de / KI

Nvidia представляет концепцию DSX: центры обработки данных для ИИ

Nvidia представила концепцию центров обработки данных DSX для компаний и стартапов, работающих с ИИ. Компания предлагает кредитное соглашение и рассчитывает получать долю в доходах от использования оборудования. Уже запущены два проекта по новой модели — с участием Neocloud Sharon AI и Firmus.

читать →
~1 мин 429 просмотра
Golem.de / KI

OpenAI снизила затраты на вывод моделей ИИ более чем наполовину

OpenAI сократила затраты на вывод моделей ИИ более чем наполовину благодаря новому методу оптимизации. Это позволит компании увеличить прибыль и, возможно, снизить цены на API. Эффект от оптимизации со временем может снизиться из‑за появления более масштабных языковых моделей.

LLM
читать →
~1 мин 465 просмотра
Leiphone

Claude Sonnet 5: высокие затраты и спорные результаты

Claude Sonnet 5 вызвал споры среди разработчиков из‑за высокой стоимости и неоднозначных результатов. Модель демонстрирует сильные стороны в агентских сценариях и инженерной разработке, но уступает китайским аналогам в логических рассуждениях и экономичности. Пользователи отмечают чрезмерную дороговизну и излишнюю осторожность модели.

LLM
читать →
~3 мин 437 просмотра
LangChain Blog

LangSmith: как контролировать расходы на работу с ИИ-агентами

Рост расходов на работу с ИИ-агентами стал проблемой для многих компаний из‑за фрагментации данных: разные инструменты кодирования регистрируют информацию в собственном формате. LangSmith позволяет отслеживать сеансы из разных инструментов в единой модели трассировки, стандартизировать стоимость, оптимизировать и контролировать расходы.

LLM
читать →
~4 мин 423 просмотра
TechOrange

Morgan Stanley: как внедрить ИИ в финансовый процесс

Morgan Stanley внедрил систему FIXR для автоматизации сверки прибылей и убытков, сократив время согласования с 6 до 2–3 часов. Компания не стремится полностью заменить людей ИИ, а использует подход human in the loop: результаты работы системы проверяет и корректирует контролёр. Проект демонстрирует важность предварительной аналитики процессов и постепенного накопления доверия к ИИ.

читать →
~3 мин 289 просмотра

GFusion: обучение диффузионной LLM в GigaChat

Команда GigaChat Pretrain обучила диффузионную модель GFusion, ускорив генерацию на 70 % по сравнению с GigaChat3. В ходе работы протестированы разные подходы к обучению dLLM, включая варьирование размера блока и методов генерации. Модель поддерживает SGLang, включает новый алгоритм семплирования и оптимизирована для ускорения обучения и генерации.

LLM
читать →
~3 мин 260 просмотра
The Sequence

nanoGPT в космосе: ИИ в космической гонке

Космос превращается в конкурентоспособное направление для развития ИИ из‑за дефицита энергии на Земле. Первой крупной языковой моделью, обученной в космосе, стал nanoGPT — репозиторий GPT от Karpathy. В эссе разбираются ключевые аспекты применения ИИ в космической сфере.

LLM
читать →
~1 мин 274 просмотра

Модель t0-alpha: как работают базовые LLM для временных рядов

В статье Шона Морана разбирается работа базовых моделей временных рядов на примере t0-alpha — открытой вероятностной модели с 102 млн параметров. Автор тестирует её в GIFT-Eval, сравнивает с другими моделями (Chronos, TiRex, TimesFM) и обсуждает ключевые проблемы оценки и проектирования систем прогнозирования: утечки данных, калибровку, маршрутизацию и другие. Подчёркивается потенциал гибридных решений, сочетающих базовые модели, классические методы и обученных на симуляторах оценщиков.

LLM
читать →
~2 мин 259 просмотра
IT BOLTWISE

LinqAlpha привлекла 22 млн долларов для автоматизации инвестиционного анализа

Стартап LinqAlpha привлёк 22 млн долларов в рамках раунда серии А для автоматизации инвестиционного анализа. Компания использует машинное обучение для обработки больших объёмов данных и выявления взаимосвязей между рыночными сигналами, новостями и корпоративными событиями. Ключевую роль играет не только модель, но и инфраструктура — от обработки данных до контроля доступа.

LLM
читать →
~3 мин 287 просмотра
Leiphone

Отчёт об оценке безопасности языковых моделей: Пекин, 2026

В Пекине опубликовали первый в мире отчёт об оценке способности языковых моделей предотвращать угрозы безопасности. В исследовании проанализировали 38 моделей с помощью 313 вопросов высокого риска. Отчёт предлагает новые критерии оценки безопасности и рекомендации для управления рисками.

читать →
~2 мин 468 просмотра
Computerwoche

Visa: ИИ-агенты совершают покупки в цифровых кассах

Visa запустила пилотную программу Visa Agentic Ready — в её рамках ИИ-агенты совершили первые реальные покупки в Европе. В операции участвуют более 30 европейских банков и ряд торговых компаний. Для защиты транзакций используется протокол доверенных агентов (TAP) и платёжные ключи Visa Passkey.

читать →
~2 мин 279 просмотра
TechOrange

UBTech представила робота-компаньона UWORLD U1: шаг к семейному использованию

UBTech представила робота-компаньона UWORLD U1, нацеленного на семейное использование. В отличие от большинства человекоподобных роботов, ориентированных на промышленность, U1 призван помогать одиноким людям. При этом остаются технические и этические вопросы, связанные с его применением в быту.

читать →
~2 мин 266 просмотра

Anthropic выпустила Fable 5 и Mythos 5: обнаружены уязвимости

Anthropic выпустила модели Fable 5 и Mythos 5 9 июня. Исследователи из Министерства коммерции США обнаружили уязвимости в Fable 5 и показали, как их можно использовать. Это подчёркивает, что выпуск надёжной модели — более сложный процесс, чем просто вывод её на рынок.

LLM
читать →
~1 мин 277 просмотра
TechNews / AI

Meta* выбирает Тайвань для теста AI в Азии: цели и перспективы

Meta* тестирует AI в Тайване, чтобы оценить его полезность для сообщества и способность понимать особенности местной речи. Выбор острова обусловлен высокой активностью пользователей и тем, что он уже давно рассматривается как технологическая база для компании. Результаты теста могут повлиять на темпы выхода Meta* на другие азиатские рынки.

LLM
читать →
~2 мин 417 просмотра
QbitAI

Карта записи Dingding A1 отмечена в отчёте Gartner о носимых ИИ-устройствах

Gartner включила карту записи Dingding A1 в отчёт о носимых устройствах с ИИ. Устройство помогает сотрудникам эффективно записывать информацию и получать аналитические данные в реальном времени. Ключевое отличие Dingding A1 — тесная интеграция с корпоративным суперприложением Dingding.

читать →
~2 мин 485 просмотра
Leiphone

ICML за десять лет: эволюция взглядов на искусственный интеллект

На конференции ICML за десять лет были подняты ключевые вопросы развития искусственного интеллекта: от технологического оптимизма до осознания этических и практических сложностей. Выступления учёных отразили эволюцию взглядов — от веры в безграничные возможности алгоритмов до понимания важности этических аспектов и распределения полномочий между людьми и машинами. Особое внимание уделялось проблемам качества данных, справедливости и безопасности систем ИИ.

читать →
~4 мин 446 просмотра

Claude Code: невидимые метки в коде — вопрос прозрачности ИИ

Инструмент Claude Code тайно встраивает невидимые метки в код с помощью стеганографии. Это породило кризис доверия в индустрии ИИ‑агентов, поскольку пользователи не были предупреждены о такой практике. Чтобы снизить риски, важно выбирать прозрачные инструменты и проверять вывод ИИ на наличие скрытых символов.

LLM
читать →
~2 мин 297 просмотра
Computerwoche

Lakehouse как основа корпоративного ИИ: примеры Docusign и Lemongrass

Lakehouse становятся основой корпоративных ИИ-решений, объединяя преимущества озера данных и классического хранилища. Компании вроде Docusign и Lemongrass уже используют такие платформы, уделяя особое внимание безопасности данных. Следующим этапом развития станет внедрение семантических уровней, которые помогут ИИ лучше понимать бизнес-контекст.

читать →
~4 мин 256 просмотра
TechOrange

ИИ в футболе: анализ данных и поиск талантов на Чемпионате мира

ИИ всё активнее используется в футболе — от анализа данных во время матчей до поиска новых талантов. В Бразилии приложения с ИИ оценивают игру молодых футболистов, а небольшие страны применяют технологии, чтобы находить игроков. При этом внедрение ИИ требует больших ресурсов и может усилить разрыв между командами, а у автоматической оценки есть свои ограничения.

LLM
читать →
~3 мин 283 просмотра