19 августа стало известно о реорганизации команды Seed от ByteDance. В рамках изменений созданы четыре новых отдела: Pretrain Data (данные для предварительного обучения), Horizon RL (усиление обучения), Product Posttrain-Work (оптимизация моделей для офисных задач) и Product Posttrain-Chat (оптимизация для диалоговых сценариев).
Отдел Pretrain Data объединил ранее разрозненные команды, работавшие с текстом, кодом, визуальным и аудиоконтентом. В его структуре выделены поднаправления: текстовое, кодовое, визуальное и аудио предварительное обучение. Цель — обеспечить данными Omni-модели и сверхбольшие модели. Руководит отделом Ли Чэнган. Среди ключевых сотрудников — Шэнь Кэ (текстовое обучение), Ся Сяо (кодовое обучение), Линь И (визуальное обучение).
Horizon RL объединил команды, занимавшиеся разными направлениями пост-обучения (включая вывод и визуальное понимание). В составе три направления: масштабирование RL (Юэ Юй), рассуждение (Ван Минсюань) и визуальное усиление обучения (У Юйбинь). Цель — улучшить базовые интеллектуальные возможности моделей. Ван Минсюань ранее работал в Tencent, участвовал в соревнованиях по машинному переводу WMT. Юэ Юй — один из авторов системы RL DAPO, открытой совместно ByteDance и Tsinghua AIR.
Product Posttrain-Work ориентирован на бизнес-сегмент (B-сегмент). В его структуре — подразделение GUI (руководитель У Чжиюн) и объединённый отдел агентов для офисной работы. Задача — оптимизировать агентские способности моделей для офисных задач, включая поддержку Dola и Doubao. Руководитель отдела — Цинь Юйцзя, автор инструмента BMTools и GUI-агента UI-TARS.
Product Posttrain-Chat (бывший Application) нацелен на конечных пользователей (C-сегмент). Подразделения — Doubao и Dola Chat. Задача — улучшить поиск, диалоги, персонализацию и безопасность, контролируя затраты на вывод. Руководитель — Янь Линь, ранее возглавлял команду Alignment в модели Doubao.
Изменения отражают сдвиг фокуса: от разделения по типам моделей (текст, код, визуал) к разделению по задачам пользователей. ByteDance выделяет несколько направлений: Doubao и Dola для роста пользовательской базы, Work — для новых офисных сценариев с агентами, а Huoshan — для долгосрочных корпоративных сервисов и коммерциализации моделей. Аналогичные изменения происходят и у других игроков: например, Tencent объединил отделы больших и мультимодальных моделей, а Meta* перестроила суперинтеллектуальную лабораторию.
* Meta Platforms Inc. признана экстремистской организацией, её деятельность запрещена на территории РФ.