Дом
Tencent проводит перестановки в команде по работе с большими моделями, где Яо Шунью берет на себя руководство базовой моделью

Команда мультимодальных моделей Tencent Hunyuan недавно завершила масштабную реструктуризацию и стратегический поворот. Лу Сюдун, ранее руководивший работами по мультимодальному пониманию в xAI, присоединился к Hunyuan для руководства алгоритмами генерации мультимодального контента. Эти изменения совпали с ключевыми кадровыми перестановками, включая уход бывшего руководителя направления мультимодального понимания Ху Ханя для занятия предпринимательской деятельностью и приход Тянь Юнлуна, бывшего исследователя OpenAI. Эти шаги сигнализируют о существенном пересмотре подхода Tencent к разработке мультимодальных больших моделей.
Эволюция мультимодальных возможностей Tencent Hunyuan сосредоточена на нескольких ключевых продуктах. В конце 2024 года команда запустила HunyuanVideo, крупнейшую в мире открытую модель генерации видео по текстовому описанию, за которой последовало в 2025 году расширение функционала в направлениях генерации видео по изображениям, пользовательской генерации и анимации цифровых людей. Возможности генерации изображений эволюционировали от HunyuanImage к версии 2.1, поддерживающей нативное разрешение 2K, и версии 3.0 с 80 миллиардами параметров, что знаменует переход к производительности промышленного уровня. Тем временем Hy3D, унифицированная 3D-модель, широко используется в электронной коммерции и промышленном дизайне. В области пространственного интеллекта Tencent представила Hy World 1.0, первую в мире открытую модель генерации иммерсивных 3D-сцен, готовую к симуляции, при этом последующие версии продолжают продвигать исследования в области пространственного интеллекта.
По мере консолидации подразделений больших языковых моделей и мультимодальных моделей Tencent в «Отдел базовых моделей» под руководством Яо Шуньюя, стратегия исследований и разработок претерпела фундаментальные изменения. Текущий технический дорожный план отражает отраслевые дискуссии о роли мультимодальных систем в основном направлении развития ИИ. Фэйфэй Ли из World Labs утверждает, что модели мира, как компоненты пространственного интеллекта, являются центральными для достижения искусственного общего интеллекта (AGI). В свою очередь, DeepSeek выступает за использование визуальных модальностей как инструментов поддержки языковых моделей, снижая акцент на самостоятельной разработке 3D-моделей или моделей мира.
Недавние стратегические инициативы Яо Шуньюя, включая флагманский продукт Hy3, указывают на предпочтение последнего подхода. Он неизменно заявлял, что следующее конкурентное преимущество ИИ заключается в обработке контекста и рассуждениях, а не просто в количестве параметров. Интегрируя мультимодальное понимание в архитектуру основной модели и улучшая стабильность вызова инструментов и поддержку длинного контекста, Tencent стремится повысить эффективность моделей в реальных офисных средах и приложениях GUI Agent. Добавление Лу Сюдуна усиливает возможности мультимодального понимания, решая такие распространенные проблемы, как несоответствие генерации и пространственная нестабильность. Эта реструктуризация подчеркивает внутреннюю стратегическую эволюцию Tencent и ее приверженность фокусу на продуктивности и ключевых возможностях на следующем этапе развития AGI.
Связанная статья
Стратегия Трампа в области искусственного интеллекта: что ждет политику США в будущем
3 августа пять сенаторов-демократов призвали администрацию Трампа разъяснить подход к регулированию передовых моделей искусственного интеллекта, выразив обеспокоенность в связи с угрозой со стороны ки
Платформа Tongyi Qianwen открыта для разработчиков, предоставляя возможности диалогов как сервиса в повседневной жизни
Платета Tongyi Qianwen Open Platform официально запущена, предоставляя разработчикам доступ к услугам на мобильных устройствах, ПК и умных очках. Пользователям больше не нужно переключаться между приложениями; они могут выполнять различные повседневн
Пакеты Swiftlet 80B Qwen в Mac с памятью 4,3 ГБ; iPhone 17 будет работать с 35B нативно
Swiftlet — среда выполнения на базе Swift и Metal, которая переосмысливает понятие «места, где могут запускаться большие модели». Она специально адаптирована для семейства MoE (Mixture of Experts) моделей Qwen3-Next и Qwen3.5/3.6. Основная идея довол
Рекомендации по связанным специальным темам
Комментарии (0)

Команда мультимодальных моделей Tencent Hunyuan недавно завершила масштабную реструктуризацию и стратегический поворот. Лу Сюдун, ранее руководивший работами по мультимодальному пониманию в xAI, присоединился к Hunyuan для руководства алгоритмами генерации мультимодального контента. Эти изменения совпали с ключевыми кадровыми перестановками, включая уход бывшего руководителя направления мультимодального понимания Ху Ханя для занятия предпринимательской деятельностью и приход Тянь Юнлуна, бывшего исследователя OpenAI. Эти шаги сигнализируют о существенном пересмотре подхода Tencent к разработке мультимодальных больших моделей.
Эволюция мультимодальных возможностей Tencent Hunyuan сосредоточена на нескольких ключевых продуктах. В конце 2024 года команда запустила HunyuanVideo, крупнейшую в мире открытую модель генерации видео по текстовому описанию, за которой последовало в 2025 году расширение функционала в направлениях генерации видео по изображениям, пользовательской генерации и анимации цифровых людей. Возможности генерации изображений эволюционировали от HunyuanImage к версии 2.1, поддерживающей нативное разрешение 2K, и версии 3.0 с 80 миллиардами параметров, что знаменует переход к производительности промышленного уровня. Тем временем Hy3D, унифицированная 3D-модель, широко используется в электронной коммерции и промышленном дизайне. В области пространственного интеллекта Tencent представила Hy World 1.0, первую в мире открытую модель генерации иммерсивных 3D-сцен, готовую к симуляции, при этом последующие версии продолжают продвигать исследования в области пространственного интеллекта.
По мере консолидации подразделений больших языковых моделей и мультимодальных моделей Tencent в «Отдел базовых моделей» под руководством Яо Шуньюя, стратегия исследований и разработок претерпела фундаментальные изменения. Текущий технический дорожный план отражает отраслевые дискуссии о роли мультимодальных систем в основном направлении развития ИИ. Фэйфэй Ли из World Labs утверждает, что модели мира, как компоненты пространственного интеллекта, являются центральными для достижения искусственного общего интеллекта (AGI). В свою очередь, DeepSeek выступает за использование визуальных модальностей как инструментов поддержки языковых моделей, снижая акцент на самостоятельной разработке 3D-моделей или моделей мира.
Недавние стратегические инициативы Яо Шуньюя, включая флагманский продукт Hy3, указывают на предпочтение последнего подхода. Он неизменно заявлял, что следующее конкурентное преимущество ИИ заключается в обработке контекста и рассуждениях, а не просто в количестве параметров. Интегрируя мультимодальное понимание в архитектуру основной модели и улучшая стабильность вызова инструментов и поддержку длинного контекста, Tencent стремится повысить эффективность моделей в реальных офисных средах и приложениях GUI Agent. Добавление Лу Сюдуна усиливает возможности мультимодального понимания, решая такие распространенные проблемы, как несоответствие генерации и пространственная нестабильность. Эта реструктуризация подчеркивает внутреннюю стратегическую эволюцию Tencent и ее приверженность фокусу на продуктивности и ключевых возможностях на следующем этапе развития AGI.
Стратегия Трампа в области искусственного интеллекта: что ждет политику США в будущем
3 августа пять сенаторов-демократов призвали администрацию Трампа разъяснить подход к регулированию передовых моделей искусственного интеллекта, выразив обеспокоенность в связи с угрозой со стороны ки
Платформа Tongyi Qianwen открыта для разработчиков, предоставляя возможности диалогов как сервиса в повседневной жизни
Платета Tongyi Qianwen Open Platform официально запущена, предоставляя разработчикам доступ к услугам на мобильных устройствах, ПК и умных очках. Пользователям больше не нужно переключаться между приложениями; они могут выполнять различные повседневн
Пакеты Swiftlet 80B Qwen в Mac с памятью 4,3 ГБ; iPhone 17 будет работать с 35B нативно
Swiftlet — среда выполнения на базе Swift и Metal, которая переосмысливает понятие «места, где могут запускаться большие модели». Она специально адаптирована для семейства MoE (Mixture of Experts) моделей Qwen3-Next и Qwen3.5/3.6. Основная идея довол











