вариант
Дом
Новости
Предварительный обзор Hy3: первый релиз с открытым исходным кодом после реорганизации Yuan, отличающийся повышенной практичностью и расширенными возможностями агентов

Предварительный обзор Hy3: первый релиз с открытым исходным кодом после реорганизации Yuan, отличающийся повышенной практичностью и расширенными возможностями агентов

1 июня 2026 г.
211

23 апреля подразделение Huan Yuan компании Tencent выпустило языковую модель Hy3preview в виде открытого исходного кода. Эта гибридная экспертная модель сочетает в себе быстрое и медленное мышление, имеет 295 миллиардов параметров и 21 миллиард активированных параметров, а также поддерживает контекст длиной до 256K. Это первая модель, обученная после реорганизации Huan Yuan, и самая интеллектуальная модель в истории Huan Yuan, обеспечивающая существенный рост производительности в области сложного мышления, выполнения инструкций, контекстного обучения, генерации кода, возможностей агентов и общей эффективности мышления.

В феврале 2026 года Tencent Huan Yuan реструктурировала свою инфраструктуру предварительного обучения и обучения с подкреплением, а также установила три руководящих принципа для достижения практической полезности:

1. Системные возможности: вместо того, чтобы делать акцент на специализации, мы признаем, что даже одно приложение, такое как агент кода, требует глубокого взаимодействия между рассуждениями, обработкой длинного контекста, выполнением инструкций, диалогом, кодированием и использованием инструментов.

2. Аутентичная оценка: выходя за рамки легко поддающихся манипуляциям публичных тестов, мы оцениваем и повышаем реальную эффективность модели с помощью вопросов, разработанных внутри компании, последних наборов экзаменационных заданий, оценки людьми, крауд-тестирования конкретных продуктов и других методов.

3. Ориентация на экономическую эффективность: практическая применимость должна соответствовать коммерческой жизнеспособности. Тщательно совместно разработанная архитектура модели и инфраструктура вывода существенно снижают затраты на выполнение задач, делая ИИ доступным и эффективным.

Hy3preview знаменует начало ускоренного стремления Huan Yuan к созданию практичных больших языковых моделей, решающих реальные проблемы.

Яо Шуню, главный научный сотрудник Tencent по ИИ, отметил, что Hy3preview — это первый шаг в реконструкции модели Huan Yuan. Благодаря этому релизу с открытым исходным кодом мы надеемся получить искреннюю обратную связь от сообщества и пользователей, что поможет усовершенствовать практическую применимость официальной версии Hy3. В то же время мы продолжаем расширять масштабы предварительного обучения и обучения с подкреплением, повышая интеллектуальный потенциал модели. Благодаря тесному совместному проектированию с многочисленными продуктами Tencent мы неуклонно повышаем реальную производительность модели и начинаем исследовать возможности специализированных моделей.

В настоящее время Hy3preview доступна на Tencent Cloud, Yua, ima, CodeBuddy, WorkBuddy, QQ, QQ Browser, Tencent Docs и Tencent LeXiang. Другие крупные продукты, такие как официальный аккаунт WeChat, Peace Elite, Tencent News, Tencent Stock Selection, Tencent Customer Service и WeChat Reading, постепенно внедряются. Кроме того, Hy3preview интегрируется с популярными фреймворками агентов с открытым исходным кодом, такими как OpenClaw, OpenCode и KiloCode, и представлен на платформе обслуживания больших моделей Tencent Cloud — TokenHub.

Hy3preview делает акцент на всесторонней практичности, значительно расширяя возможности агентов

Многочисленные оценки подтверждают, что возможности Hy3preview были значительно улучшены.

1.Превосходные возможности обучения в контексте и выполнения инструкций

В разнообразных реальных производственных и повседневных сценариях анализ беспорядочных, длинных контекстов и соблюдение сложных, меняющихся правил остаются ключевой проблемой для моделей. Опираясь на бизнес-кейсы Tencent, Хуань Юань представил CL-bench и CL-bench-Life для инновационной оценки обучения в контексте и значительно улучшил способности Hy3preview к обучению в контексте и выполнению инструкций.

image.png

2. Исключительная способность к сложному рассуждению, позволившая получить максимальный балл на квалификационном экзамене по математике для докторантов в Университете Цинхуа в Китае

Сложное рассуждение лежит в основе способности модели решать разнообразные задачи. Hy3preview продемонстрировал превосходные результаты в сложных тестах по рассуждению в области STEM, таких как FrontierScience-Olympiad и IMOAnswerBench, а также достиг выдающихся результатов на последнем экзамене на соискание степени доктора математических наук в Академии Цучжэнь Университета Цинхуа (весна 2026 г.) и Национальном конкурсе по биологии среди старшеклассников (CHSBO2025), продемонстрировав надежное обобщенное рассуждение.

image.png

3. Значительные усовершенствования в возможностях кода и агентов, демонстрирующие высокую экономическую эффективность

Возможности кода и агентов являются наиболее заметными улучшениями в Hy3preview. Благодаря обновленной инфраструктуре предварительного обучения и обучения с подкреплением, а также расширенному масштабу задач RL, Tencent Huan Yuan быстро достиг конкурентоспособных результатов в ведущих тестах для кодовых агентов, таких как SWE-Bench Verified и Terminal-Bench2.0, а также в тестах для поисковых агентов, таких как BrowseComp и WideSearch.

image.png

В цифровой сфере код измеряет способность модели выполнять задачи в средах разработки, в то время как поиск оценивает ее способность извлекать, фильтровать и синтезировать информацию из открытых источников. Вместе они определяют, действительно ли модель полезна в сложных сценариях с агентами, таких как OpenClaw. Hy3preview достиг высоких результатов в таких оценках, как ClawEval и WildClawBench, показав, что возможности наших агентов неуклонно продвигаются к полноте и практичности.

image.png

Помимо общедоступных тестов, Tencent Huan Yuan создал несколько наборов внутренних оценок для определения производительности модели в реальных условиях разработки. Результаты показывают, что в наборе задач бэкэнд-инженерии Hy-Backend, ориентированном на разработчиков тесте Hy-Vibe Bench и сложном наборе задач программной инженерии Hy-SWE Max, Hy3preview продемонстрировал высокую конкурентоспособность.

48920987-bdbb-464b-adca-513891f742e1.png

При сравнении размера модели и общей производительности агента с альтернативными решениями с открытым исходным кодом Hy3preview выделяется своей высокой экономической эффективностью.

image.png

Основные направления деятельности Tencent полностью интегрированы, и ряд ключевых продуктов на базе ИИ демонстрирует очевидные преимущества

До официального запуска Hy3preview был протестирован на основных продуктах Tencent в области ИИ, что принесло заметные положительные результаты.

Что касается Yua, то Huan Yuan и Yua прошли глубокую совместную разработку. Производительность модели по ключевым показателям, таким как точность понимания намерений, качество генерации текста и глубокий поиск, была улучшена, а также была проведена тонкая настройка стиля письма, выражений, эмоционального интеллекта, структуры контента и профессионализма. Такое тесное сотрудничество между моделью и продуктом обеспечило пользователям более интеллектуальный и человекоподобный опыт взаимодействия.

В сценариях вопросов и ответов на основе базы знаний и общих вопросов и ответов ima тесты показали, что Hy3preview отлично справляется с обработкой длинных текстов, особенно в задачах поиска, где он обеспечивает высокую точность, охват и полноту ответов.

В CodeBuddy и WorkBuddy задержка первого токена Hy3preview сократилась на 54%, продолжительность сквозного процесса уменьшилась на 47%, а коэффициент успешности поднялся до более чем 99,99%. В реальных пользовательских средах он стабильно управляет сложными рабочими процессами агентов, насчитывающими до 495 шагов, охватывающими разнообразные офисные задачи, такие как обработка документов, анализ данных, поиск знаний и оркестрация инструментария MCP.

В специальных оценках ИИ-аватара официального аккаунта WeChat и ИИ-службы поддержки клиентов Hy3preview продемонстрировал более всесторонние улучшения по сравнению с Hy2. Он показал большую зрелость в понимании намерений пользователя, продолжении сложного контекста и организации знаний. При работе с неоднозначными запросами, короткими предложениями и многоходовыми диалогами система лучше улавливала потребности пользователей и давала более четкие и стабильные ответы. Благодаря интеграции баз знаний, пользовательской памяти и генерации контекста, ее вывод более точно соответствовал роли ИИ-аватара или службы поддержки, что значительно сократило количество чрезмерных домыслов, субъективных предположений и эмоционального тона, приблизив общее взаимодействие к «надежному, естественному и эффективному» опыту.

В сценарии с ИИ-НПЦ в Peace Elite команда быстро интегрировала и оценила Hy3preview после его выпуска, получив впечатляющие общие результаты. В ролевой игре с персонажами вне игры Hy3preview точно улавливал настройки персонажей и предоставлял высокорелевантный контент с добавленной стоимостью для открытых вопросов, создавая более реалистичный, естественный и иммерсивный диалог. Во время сложных игровых боевых сценариев время отклика модели было близко к времени отклика реальных игроков, демонстрируя отличную стабильность и человекоподобные навыки ролевой игры, что сделало ее общую производительность исключительной.

В сценарии AI PPT Tencent Docs по сравнению с предыдущей версией Hy2 Hy3preview продемонстрировала значительные улучшения: успешность генерации выросла на 20%, оценки улучшились на 10%, а время генерации сократилось на 20%. В целом новая модель превосходила предыдущую в выборе шаблонов, подборе цветов, генерации контуров и дополнении контента — без галлюцинаций, с тематической согласованностью и высокой визуальной привлекательностью.

Что касается AI-помощника QQ Xiao Q, по сравнению с предыдущей версией Hy3preview обеспечила значительную оптимизацию задержки первого байта при обработке длинных текстов, общей скорости отклика и эффективности потоковой передачи. Такие ключевые возможности, как математическое мышление, значительно улучшились, а выполнение инструкций в различных сценариях и способность к обобщению были еще более усовершенствованы. В области рассуждений с вызовом инструментов и разрешения ссылок в многоходовых диалогах он продемонстрировал более стабильную и эффективную производительность. В официальном тесте сценариев интеллектуальных агентов PinchBench QQ от OpenClaw он достиг выдающихся результатов, а общий пользовательский опыт заметно улучшился.

Эффективность рассуждений улучшилась на 40%, обеспечив оптимальную плотность интеллекта при тех же затратах

Благодаря тесному взаимодействию между моделью и инференционной средой, а также комплексной оптимизации инференционной среды, производительности операторов, алгоритмов квантования и других компонентов, общая эффективность вывода улучшилась на 40%, а стоимость Hy3preview значительно снизилась по сравнению с предыдущим поколением.

На платформе обслуживания больших моделей Tencent Cloud TokenHub цена ввода Hy3preview составляет всего 1,2 юаня за миллион токенов, кэш ввода — 0,4 юаня за миллион токенов, а вывода — 4 юаня за миллион токенов. Кроме того, Tencent Cloud и Huan Yuan совместно представили индивидуальный пакет Hy3preview Token Plan, стоимость которого в личной версии начинается от 28 юаней в месяц, предлагая экономичный вариант для разработки агентов и создания приложений «Lobster».

image.png

image.png

Связанная статья
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт
Кубок Суперкубок Alibaba: Qwen3.8-Max дебютирует с улучшенными инструментами для программирования и офисными приложениями Кубок Суперкубок Alibaba: Qwen3.8-Max дебютирует с улучшенными инструментами для программирования и офисными приложениями Alibaba официально представила Qwen3.8-Max — новую базовую большую модель с 2,4 триллиона параметров. Это значимое достижение в области искусственного интеллекта обеспечивает существенное улучшение производительности в ключевых областях, таких как пр
Рекомендации по связанным специальным темам
Музыкальная композиция Лучшие инструменты для написания мелодий с помощью ИИ для черновиков песен
Лучшие инструменты для написания мелодий с помощью ИИ для черновиков песен

2026 год: лучшие, топовые и высокооценённые инструменты ИИ для написания мелодий для черновиков песен! XIX.AI подобрал высокоэффективную коллекцию, меняющую правила игры, которая прошла строгие реальные испытания, чтобы обеспечить лучший опыт написания. Вы можете найти подробные сравнения бесплатных и платных версий, точные рейтинги и обязательные к использованию варианты, разработанные, чтобы помочь вам создавать потрясающие черновики песен без усилий и значительно повысить вашу творческую продуктивность. Исследуйте сейчас, чтобы найти свой идеальный инструмент!

8 инструментов
xix.ai
чат-бот Лучшие инструменты для тренировки разговоров с помощью ИИ для подготовки к собеседованиям
Лучшие инструменты для тренировки разговоров с помощью ИИ для подготовки к собеседованиям

2026 г. — новейшие, лучшие и наиболее высоко оцененные инструменты для тренировки разговорных навыков с помощью ИИ для подготовки к собеседованиям уже доступны на XIX.AI! Эта тщательно отобранная подборка включает мощные, революционные инструменты, прошедшие строгие реальные испытания и обеспечивающие точную обратную связь. Вы найдете сравнение бесплатных и платных вариантов, а также подробные рейтинги, которые помогут вам выбрать наиболее подходящий инструмент, повышающий вашу уверенность и навыки. Исследуйте сейчас, чтобы найти идеальный инструмент для успешного прохождения собеседований!

12 инструментов
xix.ai
Дизайн и искусство Лучшие инструменты для переноса стилей с помощью ИИ для творческих экспериментов
Лучшие инструменты для переноса стилей с помощью ИИ для творческих экспериментов

2026: лучшие и самые популярные инструменты для переноса стиля с помощью ИИ для творческих экспериментов! XIX.AI подготовила подборку мощных, революционных инструментов, которые обязательно стоит попробовать: они демонстрируют исключительные результаты, подтвержденные реальными тестами и тщательным рейтингом. Эти ведущие решения помогают творческим людям значительно повысить продуктивность, ускоряя создание контента и открывая безграничные творческие возможности. Ознакомьтесь с ними прямо сейчас, чтобы найти идеальный инструмент и начать творить уже сегодня!

9 инструментов
xix.ai
Создание комиксов Лучшие инструменты для создания диалоговых пузырей с помощью ИИ для визуального повествования
Лучшие инструменты для создания диалоговых пузырей с помощью ИИ для визуального повествования

2026 года: самые новые и лучшие инструменты с ИИ для создания диалоговых пузырей в визуальном сторителлинге представлены на XIX.AI! В этой тщательно подобранной подборке представлены мощные, революционные инструменты, которые помогут творческим людям повысить продуктивность и преодолеть творческие кризисы. Ознакомьтесь со сравнением бесплатных и платных версий, посмотрите тесты в реальных условиях и изучите последние рейтинги, чтобы найти решения, которые обязательно стоит попробовать и которые идеально подходят для создания увлекательных визуальных историй. Исследуйте коллекцию прямо сейчас, чтобы найти свой идеальный инструмент!

10 инструментов
xix.ai
Помощник по встречам Лучшие инструменты для составления отчетов о встречах с использованием ИИ: четкое отслеживание решений и последующих действий
Лучшие инструменты для составления отчетов о встречах с использованием ИИ: четкое отслеживание решений и последующих действий

2026: Последние версии лучших инструментов для составления отчетов о встречах с помощью ИИ, обеспечивающих четкое отслеживание решений и удобное выполнение последующих действий. В этом тщательно подобранном списке представлены мощные, революционные решения, которые значительно повышают продуктивность за счет автоматизации ведения протоколов встреч, выявления ключевых задач и оптимизации координации работы команды по всем проектам. Получите сравнение бесплатных и платных версий, а также результаты реальных тестов и еженедельно обновляемые рейтинги, которые помогут вам найти идеальный инструмент. Ознакомьтесь с ними прямо сейчас, чтобы раскрыть потенциал искусственного интеллекта!

9 инструментов
xix.ai
Анализ данных Лучшие инструменты для очистки данных с использованием ИИ: быстрое устранение пропущенных значений и дубликатов
Лучшие инструменты для очистки данных с использованием ИИ: быстрое устранение пропущенных значений и дубликатов

2026 год: лучшие и наиболее высоко оценённые инструменты для очистки данных с ИИ, предназначенные для быстрого устранения пропущенных значений и дубликатов. В этом тщательно отобранном списке представлены мощные решения, способные кардинально повысить производительность. Каждый инструмент прошёл строгие тестирования в реальных условиях для обеспечения надёжности. Получите бесплатное сравнение версий с платной и найдите инструмент, который наилучшим образом соответствует вашим потребностям. Ознакомьтесь с ним прямо сейчас на сайте XIX.AI, чтобы раскрыть полный потенциал работы с ИИ.

11 инструментов
xix.ai
Комментарии (0)
0/500
OR