Дом
Появилась официальная поддержка Tongyi Qianwen: Unsloth Dynamic V3 уменьшила размер модели Qwen3.8-27B, а её 1-битная версия работает на 8 ГБ памяти
Тонги Цяньвэнь (Qwen) недавно публично поблагодарил команду Unsloth за выпуск квантованной версии Qwen3.8-27B GGUF, отметив, что она стала «меньше и умнее». Этот обмен мнениями вызвал широкую дискуссию в сообществе открытого исходного кода, что подчеркивает неуклонное снижение барьеров для локального развертывания крупных моделей.
Официальное заявление: Tongyi Qianwen благодарит Unsloth
В своём официальном заявлении Tongyi Qianwen выразила искреннюю благодарность за работу Unsloth, назвав её отличной новостью для сообщества и призвав пользователей опробовать эту «более компактную и умную» версию Qwen3.8-27B. Этот шаг подчеркивает растущую синергию между разработчиками моделей с открытым исходным кодом и поставщиками решений по оптимизации квантования.

Значительное обновление решения для квантования Unsloth Dynamic V3
Новейшее решение Unsloth по квантованию Dynamic V3 (v3.0) специально оптимизировано для Qwen3.8-27B. Согласно официальным данным, этот подход повышает точность более чем на 10 % по сравнению с другими распространенными методами квантования при том же размере файла, обеспечивая исключительную производительность в ключевых тестах, таких как Div-300 и KLD (KL Divergence).
Данное обновление выходит за рамки простого сжатия. Благодаря использованию усовершенствованных методов квантования после обучения оно лучше сохраняет качество выходных данных исходной модели, практически не уступая по производительности при полной точности в задачах кодирования интеллектуальных агентов, ведения диалога и многоязыковых задач. Соответствующие файлы GGUF теперь доступны на Hugging Face и поддерживают популярные инструменты для инференса, такие как llama.cpp и Unsloth Desktop.
Версия с 1-битной квантованием: работает с 8 ГБ памяти
Примечательно, что Unsloth также выпустила версию с 1-битной квантованием. Этот вариант сохраняет точность на уровне примерно 77%, при этом значительно сокращая потребность в ресурсах, что позволяет работать на устройствах с объемом памяти всего 8 ГБ. Некоторые сверхсжатые варианты (такие как UD-IQ1_S, около 6,2 ГБ) уменьшают размер файла примерно на 89 % по сравнению с полной точностью, при этом сохраняя приемлемую производительность.
Ранее для запуска Qwen3.8-27B с 4-битной квантованием обычно требовалось 16–19 ГБ видеопамяти или системной памяти. Теперь эти варианты с низкой разрядностью позволяют использовать эту мультимодальную модель с 27 миллиардами параметров на стандартных ноутбуках и потребительских устройствах.
Значение для локальной экосистемы ИИ
Qwen3.8-27B изначально поддерживает мультимодальные возможности, имеет контекстное окно размером 262K (расширяемое примерно до 1 миллиона токенов) и отлично подходит для сценариев программирования и офисных рабочих процессов. Модель, лицензированная по Apache 2.0, органично сочетается с квантованием Dynamic V3 от Unsloth, что позволяет разработчикам с большей лёгкостью выполнять инференс и тонкую настройку локально, сокращая зависимость от облачной инфраструктуры.
AIbase считает, что плодотворное сотрудничество между Tongyi Qianwen и Unsloth, наряду с двойным прорывом в точности и эффективности, обеспеченным Dynamic V3, знаменует начало новой эры в локализации крупных моделей с открытым исходным кодом. Заинтересованные разработчики могут скачать последние файлы GGUF с Hugging Face и ознакомиться с официальной документацией Unsloth, где приведены инструкции по настройке.
Связанная статья
OpenAI запускает GPT-6 Astra, что становится важным шагом на пути к созданию общего искусственного интеллекта
Компания OpenAI официально представила свою новейшую флагманскую модель большого языкового моделирования — GPT-6Astra. В ходе брифинга для СМИ президент компании Грег Брокман высоко оценил эту модель,
Wayve объявляет о проведении тендерного предложения по выкупу акций сотрудников на сумму 85 млн долларов при оценке компании в 8,5 млрд долларов
Wayve, британский стартап, занимающийся технологиями автономного вождения, предоставляет своим сотрудникам возможность продать часть своих акций, права на которые уже вступили в силу, в рамках тендерн
Сэм Альтман предостерегает от утверждений о том, что Клод обладает сознанием
Мустафа Сулейман, руководитель подразделения искусственного интеллекта в Microsoft, недавно в эфире подкаста «Decoder» назвал «крайне опасными» предположения компании Anthropic о том, что её крупная я
Рекомендации по связанным специальным темам
Комментарии (0)
Тонги Цяньвэнь (Qwen) недавно публично поблагодарил команду Unsloth за выпуск квантованной версии Qwen3.8-27B GGUF, отметив, что она стала «меньше и умнее». Этот обмен мнениями вызвал широкую дискуссию в сообществе открытого исходного кода, что подчеркивает неуклонное снижение барьеров для локального развертывания крупных моделей.
Официальное заявление: Tongyi Qianwen благодарит Unsloth
В своём официальном заявлении Tongyi Qianwen выразила искреннюю благодарность за работу Unsloth, назвав её отличной новостью для сообщества и призвав пользователей опробовать эту «более компактную и умную» версию Qwen3.8-27B. Этот шаг подчеркивает растущую синергию между разработчиками моделей с открытым исходным кодом и поставщиками решений по оптимизации квантования.

Значительное обновление решения для квантования Unsloth Dynamic V3
Новейшее решение Unsloth по квантованию Dynamic V3 (v3.0) специально оптимизировано для Qwen3.8-27B. Согласно официальным данным, этот подход повышает точность более чем на 10 % по сравнению с другими распространенными методами квантования при том же размере файла, обеспечивая исключительную производительность в ключевых тестах, таких как Div-300 и KLD (KL Divergence).
Данное обновление выходит за рамки простого сжатия. Благодаря использованию усовершенствованных методов квантования после обучения оно лучше сохраняет качество выходных данных исходной модели, практически не уступая по производительности при полной точности в задачах кодирования интеллектуальных агентов, ведения диалога и многоязыковых задач. Соответствующие файлы GGUF теперь доступны на Hugging Face и поддерживают популярные инструменты для инференса, такие как llama.cpp и Unsloth Desktop.
Версия с 1-битной квантованием: работает с 8 ГБ памяти
Примечательно, что Unsloth также выпустила версию с 1-битной квантованием. Этот вариант сохраняет точность на уровне примерно 77%, при этом значительно сокращая потребность в ресурсах, что позволяет работать на устройствах с объемом памяти всего 8 ГБ. Некоторые сверхсжатые варианты (такие как UD-IQ1_S, около 6,2 ГБ) уменьшают размер файла примерно на 89 % по сравнению с полной точностью, при этом сохраняя приемлемую производительность.
Ранее для запуска Qwen3.8-27B с 4-битной квантованием обычно требовалось 16–19 ГБ видеопамяти или системной памяти. Теперь эти варианты с низкой разрядностью позволяют использовать эту мультимодальную модель с 27 миллиардами параметров на стандартных ноутбуках и потребительских устройствах.
Значение для локальной экосистемы ИИ
Qwen3.8-27B изначально поддерживает мультимодальные возможности, имеет контекстное окно размером 262K (расширяемое примерно до 1 миллиона токенов) и отлично подходит для сценариев программирования и офисных рабочих процессов. Модель, лицензированная по Apache 2.0, органично сочетается с квантованием Dynamic V3 от Unsloth, что позволяет разработчикам с большей лёгкостью выполнять инференс и тонкую настройку локально, сокращая зависимость от облачной инфраструктуры.
AIbase считает, что плодотворное сотрудничество между Tongyi Qianwen и Unsloth, наряду с двойным прорывом в точности и эффективности, обеспеченным Dynamic V3, знаменует начало новой эры в локализации крупных моделей с открытым исходным кодом. Заинтересованные разработчики могут скачать последние файлы GGUF с Hugging Face и ознакомиться с официальной документацией Unsloth, где приведены инструкции по настройке.
OpenAI запускает GPT-6 Astra, что становится важным шагом на пути к созданию общего искусственного интеллекта
Компания OpenAI официально представила свою новейшую флагманскую модель большого языкового моделирования — GPT-6Astra. В ходе брифинга для СМИ президент компании Грег Брокман высоко оценил эту модель,
Wayve объявляет о проведении тендерного предложения по выкупу акций сотрудников на сумму 85 млн долларов при оценке компании в 8,5 млрд долларов
Wayve, британский стартап, занимающийся технологиями автономного вождения, предоставляет своим сотрудникам возможность продать часть своих акций, права на которые уже вступили в силу, в рамках тендерн
Сэм Альтман предостерегает от утверждений о том, что Клод обладает сознанием
Мустафа Сулейман, руководитель подразделения искусственного интеллекта в Microsoft, недавно в эфире подкаста «Decoder» назвал «крайне опасными» предположения компании Anthropic о том, что её крупная я











