вариант
Параметр модели
32B
Параметр модели
Аффилированная организация
Alibaba
Аффилированная организация
Открытый исходный код
Тип лицензии
Время выпуска
3 апреля 2024 г.
Время выпуска

Введение модели
Qwen1.5 является бета-версией Qwen2, сохраняя архитектуру декодера-только с активацией SwiGLU, RoPE и механизмом многозадачного внимания. Она предлагает девять размеров моделей и имеет усиленные возможности многоязычных и чат-моделей, поддерживающих длину контекста до 32,768 токенов. Все модели имеют включенные системные подсказки для ролевых игр, и код поддерживает нативную реализацию в transformers.
Смахните влево и вправо, чтобы посмотреть больше
Способность к пониманию языка Способность к пониманию языка
Способность к пониманию языка
Может справиться с базовым пониманием повседневных разговоров, но борьбу с метафорами и техническими терминами.
6.0
Объем знаний Объем знаний
Объем знаний
Имеет значительные знания слепых пятен, часто показывающих фактические ошибки и повторяющуюся устаревшую информацию.
6.8
Способность рассуждать Способность рассуждать
Способность рассуждать
Невозможно поддерживать последовательные сети рассуждений, часто вызывая инвертированную причинность или просчеты.
4.1
Связанная модель
Qwen3.6-27B Qwen3.6 — это модель с открытым исходным кодом нового поколения из семейства Qwen и усовершенствованная версия серии Qwen3.5.
Qwen3.5-397B-A17B Qwen3.5 — это важная базовая модель, недавно выпущенная компанией Alibaba, которая отличается комплексными усовершенствованиями в области мультимодального слияния данных, эффективной гибридной архитектурой, масштабируемым обучением с подкреплением, поддержкой нескольких языков и инфраструктурой обучения, а также значительно улучшенной производительностью и практической применимостью.
Qwen3.6-Max-Preview Qwen3.6-Max-Preview — это флагманская проприетарная модель Qwen, ориентированная на более глубокое логическое мышление, решение сложных задач и высокое качество диалога.
Qwen3-Next-80B-A3B-Thinking Последняя выпущенная серия Qwen3-Next в моделях Qwen, улучшающая эффективность масштабирования за счет инновационной архитектуры модели.
Qwen3-235B-A22B-Thinking-2507 Qwen3 — это последнее поколение крупных языковых моделей серии Qwen, предлагающее комплексный набор плотных моделей и моделей типа «смесь экспертов» (MoE).
Соответствующие документы
Генеральный директор Meituan Ван Син: ИИ-агенты оказывают более сильное воздействие, чем ChatGPT Во время сессии управленческого общения 13 марта 2026 года генеральный директор Meituan Чжан Ван обсудил траекторию развития искусственного интеллекта (ИИ). Он утверждал, что трансформация, движимая ИИ, превзойдет влияние всей эпохи Интернета. Провод
Дженсен Хуанг раскрыл «совершенно новую» рыночную возможность Nvidia стоимостью 200 млрд долларов Основатель и генеральный директор Nvidia Дженсен Хуанг выделяется как один из самых убедительных корпоративных визионеров, если не самый выдающийся, в продвижении нарратива своей компании. Он может даже затмить Марка Бениоффа из Salesforce своим непо
Hugging Face ведет переговоры о приобретении за 13 млрд долларов В выходные Business Insider сообщил, что к Hugging Face поступали предложения о продаже компании с оценкой в 13 миллиардов долларов или выше.Платформа стартапа и его сообщество с открытым исходным кодом являются площадкой, где разработчики и исследо
Lovable запускает мобильное приложение для написания кода с поддержкой голосовых команд для создания веб-приложений 28 апреля Lovable официально запустила свой no-code ИИ-инструмент для создания приложений для iOS и Android. Платформа, основанная на концепции «Vibe Coding», позволяет пользователям фиксировать идеи с помощью голосовых или текстовых подсказок и мгно
Суперинтеллект прибыл: впустим ли мы его? Загрузка плеера…Компании, занимающиеся искусственным интеллектом, говорят о сверхинтеллектуальном ИИ так, будто это неизбежно, но недавние инциденты с безопасностью, такие как взлом Hugging Face компанией OpenAI, демонстрируют потенциальные опасност
Сравнение модели
Начните сравнение
OR