вариант
Дом
Список моделей AL
DeepSeek-V2-Chat-0628
Параметр модели
236B
Параметр модели
Аффилированная организация
DeepSeek
Аффилированная организация
Открытый исходный код
Тип лицензии
Время выпуска
6 мая 2024 г.
Время выпуска

Введение модели
DeepSeek-V2 — это мощная модель языка типа Mixture-of-Experts (MoE), характеризующаяся экономичностью обучения и эффективностью вывода. Она содержит 236 миллиардов общих параметров, из которых 21 миллиард активируется для каждого токена. В сравнении с DeepSeek 67B, DeepSeek-V2 демонстрирует более высокую производительность, при этом экономя 42,5% затрат на обучение, снижая объем KV-кэша на 93,3% и увеличивая максимальную пропускную способность генерации до 5,76 раз.
Смахните влево и вправо, чтобы посмотреть больше
Способность к пониманию языка Способность к пониманию языка
Способность к пониманию языка
Часто делает семантические ошибки, что приводит к очевидным логическим отключениям в ответах.
4.6
Объем знаний Объем знаний
Объем знаний
Обладает основными знаниями в основных дисциплинах, но имеет ограниченный охват передовых междисциплинарных полей.
7.8
Способность рассуждать Способность рассуждать
Способность рассуждать
Невозможно поддерживать последовательные сети рассуждений, часто вызывая инвертированную причинность или просчеты.
4.7
Связанная модель
DeepSeek-V4-Flash DeepSeek-V4-Flash — это оптимизированная на производительность облегченная модель DeepSeek, предназначенная для взаимодействия с низкой задержкой, работы в условиях высокой параллельности и повседневных интеллектуальных приложений.
DeepSeek-V4-Pro DeepSeek-V4-Pro является флагманской высокопроизводительной моделью от DeepSeek, которая дальнейше улучшает способности к логическому мышлению, программированию, обработке длинных текстов и выполнению различных задач в целом.
DeepSeek-V3.2 Последняя версия моделей серии Deepseek V3.
DeepSeek-V3.2-Exp Последняя экспериментальная версия моделей серии Deepseek V3.
DeepSeek-R1-0528 Последняя версия Deepseek R1.
Соответствующие документы
Внутри раскрыты подробности о Gemini следующего поколения: ограниченные вычислительные мощности, внутренние команды не сошлись в вопросах приоритетов разработки и распределения ресурсов В отчётах указывается, что запуск долгожданной модели Gemini следующего поколения от Google был перенесён. Внутренние разногласия по вопросам приоритетов разработки и распределения ресурсов, в сочетании с ограниченной вычислительной мощностью и сложн
OpenAI отклоняет опасения по поводу замедления роста, заявляя о ускорении работы нескольких бизнес-подразделений В ответ на внешнюю критику, связанную с замедлением роста продаж и невыполнением внутренних плановых показателей, лидер в области искусственного интеллекта компания OpenAI опубликовала во вторник, 28 апреля, уверенное заявление. Компания уточнила, чт
Кубок Суперкубок Alibaba: Qwen3.8-Max дебютирует с улучшенными инструментами для программирования и офисными приложениями Alibaba официально представила Qwen3.8-Max — новую базовую большую модель с 2,4 триллиона параметров. Это значимое достижение в области искусственного интеллекта обеспечивает существенное улучшение производительности в ключевых областях, таких как пр
Индийский технологический магнат инвестирует $30 млн в ИИ-аналог Microsoft Office Серийный предприниматель Бхавин Турахия инвестирует $30 млн собственных средств, делая ставку на то, что сектор корпоративного искусственного интеллекта всё ещё имеет место для новых игроков. Его последний стартап, Neo, основан на ключевой идее: уста
Бывший главный научный сотрудник OpenAI Илья представляет SSI и раскрывает первую модель Искусственный интеллект достиг еще одной важной вехи. После своего ухода из OpenAI бывший главный научный сотрудник Илья Сутскер основал компанию Safe Superintelligence Inc. (SSI), которая недавно раскрыла детали своей первой модели. Сообщения в зару
Сравнение модели
Начните сравнение
OR