Дом
DeepSeek V4.1 Flash выходит с нативной мультимодальной визуализацией, превосходя профессиональную версию по мере снижения цен
Сегодня компания DeepSeek официально представила самую маленькую модель из своей новейшей серии архитектур: DeepSeek V4.1Flash. Разработанная как легковесная модель с нативным многомодальным визуальным пониманием, она направлена на обеспечение более высокой производительности, более быстрого вывода, большей пропускной способности и масштабируемости до больших размеров параметров.
В основе DeepSeek V4.1Flash лежит архитектура Mixture of Experts (MoE) с 552B параметров, отличающаяся инновационной причинно-следственной структурой кодировщика-декодатора. Ее асимметричный дизайн приводит к тому, что входные активации составляют всего 8B, а выходные — 16B, что значительно снижает затраты по сравнению с моделями аналогичного размера. Улучшенная за счет нового подхода к предварительному обучению и крупномасштабного обучения с подкреплением, эта модель превосходит флагманские модели, такие как DeepSeek V4Pro, в различных бенчмарках.

Что касается эффективности и контроля затрат, новая модель радикально уменьшает размер KV Cache. По сравнению с ее предшественником, V4.1Flash требует лишь 1/4 высокоскоростной памяти (HBM) и 1/8 емкости твердотельного накопителя (SSD). Эта компрессия особенно полезна для сценариев использования агентов, где высоки затраты на хранение контекста и кэширование, что значительно снижает операционные расходы. Статистика показывает, что размер KV Cache сократился до 1/437 от размера исходной модели.
С выходом новой модели DeepSeek обновила свою продуктовую линейку и стратегию биллинга. DeepSeek V4.1Flash теперь доступна через API DeepSeek под именем модели deepseek-flash. Предыдущие версии, V4Flash и V4Flash Vision Exp, были прекращены, при этом старые имена (deepseek-v4-flash и deepseek-v4-flash-vision-exp) временно перенаправляются на V4.1Flash. Поскольку V4.1Flash превосходит V4Pro по производительности, стоимости, скорости и времени использования, компания планирует постепенно выводить V4Pro из эксплуатации: после 12:00 14 сентября 2026 года запросы к deepseek-v4-pro будут перенаправляться на V4.1Flash и тарифицироваться по ее ставке. Официальные партнеры, такие как WorkBuddy, CodeBuddy и OpenCode от Tencent, уже интегрировали эту модель.
Связанная статья
Топ-1% компаний тратят 7500 долларов в месяц на сотрудника на ИИ, поскольку затраты на вычисления приближаются к расходам на персонал
Обновление от 10 июня: Свежий отчет из Индекса Ramp AI показывает, что корпоративное внедрение искусственного интеллекта в США ускоряется. Ведущие компании, отнесенные к категории «сверхактивных пользователей ИИ» (топ 1%), инвестируют до 7500 долларо
Запуск открытой платформы Aliyun Qwen: внедрение искусственного интеллекта в смартфоны, компьютеры и очки для решения задач аренды, доставки и других сценариев
По мере стремительного расширения применения искусственного интеллекта экосистема Qwen претерпела значительные улучшения. Запущенная 10 августа открытая платформа Qwen теперь предоставляет широкий доступ для мобильных телефонов, персональных компьюте
Dou Bao планирует запустить платные тарифы в середине июня, а в третьем квартале запланированы усилия по продвижению электронной коммерции.
Douyin, флагманское приложение крупной языковой модели ByteDance, планирует запустить функции платного контента к концу июня, с обновлениями, запланированными на конференции Force. Этот шаг знаменует собой важный этап в монетизации крупнейшей в Китае
Рекомендации по связанным специальным темам
Комментарии (0)
Сегодня компания DeepSeek официально представила самую маленькую модель из своей новейшей серии архитектур: DeepSeek V4.1Flash. Разработанная как легковесная модель с нативным многомодальным визуальным пониманием, она направлена на обеспечение более высокой производительности, более быстрого вывода, большей пропускной способности и масштабируемости до больших размеров параметров.
В основе DeepSeek V4.1Flash лежит архитектура Mixture of Experts (MoE) с 552B параметров, отличающаяся инновационной причинно-следственной структурой кодировщика-декодатора. Ее асимметричный дизайн приводит к тому, что входные активации составляют всего 8B, а выходные — 16B, что значительно снижает затраты по сравнению с моделями аналогичного размера. Улучшенная за счет нового подхода к предварительному обучению и крупномасштабного обучения с подкреплением, эта модель превосходит флагманские модели, такие как DeepSeek V4Pro, в различных бенчмарках.

Что касается эффективности и контроля затрат, новая модель радикально уменьшает размер KV Cache. По сравнению с ее предшественником, V4.1Flash требует лишь 1/4 высокоскоростной памяти (HBM) и 1/8 емкости твердотельного накопителя (SSD). Эта компрессия особенно полезна для сценариев использования агентов, где высоки затраты на хранение контекста и кэширование, что значительно снижает операционные расходы. Статистика показывает, что размер KV Cache сократился до 1/437 от размера исходной модели.
С выходом новой модели DeepSeek обновила свою продуктовую линейку и стратегию биллинга. DeepSeek V4.1Flash теперь доступна через API DeepSeek под именем модели deepseek-flash. Предыдущие версии, V4Flash и V4Flash Vision Exp, были прекращены, при этом старые имена (deepseek-v4-flash и deepseek-v4-flash-vision-exp) временно перенаправляются на V4.1Flash. Поскольку V4.1Flash превосходит V4Pro по производительности, стоимости, скорости и времени использования, компания планирует постепенно выводить V4Pro из эксплуатации: после 12:00 14 сентября 2026 года запросы к deepseek-v4-pro будут перенаправляться на V4.1Flash и тарифицироваться по ее ставке. Официальные партнеры, такие как WorkBuddy, CodeBuddy и OpenCode от Tencent, уже интегрировали эту модель.
Топ-1% компаний тратят 7500 долларов в месяц на сотрудника на ИИ, поскольку затраты на вычисления приближаются к расходам на персонал
Обновление от 10 июня: Свежий отчет из Индекса Ramp AI показывает, что корпоративное внедрение искусственного интеллекта в США ускоряется. Ведущие компании, отнесенные к категории «сверхактивных пользователей ИИ» (топ 1%), инвестируют до 7500 долларо
Запуск открытой платформы Aliyun Qwen: внедрение искусственного интеллекта в смартфоны, компьютеры и очки для решения задач аренды, доставки и других сценариев
По мере стремительного расширения применения искусственного интеллекта экосистема Qwen претерпела значительные улучшения. Запущенная 10 августа открытая платформа Qwen теперь предоставляет широкий доступ для мобильных телефонов, персональных компьюте
Dou Bao планирует запустить платные тарифы в середине июня, а в третьем квартале запланированы усилия по продвижению электронной коммерции.
Douyin, флагманское приложение крупной языковой модели ByteDance, планирует запустить функции платного контента к концу июня, с обновлениями, запланированными на конференции Force. Этот шаг знаменует собой важный этап в монетизации крупнейшей в Китае











