Дом
DeepSeek представляет предварительную версию V4, делая доступным контекст длиной 1 млн токенов для всех
DeepSeek официально выпустила и открыла исходный код предварительной версии своей новейшей серии моделей, DeepSeek-V4 . Благодаря структурным инновациям эта серия обеспечивает стандартизированную обработку ультрадлинного контекста объемом 1 млн токенов и лидирует среди отечественных и открытых моделей в области взаимодействия агентов, мировых знаний и логического вывода.

Двухуровневая архитектура: Pro для превосходства, Flash для эффективности
DeepSeek-V4 предлагает две спецификации, адаптированные под различные потребности в применении:
DeepSeek-V4-Pro (1,6 трлн параметров, 49 млрд активированных): Производительность сопоставима с лучшими закрытыми моделями. Она демонстрирует лучшие результаты среди открытых моделей в оценках агентского программирования, а качество вывода приближается к уровню Opus4.6. В тестах по математике, STEM-дисциплинам и соревновательному программированию она превосходит все публично оцененные открытые модели, демонстрируя способности мирового класса в области рассуждений.
DeepSeek-V4-Flash (284 млрд параметров, 13 млрд активированных): Приоритет отдается экстремальной экономической эффективности. Хотя ее мировые знания немного уступают версии Pro, она соответствует уровню Pro в рассуждениях для простых задач и работе агентов, предоставляя более быстрые и экономичные API-услуги.
Структурные инновации: механизм DSA обеспечивает доступность длинного контекста
DeepSeek-V4 внедряет новаторский **механизм разреженного внимания DSA**. Сжимая данные на уровне токенов, модель значительно снижает вычислительные и мемориальные затраты при работе с ультрадлинными контекстами. Это делает контекст в 1 млн токенов стандартной функцией всех официальных сервисов DeepSeek, решая отраслевую проблему высоких затрат на обработку длинных текстов.
Глубокая адаптация к экосистеме агентов
Оптимизированный для популярных продуктов агентов, таких как Claude Code и CodeBuddy, DeepSeek-V4 поддерживает как режим без рассуждений, так и режим рассуждений. API предоставляет параметр reasoning_effort, позволяющий пользователям регулировать интенсивность рассуждений (высокая/максимальная) в зависимости от сложности задачи, что значительно повышает производительность в сложных сценариях, таких как генерация кода и обработка документов.
Доступность и план открытого исходного кода
Пользователи могут получить доступ к новейшей модели через официальный сайт или официальное приложение, с соответствующими обновлениями API. Обратите внимание, что старые имена моделей deepseek-chat и deepseek-reasoner будут прекращены через три месяца (к 24 июля 2026 года).
Ссылки на открытый исходный код: Доступны на Hugging Face и Moba Community .
Технический отчет: Опубликован в репозитории Hugging Face .
Этот выпуск DeepSeek-V4 подтверждает осуществимость идеи о том, что открытые модели могут догнать лучшие закрытые модели в области длинного контекста и возможностей агентов, закладывая прочный фундамент для популяризации AGI благодаря технологическим прорывам.
Связанная статья
Chrome и Edge незаметно повысили требования к локальному хранению моделей ИИ до 20 ГБ по мере того, как браузеры превращаются в движки для вывода ИИ
Google Chrome и Microsoft Edge повысили требования к объему дискового пространства для локальных моделей искусственного интеллекта до 20 ГБ. Эти браузеры в фоновом режиме скачивают модели, чтобы обеспечить возможности искусственного интеллекта на уст
Zhipu AI нацелена на годовой повторяющийся доход в 1 миллиард долларов с акцентом на программирование после 15-кратного роста за 5 месяцев
Несколько независимых источников подтверждают, что годовой регулярный доход (ARR) компании Zhipu достиг 1 миллиарда долларов к июлю 2026 года. Компания пока не комментировала эти сообщения.Искусственный интеллект для написания кода и генерация видео
Microsoft представила первую модель искусственного интеллекта для кибербезопасности MAI-Cyber-1-Flash и запустила платформу Perception Security
Microsoft официально представила MAI-Cyber-1-Flash, свою первую специализированную модель для кибербезопасности, а также новую платформу безопасности на основе искусственного интеллекта под названием Perception. Представленные на мероприятии в Сан-Фр
Рекомендации по связанным специальным темам
Комментарии (0)
DeepSeek официально выпустила и открыла исходный код предварительной версии своей новейшей серии моделей,

Двухуровневая архитектура: Pro для превосходства, Flash для эффективности
DeepSeek-V4-Pro (1,6 трлн параметров, 49 млрд активированных): Производительность сопоставима с лучшими закрытыми моделями. Она демонстрирует лучшие результаты среди открытых моделей в оценках агентского программирования, а качество вывода приближается к уровню Opus4.6. В тестах по математике, STEM-дисциплинам и соревновательному программированию она превосходит все публично оцененные открытые модели, демонстрируя способности мирового класса в области рассуждений.
DeepSeek-V4-Flash (284 млрд параметров, 13 млрд активированных): Приоритет отдается экстремальной экономической эффективности. Хотя ее мировые знания немного уступают версии Pro, она соответствует уровню Pro в рассуждениях для простых задач и работе агентов, предоставляя более быстрые и экономичные API-услуги.
Структурные инновации: механизм DSA обеспечивает доступность длинного контекста
Глубокая адаптация к экосистеме агентов
Оптимизированный для популярных продуктов агентов, таких как Claude Code и CodeBuddy, reasoning_effort, позволяющий пользователям регулировать интенсивность рассуждений (высокая/максимальная) в зависимости от сложности задачи, что значительно повышает производительность в сложных сценариях, таких как генерация кода и обработка документов.
Доступность и план открытого исходного кода
Пользователи могут получить доступ к новейшей модели через deepseek-chat и deepseek-reasoner будут прекращены через три месяца (к 24 июля 2026 года).
Ссылки на открытый исходный код: Доступны на
Технический отчет: Опубликован в репозитории
Этот выпуск
Chrome и Edge незаметно повысили требования к локальному хранению моделей ИИ до 20 ГБ по мере того, как браузеры превращаются в движки для вывода ИИ
Google Chrome и Microsoft Edge повысили требования к объему дискового пространства для локальных моделей искусственного интеллекта до 20 ГБ. Эти браузеры в фоновом режиме скачивают модели, чтобы обеспечить возможности искусственного интеллекта на уст
Zhipu AI нацелена на годовой повторяющийся доход в 1 миллиард долларов с акцентом на программирование после 15-кратного роста за 5 месяцев
Несколько независимых источников подтверждают, что годовой регулярный доход (ARR) компании Zhipu достиг 1 миллиарда долларов к июлю 2026 года. Компания пока не комментировала эти сообщения.Искусственный интеллект для написания кода и генерация видео
Microsoft представила первую модель искусственного интеллекта для кибербезопасности MAI-Cyber-1-Flash и запустила платформу Perception Security
Microsoft официально представила MAI-Cyber-1-Flash, свою первую специализированную модель для кибербезопасности, а также новую платформу безопасности на основе искусственного интеллекта под названием Perception. Представленные на мероприятии в Сан-Фр











