Hogar
DeepSeek presenta la versión preliminar de V4, haciendo accesible el contexto largo de 1M a todos
DeepSeek ha lanzado oficialmente y abierto al código fuente la versión preliminar de su última serie de modelos, DeepSeek-V4 . Mediante innovaciones estructurales, esta serie logra un manejo estandarizado de contextos ultra largos de 1M (un millón de tokens) y lidera a los modelos nacionales y de código abierto en colaboración de agentes, conocimiento del mundo y razonamiento lógico.

Diseño de dos versiones: Pro para la excelencia, Flash para la eficiencia
DeepSeek-V4 ofrece dos especificaciones adaptadas a diferentes necesidades de aplicación:
DeepSeek-V4-Pro (1,6T parámetros, 49B activados): El rendimiento rivaliza con los mejores modelos de código cerrado. Obtiene los mejores resultados de código abierto en evaluaciones de codificación de agentes, con una calidad de salida cercana a Opus4.6. En matemáticas, STEM y pruebas de programación competitiva, supera a todos los modelos de código abierto evaluados públicamente, demostrando capacidades de razonamiento de clase mundial.
DeepSeek-V4-Flash (284B parámetros, 13B activados): Prioriza la extrema rentabilidad. Aunque su conocimiento del mundo es ligeramente inferior al de la versión Pro, iguala el razonamiento de nivel Pro para tareas simples y el rendimiento de agentes, proporcionando servicios de API más rápidos y económicos.
Innovación estructural: El mecanismo DSA habilita la accesibilidad de contextos largos
DeepSeek-V4 introduce un innovador **mecanismo de atención dispersa DSA**. Al comprimir a nivel de token, el modelo reduce significativamente las demandas computacionales y de memoria para contextos ultra largos. Esto convierte el contexto de 1M en una característica estándar en todos los servicios oficiales de DeepSeek, abordando el alto costo del procesamiento de textos largos en la industria.
Adaptación profunda al ecosistema de agentes
Optimizado para productos de agentes principales como Claude Code y CodeBuddy, DeepSeek-V4 admite tanto el modo no pensante como el modo pensante. La API expone el parámetro reasoning_effort, permitiendo a los usuarios ajustar la intensidad del pensamiento (alto/máximo) según la complejidad de la tarea, lo que mejora significativamente el rendimiento en escenarios complejos como la generación de código y el procesamiento de documentos.
Plan de acceso y código abierto
Los usuarios pueden acceder al último modelo a través del sitio web oficial o la aplicación oficial, con actualizaciones correspondientes de la API. Tenga en cuenta que los nombres de modelo antiguos deepseek-chat y deepseek-reasoner se descontinuarán después de tres meses (para el 24 de julio de 2026).
Enlaces de código abierto: Disponibles en Hugging Face y Comunidad Moba .
Informe técnico: Publicado en el repositorio de Hugging Face .
Este lanzamiento de DeepSeek-V4 valida la viabilidad de los modelos de código abierto para alcanzar a los mejores modelos de código cerrado en capacidades de contexto largo y agentes, sentando una base sólida para la popularización de la AGI mediante avances tecnológicos.
Artículo relacionado
Chrome y Edge aumentan silenciosamente los requisitos de almacenamiento para modelos de IA local a 20 GB, ya que los navegadores evolucionan hacia motores de inferencia de IA
Google Chrome y Microsoft Edge han elevado los requisitos de espacio en disco para modelos de inteligencia artificial local a 20 GB. Estos navegadores descargan silenciosamente los modelos en segundo plano para habilitar capacidades de IA en el dispo
Zhipu AI apunta a un ARR de 1.000 millones de dólares con enfoque en programación tras un crecimiento de 15 veces en 5 meses
Múltiples fuentes independientes confirman que los ingresos recurrentes anuales (ARR) de Zhipu alcanzaron los 1000 millones de dólares en julio de 2026. La empresa aún no ha comentado estos informes.La codificación asistida por IA y la generación de
Microsoft presenta su primer modelo de inteligencia artificial para ciberseguridad, MAI-Cyber-1-Flash, y lanza la plataforma de seguridad Perception
Microsoft ha presentado oficialmente MAI-Cyber-1-Flash, su primer modelo especializado en ciberseguridad, junto con una nueva plataforma de seguridad impulsada por inteligencia artificial llamada Perception. Desvelados en un evento en San Francisco,
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
DeepSeek ha lanzado oficialmente y abierto al código fuente la versión preliminar de su última serie de modelos,

Diseño de dos versiones: Pro para la excelencia, Flash para la eficiencia
DeepSeek-V4-Pro (1,6T parámetros, 49B activados): El rendimiento rivaliza con los mejores modelos de código cerrado. Obtiene los mejores resultados de código abierto en evaluaciones de codificación de agentes, con una calidad de salida cercana a Opus4.6. En matemáticas, STEM y pruebas de programación competitiva, supera a todos los modelos de código abierto evaluados públicamente, demostrando capacidades de razonamiento de clase mundial.
DeepSeek-V4-Flash (284B parámetros, 13B activados): Prioriza la extrema rentabilidad. Aunque su conocimiento del mundo es ligeramente inferior al de la versión Pro, iguala el razonamiento de nivel Pro para tareas simples y el rendimiento de agentes, proporcionando servicios de API más rápidos y económicos.
Innovación estructural: El mecanismo DSA habilita la accesibilidad de contextos largos
Adaptación profunda al ecosistema de agentes
Optimizado para productos de agentes principales como Claude Code y CodeBuddy, reasoning_effort, permitiendo a los usuarios ajustar la intensidad del pensamiento (alto/máximo) según la complejidad de la tarea, lo que mejora significativamente el rendimiento en escenarios complejos como la generación de código y el procesamiento de documentos.
Plan de acceso y código abierto
Los usuarios pueden acceder al último modelo a través del deepseek-chat y deepseek-reasoner se descontinuarán después de tres meses (para el 24 de julio de 2026).
Enlaces de código abierto: Disponibles en
Informe técnico: Publicado en el repositorio de
Este lanzamiento de
Chrome y Edge aumentan silenciosamente los requisitos de almacenamiento para modelos de IA local a 20 GB, ya que los navegadores evolucionan hacia motores de inferencia de IA
Google Chrome y Microsoft Edge han elevado los requisitos de espacio en disco para modelos de inteligencia artificial local a 20 GB. Estos navegadores descargan silenciosamente los modelos en segundo plano para habilitar capacidades de IA en el dispo
Zhipu AI apunta a un ARR de 1.000 millones de dólares con enfoque en programación tras un crecimiento de 15 veces en 5 meses
Múltiples fuentes independientes confirman que los ingresos recurrentes anuales (ARR) de Zhipu alcanzaron los 1000 millones de dólares en julio de 2026. La empresa aún no ha comentado estos informes.La codificación asistida por IA y la generación de
Microsoft presenta su primer modelo de inteligencia artificial para ciberseguridad, MAI-Cyber-1-Flash, y lanza la plataforma de seguridad Perception
Microsoft ha presentado oficialmente MAI-Cyber-1-Flash, su primer modelo especializado en ciberseguridad, junto con una nueva plataforma de seguridad impulsada por inteligencia artificial llamada Perception. Desvelados en un evento en San Francisco,











