Hogar
DeepSeek V4.1 Flash se lanza con visión multimodal nativa, superando a la versión Pro mientras los precios caen
DeepSeek ha lanzado oficialmente hoy el modelo más pequeño de su última serie de arquitecturas: DeepSeek V4.1Flash. Diseñado como un modelo ligero con comprensión visual multimodal nativa, tiene como objetivo ofrecer un mayor rendimiento, inferencia más rápida, mayor capacidad de procesamiento y escalabilidad a tamaños de parámetros más grandes.
En su núcleo, DeepSeek V4.1Flash utiliza una arquitectura de Mezcla de Expertos (MoE) de 552B parámetros, con una innovadora estructura Causal-Encoder-Decoder. Su diseño asimétrico resulta en solo 8B de activaciones de entrada y 16B de activaciones de salida, reduciendo significativamente los costos en comparación con modelos de tamaño similar. Mejorado por un nuevo enfoque de preentrenamiento y aprendizaje por refuerzo a gran escala, este modelo supera a modelos insignia como DeepSeek V4Pro en varias pruebas de evaluación.

En cuanto a la eficiencia y el control de costos, el nuevo modelo reduce drásticamente el tamaño del KV Cache. En comparación con su predecesor, V4.1Flash requiere solo 1/4 de la memoria de alto ancho de banda (HBM) y 1/8 de la capacidad de la unidad de estado sólido (SSD). Esta compresión es particularmente beneficiosa para escenarios de Agentes, donde los costos de almacenamiento de contexto y aciertos en caché son altos, reduciendo significativamente los gastos operativos. Las estadísticas muestran que el KV Cache se ha reducido a 1/437 del tamaño del modelo inicial.
Con el lanzamiento del nuevo modelo, DeepSeek ha actualizado su línea de productos y estrategia de facturación. DeepSeek V4.1Flash ahora está disponible a través de la API de DeepSeek bajo el nombre de modelo deepseek-flash. Las versiones anteriores, V4Flash y V4Flash Vision Exp, han sido descontinuadas, con los nombres antiguos (deepseek-v4-flash y deepseek-v4-flash-vision-exp) redirigiendo temporalmente a V4.1Flash. Dado que V4.1Flash supera a V4Pro en rendimiento, costo, velocidad y tiempo de uso, la empresa planea eliminar gradualmente V4Pro: después de las 12:00 del 14 de septiembre de 2026, las solicitudes a deepseek-v4-pro se redirigirán a V4.1Flash y se facturarán a su tarifa. Socios oficiales como WorkBuddy, CodeBuddy y OpenCode de Tencent ya han integrado este modelo.
Artículo relacionado
Lanzamiento de la Plataforma Abierta Qwen de Aliyun, que permite la implementación de inteligencia artificial en teléfonos, computadoras y gafas, abarcando servicios como alquiler, envíos y más
A medida que las aplicaciones de inteligencia artificial se expanden rápidamente, Qwen ha mejorado significativamente su ecosistema. Lanzado el 10 de agosto, la Plataforma Abierta de Qwen ahora proporciona un amplio acceso para teléfonos móviles, com
Dou Bao planea lanzar niveles de pago a mediados de junio, con un impulso al comercio electrónico previsto para el tercer trimestre
Douyin, la aplicación insignia de modelos grandes de ByteDance, está prevista para lanzar funciones de contenido pagado a finales de junio, con actualizaciones programadas para la conferencia Force. Este movimiento marca un hito importante en la mone
La CCTV expone una estafa de citas con IA que apunta a mujeres de mediana edad y mayores; 28 detenidos
Los informes recientes de CCTV News destacan una nueva ola de estafas de citas impulsadas por inteligencia artificial que tienen como objetivo a mujeres de mediana edad y mayores. Los delincuentes están aprovechando personalidades generadas por IA pa
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
DeepSeek ha lanzado oficialmente hoy el modelo más pequeño de su última serie de arquitecturas: DeepSeek V4.1Flash. Diseñado como un modelo ligero con comprensión visual multimodal nativa, tiene como objetivo ofrecer un mayor rendimiento, inferencia más rápida, mayor capacidad de procesamiento y escalabilidad a tamaños de parámetros más grandes.
En su núcleo, DeepSeek V4.1Flash utiliza una arquitectura de Mezcla de Expertos (MoE) de 552B parámetros, con una innovadora estructura Causal-Encoder-Decoder. Su diseño asimétrico resulta en solo 8B de activaciones de entrada y 16B de activaciones de salida, reduciendo significativamente los costos en comparación con modelos de tamaño similar. Mejorado por un nuevo enfoque de preentrenamiento y aprendizaje por refuerzo a gran escala, este modelo supera a modelos insignia como DeepSeek V4Pro en varias pruebas de evaluación.

En cuanto a la eficiencia y el control de costos, el nuevo modelo reduce drásticamente el tamaño del KV Cache. En comparación con su predecesor, V4.1Flash requiere solo 1/4 de la memoria de alto ancho de banda (HBM) y 1/8 de la capacidad de la unidad de estado sólido (SSD). Esta compresión es particularmente beneficiosa para escenarios de Agentes, donde los costos de almacenamiento de contexto y aciertos en caché son altos, reduciendo significativamente los gastos operativos. Las estadísticas muestran que el KV Cache se ha reducido a 1/437 del tamaño del modelo inicial.
Con el lanzamiento del nuevo modelo, DeepSeek ha actualizado su línea de productos y estrategia de facturación. DeepSeek V4.1Flash ahora está disponible a través de la API de DeepSeek bajo el nombre de modelo deepseek-flash. Las versiones anteriores, V4Flash y V4Flash Vision Exp, han sido descontinuadas, con los nombres antiguos (deepseek-v4-flash y deepseek-v4-flash-vision-exp) redirigiendo temporalmente a V4.1Flash. Dado que V4.1Flash supera a V4Pro en rendimiento, costo, velocidad y tiempo de uso, la empresa planea eliminar gradualmente V4Pro: después de las 12:00 del 14 de septiembre de 2026, las solicitudes a deepseek-v4-pro se redirigirán a V4.1Flash y se facturarán a su tarifa. Socios oficiales como WorkBuddy, CodeBuddy y OpenCode de Tencent ya han integrado este modelo.
Lanzamiento de la Plataforma Abierta Qwen de Aliyun, que permite la implementación de inteligencia artificial en teléfonos, computadoras y gafas, abarcando servicios como alquiler, envíos y más
A medida que las aplicaciones de inteligencia artificial se expanden rápidamente, Qwen ha mejorado significativamente su ecosistema. Lanzado el 10 de agosto, la Plataforma Abierta de Qwen ahora proporciona un amplio acceso para teléfonos móviles, com
Dou Bao planea lanzar niveles de pago a mediados de junio, con un impulso al comercio electrónico previsto para el tercer trimestre
Douyin, la aplicación insignia de modelos grandes de ByteDance, está prevista para lanzar funciones de contenido pagado a finales de junio, con actualizaciones programadas para la conferencia Force. Este movimiento marca un hito importante en la mone
La CCTV expone una estafa de citas con IA que apunta a mujeres de mediana edad y mayores; 28 detenidos
Los informes recientes de CCTV News destacan una nueva ola de estafas de citas impulsadas por inteligencia artificial que tienen como objetivo a mujeres de mediana edad y mayores. Los delincuentes están aprovechando personalidades generadas por IA pa











