opción
Hogar
Noticias
NUEVO LLAMA-3.1 NEMOTRON ultra supera a Deepseek R1 a la mitad del tamaño

NUEVO LLAMA-3.1 NEMOTRON ultra supera a Deepseek R1 a la mitad del tamaño

13 de abril de 2025
202

NUEVO LLAMA-3.1 NEMOTRON ultra supera a Deepseek R1 a la mitad del tamaño

Mientras Meta enfrenta el escrutinio sobre su última familia de modelos Llama 4, Nvidia ha lanzado silenciosamente un nuevo modelo de lenguaje grande (LLM) completamente de código abierto basado en el modelo anterior de Meta, Llama-3.1-405B-Instruct. Nombrado Llama-3.1-Nemotron-Ultra-253B-v1, este modelo cuenta con 253 mil millones de parámetros y está diseñado para destacar en razonamiento avanzado, seguimiento de instrucciones y flujos de trabajo de asistentes de IA. Nvidia insinuó este modelo por primera vez durante su Conferencia Anual de Tecnología GPU (GTC) en marzo.

El lanzamiento subraya el compromiso continuo de Nvidia para mejorar el rendimiento a través de la innovación arquitectónica y procesos meticulosos de posentrenamiento. Anunciado el 7 de abril de 2025, el código, los pesos y los datos de posentrenamiento del modelo ahora están disponibles gratuitamente en Hugging Face. Está diseñado para alternar sin problemas entre tareas de razonamiento complejo y salidas más simples según los prompts del sistema, ofreciendo flexibilidad a los desarrolladores en sus aplicaciones.

Diseñado para una Inferencia Eficiente

Basándose en los esfuerzos previos de Nvidia para optimizar LLMs para la inferencia, el Llama-3.1-Nemotron-Ultra-253B incorpora un proceso de Búsqueda de Arquitectura Neuronal (NAS) para refinar su arquitectura. Esto incluye características innovadoras como capas de atención omitidas, redes feedforward fusionadas (FFNs) y ratios de compresión de FFN variables. Estas modificaciones reducen el uso de memoria y los requisitos computacionales del modelo, permitiendo su despliegue en un solo nodo de GPU 8x H100 sin comprometer la calidad de la salida.

Nvidia afirma que este modelo ofrece un rendimiento robusto mientras es rentable para despliegues en centros de datos. Es compatible con las microarquitecturas B100 y Hopper de Nvidia, y ha sido probado en modos de precisión BF16 y FP8.

Posentrenamiento para Razonamiento y Alineación

El modelo fue sometido a un régimen integral de posentrenamiento. Esto incluyó ajuste fino supervisado en diversos dominios como matemáticas, generación de código, chat y uso de herramientas, seguido de aprendizaje por refuerzo con Optimización de Política Relativa de Grupo (GRPO) para mejorar sus capacidades de seguimiento de instrucciones y razonamiento.

El refinamiento adicional se logró a través de una fase de destilación de conocimiento sobre 65 mil millones de tokens, y un preentrenamiento continuo en 88 mil millones de tokens adicionales. Las fuentes de datos de entrenamiento incluyeron FineWeb, Buzz-V1.2 y Dolma, con prompts y respuestas de posentrenamiento extraídos de corpora públicos y métodos de generación sintética. Este enfoque ayudó al modelo a diferenciar entre sus modos de razonamiento.

Mejor Rendimiento en Múltiples Dominios y Benchmarks

Cuando se habilita para el razonamiento, el modelo mostró mejoras significativas en varios benchmarks. Por ejemplo, en el benchmark MATH500, su rendimiento aumentó del 80.40% en modo estándar al 97.00% con el razonamiento habilitado. De manera similar, los puntajes de AIME25 pasaron del 16.67% al 72.50%, y los resultados de LiveCodeBench se duplicaron con creces, del 29.03% al 66.31%.

El modelo también destacó en tareas basadas en herramientas y en respuestas a preguntas generales (GPQA), obteniendo un 76.01% en modo de razonamiento comparado con el 56.60% sin este. Estos benchmarks se realizaron con una longitud máxima de secuencia de 32,000 tokens, y cada prueba se repitió hasta 16 veces para mayor precisión.

En comparación con el modelo MoE de vanguardia DeepSeek R1, que tiene 671 mil millones de parámetros, el modelo de Nvidia se mantiene firme a pesar de tener menos parámetros. Supera a DeepSeek R1 en tareas como GPQA (76.01 vs. 71.5), seguimiento de instrucciones IFEval (89.45 vs. 83.3) y tareas de codificación LiveCodeBench (66.31 vs. 65.9). Sin embargo, DeepSeek R1 tiene una ligera ventaja en ciertas evaluaciones matemáticas, particularmente AIME25 (79.8 vs. 72.50) y MATH500 (97.3 vs. 97.00).

Estos resultados indican que el modelo denso de Nvidia puede igualar o superar a los modelos MoE en razonamiento y alineación de instrucciones generales, aunque queda ligeramente rezagado en categorías intensivas en matemáticas.

Uso e Integración

El modelo se integra sin problemas con la biblioteca Transformers de Hugging Face (se recomienda la versión 4.48.3) y soporta secuencias de hasta 128,000 tokens. Los desarrolladores pueden alternar el comportamiento de razonamiento usando prompts del sistema y elegir estrategias de decodificación según las necesidades de la tarea. Para tareas de razonamiento, Nvidia sugiere usar muestreo de temperatura (0.6) con un valor top-p de 0.95, mientras que la decodificación codiciosa se recomienda para salidas deterministas.

Llama-3.1-Nemotron-Ultra-253B soporta aplicaciones multilingües, incluyendo inglés, alemán, francés, italiano, portugués, hindi, español y tailandés. Es ideal para diversos casos de uso de LLM como desarrollo de chatbots, flujos de trabajo de agentes de IA, generación aumentada por recuperación (RAG) y generación de código.

Licenciado para Uso Comercial

Lanzado bajo la Licencia de Modelo Abierto de Nvidia y regido por el Acuerdo de Licencia Comunitaria de Llama 3.1, el modelo está listo para aplicaciones comerciales. Nvidia enfatiza la importancia del desarrollo responsable de IA, instando a los equipos a evaluar la alineación, seguridad y sesgos del modelo para sus casos de uso específicos.

Oleksii Kuchaiev, Director de Posentrenamiento de Modelos de IA de Nvidia, compartió la emoción por este lanzamiento abierto en X, destacando su diseño denso de 253B con capacidades de razonamiento conmutables y la inclusión de pesos y datos abiertos.

Artículo relacionado
Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes Investigaciones recientes indican que muy pocos laboratorios líderes en IA han publicado o demostrado planes de respuesta de contención. Un plan de contención define los procedimientos a seguir cuando
OneRail aprovecha la IA de Nvidia para optimizar la entrega en la última milla en tiempo real OneRail aprovecha la IA de Nvidia para optimizar la entrega en la última milla en tiempo real OneRail ha presentado una plataforma de reparto basada en inteligencia artificial que aprovecha la tecnología de Nvidia para ayudar a minoristas, mayoristas y distribuidores a determinar los métodos d
¿Cree realmente Mark Zuckerberg que la IA es para todos? ¿Cree realmente Mark Zuckerberg que la IA es para todos? Cargando el reproductor…Meta presentó esta semana Glimmer, un modelo de inteligencia artificial con pesos abiertos que cualquiera puede descargar y ejecutar en hardware personal, un contraste marcado con Muse Spark, el modelo más potente de la empre
Recomendaciones de temas especiales relacionados
Diseño y Arte Las mejores herramientas de transferencia de estilos con IA para experimentos creativos
Las mejores herramientas de transferencia de estilos con IA para experimentos creativos

¡Las mejores herramientas de transferencia de estilo con IA de 2026, mejor valoradas para experimentos creativos! XIX.AI ha seleccionado una colección de herramientas potentes y revolucionarias que no te puedes perder, capaces de ofrecer resultados excepcionales según pruebas reales y clasificaciones rigurosas. Estas soluciones de primera categoría ayudan a los creativos a aumentar significativamente su productividad, acelerando la creación de contenidos y abriendo un sinfín de posibilidades creativas. ¡Explora ahora mismo para descubrir tu herramienta perfecta y empieza a crear hoy mismo!

9 herramientas
xix.ai
Creación de cómics Las mejores herramientas de burbujas de diálogo con IA para la narración visual
Las mejores herramientas de burbujas de diálogo con IA para la narración visual

¡Ya están aquí, en XIX.AI, las mejores herramientas de 2026 con las mejores valoraciones para crear bocadillos de diálogo con IA y contar historias visuales! Esta selección incluye potentes herramientas revolucionarias que ayudan a los creadores a aumentar su productividad y superar los bloqueos creativos. Consulta una comparación entre las versiones gratuitas y de pago, echa un vistazo a las pruebas en condiciones reales y revisa las últimas clasificaciones para encontrar las soluciones imprescindibles, perfectas para crear narrativas visuales cautivadoras. ¡Explora ahora mismo y descubre tu herramienta ideal!

10 herramientas
xix.ai
Asistente de reuniones Las mejores herramientas de resumen de reuniones con IA: realiza un seguimiento claro de las decisiones y las acciones de seguimiento
Las mejores herramientas de resumen de reuniones con IA: realiza un seguimiento claro de las decisiones y las acciones de seguimiento

Las mejores herramientas de resumen de reuniones con IA de 2026, mejor valoradas para un seguimiento claro de las decisiones y un seguimiento posterior sin esfuerzo. Esta lista seleccionada presenta soluciones potentes y revolucionarias que aumentan drásticamente la productividad al automatizar las notas de las reuniones, identificar las acciones clave y agilizar la coordinación del equipo en todos los proyectos. Consigue una comparación entre las versiones gratuitas y de pago, junto con pruebas en condiciones reales y clasificaciones actualizadas semanalmente, para ayudarte a encontrar la herramienta perfecta. ¡Explora ahora mismo y aprovecha las ventajas de la IA!

9 herramientas
xix.ai
Análisis de datos Mejores herramientas de limpieza de datos con IA: corrige valores faltantes y duplicados rápidamente
Mejores herramientas de limpieza de datos con IA: corrige valores faltantes y duplicados rápidamente

2026: Las mejores herramientas de limpieza de datos basadas en IA, mejor calificadas y más actualizadas, para corregir rápidamente valores faltantes y duplicados. Esta lista cuidadosamente seleccionada presenta soluciones potentes que transforman el trabajo y aumentan significativamente la productividad. Cada opción ha sido sometida a pruebas rigurosas en entornos reales para garantizar su fiabilidad. Obtenga una comparación gratuita entre las opciones gratuitas y de pago y descubra la herramienta imprescindible que mejor se adapte a sus necesidades. Explore ahora en XIX.AI para darle un vantaje con la inteligencia artificial.

11 herramientas
xix.ai
Diseño y Arte Mejores herramientas de IA para la ideación creativa de artistas: superar los bloqueos visuales
Mejores herramientas de IA para la ideación creativa de artistas: superar los bloqueos visuales

2026 Últimas Mejores Herramientas de Ideación Creativa con IA Mejor Valoradas para Artistas son seleccionadas por XIX.AI para ayudar a los creadores a superar los bloqueos visuales y potenciar la creatividad al instante. Estas poderosas herramientas que cambian las reglas del juego ofrecen pruebas en el mundo real, una comparación detallada entre versiones gratuitas y de pago, y clasificaciones actualizadas semanalmente. Descubre tu herramienta perfecta para acelerar la creación de contenido y desbloquear tu ventaja con IA hoy mismo. ¡Explora ahora!

14 herramientas
xix.ai
composicion musical Creadores de ritmos con IA para pistas de fondo de TikTok, audio de Reels y música promocional para creadores
Creadores de ritmos con IA para pistas de fondo de TikTok, audio de Reels y música promocional para creadores

¡Los mejores creadores de ritmos con IA de 2026 para pistas de fondo de TikTok, audio de Reels y música promocional para creadores! XIX.AI ha elaborado una lista de las herramientas más valoradas y revolucionarias, sometidas a pruebas en el mundo real para ofrecer música impecable que se adapte a cualquier necesidad de contenido. Encontrarás datos detallados que comparan las versiones gratuitas con las de pago, clasificaciones actualizadas semanalmente y opciones imprescindibles que te ayudarán a potenciar tu creatividad y productividad. ¡Explora ahora mismo y descubre tu herramienta perfecta!

11 herramientas
xix.ai
comentario (54)
0/500
JonathanNelson
JonathanNelson 9 de diciembre de 2025 09:30:42 GMT+01:00

Интересно, как Nvidia удалось упаковать все эти параметры в модель размером вдвое меньше. Выходит, вложения в архитектуру дают больше преимуществ, чем просто увеличение данных? Хотя, конечно, с учётом их вычислительных ресурсов не стоит удивляться. Что особенно ценно, так это тот факт, что модель открыта. На этом фоне заявления Meta порой звучат слишком громко и с многочисленными оговорками 🤔 Это может изменить правила игры для независимых исследователей!

CharlesYoung
CharlesYoung 3 de noviembre de 2025 05:30:34 GMT+01:00

¿Nvidia saca otro modelo open-source más potente que DeepSeek R1? 🤔 Me pregunto si esto realmente marcará una diferencia práctica para los desarrolladores o es solo otra carrera por los números en los benchmarks. ¡253 mil millones de parámetros parece excesivo!

DouglasMartínez
DouglasMartínez 18 de agosto de 2025 17:01:00 GMT+02:00

Nvidia's new model sounds like a beast! Half the size of DeepSeek R1 but still outperforms it? That's wild efficiency. Can't wait to see how devs play with this open-source gem! 🚀

StephenRoberts
StephenRoberts 1 de agosto de 2025 04:48:18 GMT+02:00

Nvidia's new model sounds like a beast! Half the size of DeepSeek R1 but still outshines it? That's some serious tech flex. Can't wait to see how devs play with this open-source gem! 😎

AnthonyRoberts
AnthonyRoberts 24 de abril de 2025 10:35:07 GMT+02:00

Nvidia's new Llama-3.1 Nemotron Ultra is a beast! It's amazing how it outperforms DeepSeek R1 with half the size. I've been using it for my projects and the results are incredible. Just wish it was a bit faster, but overall, a solid choice! 🚀

JohnRoberts
JohnRoberts 23 de abril de 2025 02:03:45 GMT+02:00

¡El Llama-3.1 Nemotron Ultra de Nvidia es impresionante! Supera al DeepSeek R1 con la mitad del tamaño, lo cual es alucinante. Lo he estado usando en mis proyectos y es súper eficiente. Lo único es que puede ser un poco complicado de configurar. Aún así, una excelente opción para quien busque un LLM potente. 🚀

OR