El modelo pequeño Qwen 3.5 de Alibaba planta cara a su rival GPT-4o

Un modelo de 4000 millones de parámetros demuestra que «menos es más» y abre una nueva era para la implementación local de la IA en China
El campo de la IA ha funcionado durante mucho tiempo bajo la creencia de que un mayor número de parámetros equivale a una mayor inteligencia. Sin embargo, la serie Qwen 3.5 de modelos pequeños lanzada recientemente por Alibaba ha proporcionado un ejemplo paradigmático de que «lo pequeño vence a lo grande». En pruebas del mundo real, el modelo Qwen 3.5-4B, con solo 4000 millones de parámetros, se enfrentó cara a cara con el modelo GPT-4o, del que se rumorea que tiene más de 100 000 millones de parámetros, y no solo se mantuvo a la altura, sino que incluso salió ligeramente por delante.
Este desafío entre niveles fue llevado a cabo por la entidad independiente N8 Programs. Los evaluadores seleccionaron al azar 1000 preguntas del mundo real del conjunto de datos WildChat, enfrentando a Qwen 3.5-4B contra GPT-4o en el mismo escenario, con Opus 4.6 —actualmente reconocido como el juez más potente— supervisando la competición. Los resultados fueron sorprendentes: en esta arena de preguntas y respuestas de 1000 rondas, Qwen 3.5-4B logró 499 victorias, 431 derrotas y 70 empates, superando finalmente a GPT-4o.
La cifra más asombrosa es que se especula que GPT-4o posee hasta 200 000 millones de parámetros, mientras que Qwen 3.5-4B cuenta con apenas el 2 % de esa cifra. Esto demuestra el logro de Alibaba de obtener resultados de razonamiento lógico de primer nivel con un gasto mínimo de recursos.
Más allá de su formidable rendimiento, el principal atractivo de la serie Qwen 3.5 reside en su excepcional idoneidad para la implementación local. El lanzamiento oficial incluye cuatro tamaños —0,8B, 2B, 4B y 9B— que abarcan escenarios que van desde dispositivos periféricos de IoT hasta servidores. La versión 4B es especialmente destacable, ya que, en teoría, solo requiere 8 GB de VRAM para funcionar, con 16 GB recomendados para un funcionamiento fluido.
Para los usuarios y desarrolladores habituales, esto representa una forma de «liberación de la potencia de cálculo». Ya no hay necesidad de tarjetas de cálculo profesionales que cuestan decenas de miles; ahora puedes tener un «asistente personal» con un rendimiento que rivaliza con los grandes modelos de primer nivel directamente en tu propio ordenador, o incluso en tu smartphone.
Tal y como ha demostrado el equipo de Qwen : más grande no siempre significa mejor. Una IA que pueda ejecutarse en los propios dispositivos de los usuarios es lo que realmente va a cambiar las reglas del juego para la productividad futura. Con la versión 9B compitiendo directamente con el rendimiento de los grandes modelos de clase 120B, los grandes modelos chinos están demostrando la capacidad innovadora única de China a través de este enfoque de «optimización», revelando a la comunidad global de desarrolladores la fuerza de la IA «Made in China».
Artículo relacionado
Dentro de los detalles revelados sobre el Gemini de próxima generación: Potencia de cálculo limitada, los equipos internos discreparon sobre las prioridades de desarrollo y la asignación de recursos
Los informes indican que el lanzamiento del tan esperado modelo Gemini de próxima generación de Google ha sido pospuesto. Los desacuerdos internos sobre las prioridades de desarrollo y la asignación de recursos, combinados con una capacidad de comput
OpenAI descarta preocupaciones por la desaceleración del crecimiento y afirma que múltiples unidades de negocio están acelerando
En respuesta a la escrutinio externo sobre el desaceleramiento del crecimiento de las ventas y el incumplimiento de las metas internas, el líder en inteligencia artificial, OpenAI, emitió una declaración contundente el martes 28 de abril. La empresa
Copa Super de Alibaba: Qwen3.8-Max hace su debut con herramientas de codificación y oficina mejoradas
Alibaba ha presentado oficialmente Qwen3.8-Max, un modelo base de última generación con 2,4 billones de parámetros. Este importante avance en inteligencia artificial ofrece mejoras sustanciales en áreas clave como la programación y las tareas profesi
Recomendaciones de temas especiales relacionados
comentario (2)
0/500
Alibaba's Qwen 3.5 with just 4B params taking on GPT-4o? That's hilarious — reminds me of David vs Goliath but with neural nets. "Less is more" might be true for local deployment, but I bet real benchmarks will tell a different story. Still, props for challenging the parameter arms race. 🍵

Un modelo de 4000 millones de parámetros demuestra que «menos es más» y abre una nueva era para la implementación local de la IA en China
El campo de la IA ha funcionado durante mucho tiempo bajo la creencia de que un mayor número de parámetros equivale a una mayor inteligencia. Sin embargo, la serie
Este desafío entre niveles fue llevado a cabo por la entidad independiente N8 Programs. Los evaluadores seleccionaron al azar 1000 preguntas del mundo real del conjunto de datos WildChat, enfrentando a Qwen 3.5-4B contra GPT-4o en el mismo escenario, con Opus 4.6 —actualmente reconocido como el juez más potente— supervisando la competición. Los resultados fueron sorprendentes: en esta arena de preguntas y respuestas de 1000 rondas, Qwen 3.5-4B logró 499 victorias, 431 derrotas y 70 empates, superando finalmente a GPT-4o.
La cifra más asombrosa es que se especula que GPT-4o posee hasta 200 000 millones de parámetros, mientras que Qwen 3.5-4B cuenta con apenas el 2 % de esa cifra. Esto demuestra el logro de Alibaba de obtener resultados de razonamiento lógico de primer nivel con un gasto mínimo de recursos.
Más allá de su formidable rendimiento, el principal atractivo de la serie Qwen 3.5 reside en su excepcional idoneidad para la implementación local. El lanzamiento oficial incluye cuatro tamaños —0,8B, 2B, 4B y 9B— que abarcan escenarios que van desde dispositivos periféricos de IoT hasta servidores. La versión 4B es especialmente destacable, ya que, en teoría, solo requiere 8 GB de VRAM para funcionar, con 16 GB recomendados para un funcionamiento fluido.
Para los usuarios y desarrolladores habituales, esto representa una forma de «liberación de la potencia de cálculo». Ya no hay necesidad de tarjetas de cálculo profesionales que cuestan decenas de miles; ahora puedes tener un «asistente personal» con un rendimiento que rivaliza con los grandes modelos de primer nivel directamente en tu propio ordenador, o incluso en tu smartphone.
Tal y como ha demostrado el equipo
Dentro de los detalles revelados sobre el Gemini de próxima generación: Potencia de cálculo limitada, los equipos internos discreparon sobre las prioridades de desarrollo y la asignación de recursos
Los informes indican que el lanzamiento del tan esperado modelo Gemini de próxima generación de Google ha sido pospuesto. Los desacuerdos internos sobre las prioridades de desarrollo y la asignación de recursos, combinados con una capacidad de comput
OpenAI descarta preocupaciones por la desaceleración del crecimiento y afirma que múltiples unidades de negocio están acelerando
En respuesta a la escrutinio externo sobre el desaceleramiento del crecimiento de las ventas y el incumplimiento de las metas internas, el líder en inteligencia artificial, OpenAI, emitió una declaración contundente el martes 28 de abril. La empresa
Copa Super de Alibaba: Qwen3.8-Max hace su debut con herramientas de codificación y oficina mejoradas
Alibaba ha presentado oficialmente Qwen3.8-Max, un modelo base de última generación con 2,4 billones de parámetros. Este importante avance en inteligencia artificial ofrece mejoras sustanciales en áreas clave como la programación y las tareas profesi
Alibaba's Qwen 3.5 with just 4B params taking on GPT-4o? That's hilarious — reminds me of David vs Goliath but with neural nets. "Less is more" might be true for local deployment, but I bet real benchmarks will tell a different story. Still, props for challenging the parameter arms race. 🍵





Hogar






