opción
Cantidad de parámetros del modelo
N/A
Cantidad de parámetros del modelo
Organización afiliada
Alibaba
Organización afiliada
Código cerrado
Tipo de licencia
Tiempo de lanzamiento
28 de enero de 2025
Tiempo de lanzamiento

Introducción al modelo
Qwen 2.5 Max es un modelo MoE (Mezcla de Expertos) de gran escala entrenado con más de 20 billones de tokens de datos de preentrenamiento y un diseño cuidadoso de postentrenamiento.
Desliza hacia la izquierda y la derecha para ver más
Capacidad de comprensión del lenguaje Capacidad de comprensión del lenguaje
Capacidad de comprensión del lenguaje
Capaz de comprender contextos complejos y generar oraciones lógicamente coherentes, aunque ocasionalmente en control de tono.
7.5
Alcance de cobertura de conocimiento Alcance de cobertura de conocimiento
Alcance de cobertura de conocimiento
Posee el conocimiento central de las disciplinas convencionales, pero tiene una cobertura limitada de los campos interdisciplinarios de vanguardia.
8.8
Capacidad de razonamiento Capacidad de razonamiento
Capacidad de razonamiento
Incapaz de mantener cadenas de razonamiento coherentes, a menudo causando causalidad invertida o errores de cálculo.
6.8
Modelo relacionado
Qwen3.6-27B Qwen3.6 es el modelo de código abierto de última generación de la familia Qwen y una versión mejorada de la serie Qwen3.5.
Qwen3.5-397B-A17B Qwen3.5 es un importante modelo base lanzado recientemente por Alibaba, que presenta mejoras integrales en materia de fusión multimodal, arquitectura híbrida eficiente, aprendizaje por refuerzo escalable, cobertura multilingüe e infraestructura de entrenamiento, con un rendimiento y una aplicabilidad notablemente mejorados.
Qwen3.6-Max-Preview Qwen3.6-Max-Preview es el modelo propio estrella de Qwen, centrado en un razonamiento más sólido, la gestión de tareas complejas y un rendimiento conversacional de alta calidad.
Qwen3-Next-80B-A3B-Thinking La última serie Qwen3-Next lanzada en los modelos Qwen, que mejora la eficiencia de escalado gracias a una arquitectura de modelo innovadora.
Qwen3-235B-A22B-Thinking-2507 Qwen3 es la última generación de modelos lingüísticos de gran tamaño de la serie Qwen, que ofrece un conjunto completo de modelos densos y de mezcla de expertos (MoE).
Documentos relevantes
Dentro de los detalles revelados sobre el Gemini de próxima generación: Potencia de cálculo limitada, los equipos internos discreparon sobre las prioridades de desarrollo y la asignación de recursos Los informes indican que el lanzamiento del tan esperado modelo Gemini de próxima generación de Google ha sido pospuesto. Los desacuerdos internos sobre las prioridades de desarrollo y la asignación de recursos, combinados con una capacidad de comput
OpenAI descarta preocupaciones por la desaceleración del crecimiento y afirma que múltiples unidades de negocio están acelerando En respuesta a la escrutinio externo sobre el desaceleramiento del crecimiento de las ventas y el incumplimiento de las metas internas, el líder en inteligencia artificial, OpenAI, emitió una declaración contundente el martes 28 de abril. La empresa
Copa Super de Alibaba: Qwen3.8-Max hace su debut con herramientas de codificación y oficina mejoradas Alibaba ha presentado oficialmente Qwen3.8-Max, un modelo base de última generación con 2,4 billones de parámetros. Este importante avance en inteligencia artificial ofrece mejoras sustanciales en áreas clave como la programación y las tareas profesi
El magnate tecnológico indio invierte 30 millones de dólares en un rival de Microsoft Office con inteligencia artificial El emprendedor serial Bhavin Turakhia está invirtiendo 30 millones de dólares de su propio capital, apostando a que el sector de la inteligencia artificial empresarial aún tiene espacio para nuevos jugadores. Su última startup, Neo, se basa en una cr
El primer modelo de SSI de Ilya, ex científico jefe de OpenAI, se presenta La inteligencia artificial ha alcanzado otro hito importante. Tras su salida de OpenAI, el ex científico jefe Ilya Sutskever fundó Safe Superintelligence Inc. (SSI), que ha revelado recientemente detalles sobre su modelo inaugural. Informes de redes
Comparación de modelos
Comience la comparación
OR