Hogar
Bai Ling presenta el modelo a gran escala de código abierto Ring-2.6-1T, diseñado para bucles de tareas complejas reales
Bailin Large Model ha publicado hoy oficialmente en código abierto su modelo insignia de razonamiento con un billón de parámetros, Ring-2.6-1T , diseñado para hacer frente al reto que supone la limitada capacidad de ejecución de los modelos a gran escala en entornos de producción del mundo real. Este modelo va más allá del simple aumento de los parámetros; supone un cambio fundamental hacia el avance integral de tareas de cadena larga, como los flujos de trabajo de agentes, la ingeniería de software y el análisis científico.

En el ámbito técnico, Ring-2.6-1T logra tres avances clave. En primer lugar, potencia significativamente las capacidades de ejecución de los agentes, alcanzando resultados de vanguardia en el ámbito del código abierto en pruebas de rendimiento como PinchBench y ClawEval, que evalúan la adaptabilidad de los agentes, al tiempo que mejora considerablemente la descomposición de tareas y la corrección mediante retroalimentación.
En segundo lugar, introduce un innovador mecanismo ajustable denominado «Reasoning Effort», con dos niveles de intensidad: «high » y «xhigh». Esto permite a los desarrolladores equilibrar el coste y el rendimiento en función de la complejidad de la tarea. El nivel «alto» ofrece excelentes resultados en las pruebas del sector de las telecomunicaciones de Tau2-Bench, mientras que el nivel «xalto» alcanza el límite máximo de capacidad en tareas de razonamiento de alta dificultad, como AIME26 y GPQA Diamond.
Por último, el modelo adopta una arquitectura de aprendizaje por refuerzo asíncrono combinada con el «algoritmo Ice Stick», lo que resuelve eficazmente los problemas de estabilidad durante los largos ciclos de entrenamiento de los modelos de billones de parámetros y mejora significativamente la utilización de los recursos.
Ring-2.6-1T ya está disponible en Hugging Face y ModelScope . Aunque el equipo reconoce que hay margen de mejora en la estabilidad de la entrega a largo plazo, la publicación de este modelo como código abierto representa un cambio cualitativo para la IA —pasando de interacciones de diálogo únicas a un motor de ejecución con capacidades de planificación autónoma y colaboración entre herramientas—, lo que proporciona a los desarrolladores de todo el mundo una base sólida para explorar procesos de automatización complejos.
Artículo relacionado
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en
Cumplimiento de la normativa sobre vehículos autónomos en California: una nueva era de multas, geovallas y 1 millón de millas
Guident opera un servicio de transporte de AuveTech en el sur de Florida, gestionando una ruta de cuatro millas en West Palm Beach y otra de una milla en Boca Ratón mediante su tecnología de monitoriz
Recomendaciones de temas especiales relacionados
comentario (0)
0/500

En el ámbito técnico, Ring-2.6-1T logra tres avances clave. En primer lugar, potencia significativamente las capacidades de ejecución de los agentes, alcanzando resultados de vanguardia en el ámbito del código abierto en pruebas de rendimiento como PinchBench y ClawEval, que evalúan la adaptabilidad de los agentes, al tiempo que mejora considerablemente la descomposición de tareas y la corrección mediante retroalimentación.
En segundo lugar, introduce un innovador mecanismo ajustable denominado «Reasoning Effort», con dos niveles de intensidad: «high » y «xhigh». Esto permite a los desarrolladores equilibrar el coste y el rendimiento en función de la complejidad de la tarea. El nivel «alto» ofrece excelentes resultados en las pruebas del sector de las telecomunicaciones de Tau2-Bench, mientras que el nivel «xalto» alcanza el límite máximo de capacidad en tareas de razonamiento de alta dificultad, como AIME26 y GPQA Diamond.
Por último, el modelo adopta una arquitectura de aprendizaje por refuerzo asíncrono combinada con el «algoritmo Ice Stick», lo que resuelve eficazmente los problemas de estabilidad durante los largos ciclos de entrenamiento de los modelos de billones de parámetros y mejora significativamente la utilización de los recursos.
Ring-2.6-1T ya está disponible en
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en











