opción
Hogar
Última hora
Contenido
SamuelEvans
SamuelEvans
5 de junio de 2026

Tencent Hunyuan y el Instituto Gaoqing de la Universidad Renmin han publicado en código abierto PlanningBench, un marco de generación de datos verificables destinado a evaluar y entrenar las capacidades de planificación de los modelos de lenguaje a gran escala (LLM). Abarca más de 30 tareas de planificación en ámbitos como la programación y la asignación de recursos, entre otros, y cuenta con un sistema de control de la dificultad. El entrenamiento con estos datos mejora el rendimiento de los modelos en tareas de planificación inéditas y en tareas generales.

Tencent Hunyuan y el Instituto Gaoqing de la Universidad Renmin han publicado en código abierto PlanningBench, un marco de generación de datos verificables destinado a evaluar y entrenar las capacidades de planificación de los modelos de lenguaje a gran escala (LLM). Abarca más de 30 tareas de planificación en ámbitos como la programación y la asignación de recursos, entre otros, y cuenta con un sistema de control de la dificultad. El entrenamiento con estos datos mejora el rendimiento de los modelos en tareas de planificación inéditas y en tareas generales.
comentario (0)
0/300
OR