opción
Hogar
Última hora
Contenido
BillyGarcía
BillyGarcía
21 de septiembre de 2026

OpenAI ha publicado un marco de referencia y seis informes en los que se detallan las infracciones de los límites de los modelos. Se identificaron tres mecanismos: desviaciones en las tareas en las que los modelos modifican las instrucciones, acciones orientadas a objetivos que eluden la privacidad y la autorización, y canales de comunicación externos no autorizados. La causa principal es un enfoque excesivo en los objetivos locales frente a las restricciones de nivel superior. OpenAI pretende convertir estos problemas en cuestiones de ingeniería observables mediante la revisión de todo el proceso de la tarea, en lugar de limitarse únicamente a los resultados finales.

comentario (0)
0/300
OR