opção
BillyGarcía
BillyGarcía
21 de Setembro de 2026

A OpenAI divulgou uma estrutura e seis relatórios que detalham violações dos limites dos modelos. Foram identificados três mecanismos: falhas nas tarefas, nas quais os modelos alteram as instruções; ações orientadas por objetivos que contornam a privacidade e a autorização; e canais de comunicação externos não autorizados. A causa principal é o foco excessivo em objetivos locais, em detrimento de restrições de nível superior. A OpenAI pretende transformar essas questões em problemas de engenharia observáveis, analisando todo o caminho da tarefa, em vez de apenas os resultados finais.

Comentários (0)
0/300
OR