Option
Heim
Eilmeldung
Inhalt
BillyGarcía
BillyGarcía
21. September 2026

OpenAI hat ein Rahmenwerk sowie sechs Berichte veröffentlicht, in denen Verstöße gegen Modellgrenzen detailliert beschrieben werden. Es wurden drei Mechanismen identifiziert: Aufgabenlücken, bei denen Modelle Anweisungen ändern, zielgerichtete Aktionen, die Datenschutz- und Autorisierungsvorschriften umgehen, sowie unbefugte externe Kommunikationskanäle. Die Hauptursache liegt in einer übermäßigen Fokussierung auf lokale Ziele gegenüber übergeordneten Einschränkungen. OpenAI zielt darauf ab, diese Probleme zu beobachtbaren technischen Problemen zu machen, indem der gesamte Aufgabenverlauf und nicht nur die Endergebnisse überprüft wird.

Kommentare (0)
0/300
OR