Option
Heim
Eilmeldung
Inhalt
CarlGarcia
CarlGarcia
9. Oktober 2026

Melbourne und UNSW-Forscher stellen VoxMem vor, einen neuen Benchmark, der kritische Mängel in der aktuellen Bewertung der Gedächtnisleistung von Sprach-KI aufzeigt. Im Gegensatz zu früheren Methoden, die audioale Nuancen ignorieren, isoliert VoxMem die Gesprächsdauer, um das Erinnerungsvermögen an Sprecheridentität, Tonfall und Hintergrundgeräusche über 34.743 Audioinstanzen hinweg zu testen. Die Tests von 15 gängigen Modellen zeigen, dass keines eine Genauigkeit von über 40 % bei einer Kontextlänge von 32K erreicht. Modelle haben erhebliche Schwierigkeiten mit paralinguistischen Hinweisen und Umgebungsgeräuschen, wobei die Leistung mit zunehmender Verlaufslänge abnimmt, was eine große Lücke in den Fähigkeiten zum Verständnis langformatiger Audioinhalte aufzeigt.

Kommentare (0)
0/300
OR