Qwen stellt Fun-ASR-Realtime vor – ein Echtzeit-Spracherkennungsmodell, bei dem die Latenz für das Erkennen des ersten Zeichens unter 100 ms liegt und dessen Genauigkeit der von Offline-Modellen entspricht. Es unterstützt 30 Sprachen sowie 16 chinesische Dialekte und verbessert somit Voice-Assistenten sowie Meeting-Tools für Entwickler.





Heim
