Heim
Insta30 GO Ultra stellt KI-Sprachassistent vor, der von Qwen und Gemini angetrieben wird

Insta360 wird am 7. August einen KI-Sprachassistenten für seine GO Ultra Daumenkamera vorstellen. Diese Funktion nutzt regionenspezifische Large-Language-Modelle: In Festlandchina wird der Dienst von Alibabas Qwen betrieben, während Google Gemini für Hongkong, Macau, Taiwan und internationale Märkte zum Einsatz kommt. Nutzer können Übersetzungen direkt über den integrierten Lautsprecher des Geräts hören.
Basierend auf Insta360’s proprietärer Technologie kombiniert dieser KI-Assistent die multimodalen Fähigkeiten des Qwen-Modells mit der Foto-Q&A-Funktionalität der Qwen-App und nutzt eine Cloud-Terminal-Kollaborationsarchitektur. Das Gerät übernimmt lokale Aufgaben wie Stimmerkennung und Intent-Analyse, während die Cloud komplexe Operationen wie intelligente Q&A, Moduswechsel und Echtzeitübersetzung verwaltet.
Nutzer können den Assistenten durch die Sprachbefehle „Hey Kira“ oder durch langes Drücken der Auslösetaste aktivieren, selbst wenn das Gerät ausgeschaltet ist. Zu den Hauptfunktionen gehören die Gesicht-zu-Gesicht-Übersetzung, Foto-basierte Q&A und sprachbasierte Q&A. Der Gesicht-zu-Gesicht-Übersetzungsmodus ist ideal für Szenarien wie das Fragen nach dem Weg, das Bestellen von Essen oder das Einkaufen. Die Foto-Q&A-Funktion kann nach Autorisierung den Inhalt, der im Objektiv erfasst wurde – wie Straßenschilder, Gebäude oder Gerichte – analysieren und detaillierte Einblicke liefern.
Liu Jingkang, Gründer von Insta360, ist der Ansicht, dass diese Funktion die Daumenkamera „neu definieren“ könnte. Dieses Upgrade unterstreicht, wie schnell KI-Large-Modelle in Consumer-Hardware eindringen und intelligente Kameras von einfachen Aufnahmegeräten in interaktive KI-Terminals mit erweiterten Verständnis- und Gesprächsfähigkeiten verwandeln.
Verwandter Artikel
Trumps KI-Strategie: Wie geht es mit der US-Politik weiter?
Am 3. August forderten fünf demokratische Senatoren die Trump-Regierung auf, ihre Aufsicht über Open-Weight-KI-Modelle zu präzisieren, und wiesen dabei auf Bedenken hinsichtlich der Wettbewerbsbedrohu
Tencent schüttelt das Large-Model-Team um, während Yao Shunyu die Verantwortung für das Basismodell übernimmt
Das multimodale Team von Tencent Hunyuan hat kürzlich eine bedeutende Umstrukturierung und strategische Neuausrichtung abgeschlossen. Lu Xudong, der zuvor die multimodalen Verständnisarbeiten bei xAI geleitet hatte, ist zu Hunyuan gewechselt, um die
Tongyi Qianwen Open Platform wird gestartet und bringt Conversational-as-a-Service in den Alltag.
Die Tongyi Qianwen Open Platform ist offiziell gestartet und bietet Entwicklern Zugriff auf Dienste über mobile Geräte, PCs und KI-Brillen. Nutzer müssen nicht mehr zwischen Apps wechseln; sie können verschiedene tägliche Serviceoperationen direkt in
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)

Insta360 wird am 7. August einen KI-Sprachassistenten für seine GO Ultra Daumenkamera vorstellen. Diese Funktion nutzt regionenspezifische Large-Language-Modelle: In Festlandchina wird der Dienst von Alibabas Qwen betrieben, während Google Gemini für Hongkong, Macau, Taiwan und internationale Märkte zum Einsatz kommt. Nutzer können Übersetzungen direkt über den integrierten Lautsprecher des Geräts hören.
Basierend auf Insta360’s proprietärer Technologie kombiniert dieser KI-Assistent die multimodalen Fähigkeiten des Qwen-Modells mit der Foto-Q&A-Funktionalität der Qwen-App und nutzt eine Cloud-Terminal-Kollaborationsarchitektur. Das Gerät übernimmt lokale Aufgaben wie Stimmerkennung und Intent-Analyse, während die Cloud komplexe Operationen wie intelligente Q&A, Moduswechsel und Echtzeitübersetzung verwaltet.
Nutzer können den Assistenten durch die Sprachbefehle „Hey Kira“ oder durch langes Drücken der Auslösetaste aktivieren, selbst wenn das Gerät ausgeschaltet ist. Zu den Hauptfunktionen gehören die Gesicht-zu-Gesicht-Übersetzung, Foto-basierte Q&A und sprachbasierte Q&A. Der Gesicht-zu-Gesicht-Übersetzungsmodus ist ideal für Szenarien wie das Fragen nach dem Weg, das Bestellen von Essen oder das Einkaufen. Die Foto-Q&A-Funktion kann nach Autorisierung den Inhalt, der im Objektiv erfasst wurde – wie Straßenschilder, Gebäude oder Gerichte – analysieren und detaillierte Einblicke liefern.
Liu Jingkang, Gründer von Insta360, ist der Ansicht, dass diese Funktion die Daumenkamera „neu definieren“ könnte. Dieses Upgrade unterstreicht, wie schnell KI-Large-Modelle in Consumer-Hardware eindringen und intelligente Kameras von einfachen Aufnahmegeräten in interaktive KI-Terminals mit erweiterten Verständnis- und Gesprächsfähigkeiten verwandeln.
Trumps KI-Strategie: Wie geht es mit der US-Politik weiter?
Am 3. August forderten fünf demokratische Senatoren die Trump-Regierung auf, ihre Aufsicht über Open-Weight-KI-Modelle zu präzisieren, und wiesen dabei auf Bedenken hinsichtlich der Wettbewerbsbedrohu
Tencent schüttelt das Large-Model-Team um, während Yao Shunyu die Verantwortung für das Basismodell übernimmt
Das multimodale Team von Tencent Hunyuan hat kürzlich eine bedeutende Umstrukturierung und strategische Neuausrichtung abgeschlossen. Lu Xudong, der zuvor die multimodalen Verständnisarbeiten bei xAI geleitet hatte, ist zu Hunyuan gewechselt, um die
Tongyi Qianwen Open Platform wird gestartet und bringt Conversational-as-a-Service in den Alltag.
Die Tongyi Qianwen Open Platform ist offiziell gestartet und bietet Entwicklern Zugriff auf Dienste über mobile Geräte, PCs und KI-Brillen. Nutzer müssen nicht mehr zwischen Apps wechseln; sie können verschiedene tägliche Serviceoperationen direkt in











