Googles KI-Assistent Gemini Live verbessert die Antworten mit Bildern
Google führt eine Reihe neuer Funktionen für Gemini Live ein, seinen KI-Assistenten für Konversationen. Ab nächster Woche wird Gemini Live die Fähigkeit erhalten, Objekte direkt auf Ihrem Bildschirm zu markieren, während Sie Ihren Kamera-Feed verwenden, so dass der Assistent bestimmte Gegenstände mit größerer Präzision visuell anzeigen kann.
Wenn Sie beispielsweise ein bestimmtes Werkzeug unter vielen anderen suchen, richten Sie einfach die Kamera Ihres Telefons auf das Sortiment, und Gemini Live zeigt das richtige Werkzeug auf dem Display an. Diese visuelle Anleitung wird erstmals auf den neu angekündigten Pixel 10-Geräten zu sehen sein, wenn sie am 28. August auf den Markt kommen. Google wird die Funktion dann gleichzeitig auf andere Android-Telefone ausweiten, wobei die iOS-Unterstützung in den kommenden Wochen folgen wird.

Gemini Live platziert einen Kasten um das, was Sie sich ansehen sollen : GoogleGoogle führt außerdem eine tiefere App-Integration ein, so dass Gemini Live in naher Zukunft mit Messages, Phone und Clock zusammenarbeiten kann. Stellen Sie sich vor, Sie besprechen eine Wegbeschreibung mit Gemini, wenn Sie merken, dass Sie sich verspäten. Sie können den Assistenten jetzt unterbrechen und sagen: "Diese Route funktioniert. Schicken Sie Alex bitte eine Nachricht, dass ich mich um 10 Minuten verspäten werde. Gemini entwirft dann den Text, den Sie überprüfen und senden können.

Gemini Live wird Ihnen bald auch helfen, Anrufe zu tätigen und Texte zu verfassen : GoogleVerwandt
- Googles KI Gemini merkt sich automatisch Nutzerdaten für personalisierte Interaktionen
- Die neuesten Pixel-Geräte integrieren generative KI direkt in das Kamerasystem
Und schließlich veröffentlicht Google ein verbessertes Audiomodell für Gemini Live, das die Verwendung natürlicher Sprachelemente wie Intonation, Rhythmus und Tempo durch den Chatbot deutlich verbessert. Der Assistent wird bald seinen Tonfall an den jeweiligen Kontext anpassen - zum Beispiel kann er ruhiger sprechen, wenn er ein stressiges Thema anspricht.
Die Nutzer werden auch die Kontrolle über die Sprechgeschwindigkeit von Gemini erhalten, eine Funktion, die an die anpassbaren Sprachstile von ChatGPT erinnert. Wenn Gemini eine Geschichte aus der Perspektive eines Charakters oder einer historischen Figur dramatisch nacherzählen soll, kann er außerdem Akzente einbauen, um eine lebendigere und eindringlichere Erzählung zu schaffen.
Verwandter Artikel
Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI
Warner Music Group (WMG) hat am Mittwoch bestätigt, dass es Sureel AI, ein Startup für KI-gestützte Attribution, übernimmt. Die proprietäre Technologie von Sureel generiert „AI-DNA“ für Musikstücke, indem sie diese in ihre Bestandteile zerlegt, um na
Amazon führt Alexa für den Einkauf ein und schiebt Rufus in den Hintergrund
Amazon hat Alexa for Shopping eingeführt, indem es den Rufus-Shopping-Chatbot mit Alexa+ in der App, auf der Website und auf Echo Show-Geräten zusammenführt.Der Assistent beantwortet Produktanfragen, vergleicht Artikel, verfolgt Preise und unterstüt
Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien
Microsoft investiert in die KI-gestützte Erkennung von Waldbränden. Juan Lavista Ferres, CVP und Chief Data Scientist, erörtert Strategien zur Eindämmung von Umweltschäden.Laut der NASA betrifft der K
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Google führt eine Reihe neuer Funktionen für Gemini Live ein, seinen KI-Assistenten für Konversationen. Ab nächster Woche wird Gemini Live die Fähigkeit erhalten, Objekte direkt auf Ihrem Bildschirm zu markieren, während Sie Ihren Kamera-Feed verwenden, so dass der Assistent bestimmte Gegenstände mit größerer Präzision visuell anzeigen kann.
Wenn Sie beispielsweise ein bestimmtes Werkzeug unter vielen anderen suchen, richten Sie einfach die Kamera Ihres Telefons auf das Sortiment, und Gemini Live zeigt das richtige Werkzeug auf dem Display an. Diese visuelle Anleitung wird erstmals auf den neu angekündigten Pixel 10-Geräten zu sehen sein, wenn sie am 28. August auf den Markt kommen. Google wird die Funktion dann gleichzeitig auf andere Android-Telefone ausweiten, wobei die iOS-Unterstützung in den kommenden Wochen folgen wird.

Google führt außerdem eine tiefere App-Integration ein, so dass Gemini Live in naher Zukunft mit Messages, Phone und Clock zusammenarbeiten kann. Stellen Sie sich vor, Sie besprechen eine Wegbeschreibung mit Gemini, wenn Sie merken, dass Sie sich verspäten. Sie können den Assistenten jetzt unterbrechen und sagen: "Diese Route funktioniert. Schicken Sie Alex bitte eine Nachricht, dass ich mich um 10 Minuten verspäten werde. Gemini entwirft dann den Text, den Sie überprüfen und senden können.

Verwandt
- Googles KI Gemini merkt sich automatisch Nutzerdaten für personalisierte Interaktionen
- Die neuesten Pixel-Geräte integrieren generative KI direkt in das Kamerasystem
Und schließlich veröffentlicht Google ein verbessertes Audiomodell für Gemini Live, das die Verwendung natürlicher Sprachelemente wie Intonation, Rhythmus und Tempo durch den Chatbot deutlich verbessert. Der Assistent wird bald seinen Tonfall an den jeweiligen Kontext anpassen - zum Beispiel kann er ruhiger sprechen, wenn er ein stressiges Thema anspricht.
Die Nutzer werden auch die Kontrolle über die Sprechgeschwindigkeit von Gemini erhalten, eine Funktion, die an die anpassbaren Sprachstile von ChatGPT erinnert. Wenn Gemini eine Geschichte aus der Perspektive eines Charakters oder einer historischen Figur dramatisch nacherzählen soll, kann er außerdem Akzente einbauen, um eine lebendigere und eindringlichere Erzählung zu schaffen.
Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI
Warner Music Group (WMG) hat am Mittwoch bestätigt, dass es Sureel AI, ein Startup für KI-gestützte Attribution, übernimmt. Die proprietäre Technologie von Sureel generiert „AI-DNA“ für Musikstücke, indem sie diese in ihre Bestandteile zerlegt, um na
Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien
Microsoft investiert in die KI-gestützte Erkennung von Waldbränden. Juan Lavista Ferres, CVP und Chief Data Scientist, erörtert Strategien zur Eindämmung von Umweltschäden.Laut der NASA betrifft der K





Heim






