Google hat am 19. Mai sein neues multimodales KI-Modell „Gemini Omni“ vorgestellt. Es wurde für eine nahtlose modalübergreifende Interaktion entwickelt und verarbeitet gleichzeitig Text, Audio, Bilder und Videos. Das Modell bietet eine verbesserte Geschwindigkeit, Genauigkeit und Echtzeitleistung und zielt darauf ab, die Interaktion zwischen Nutzer und KI für Anwendungen in den Bereichen Bildung, Unterhaltung und Wirtschaft zu verbessern.





Heim
