Heim
Google stellt Gemini 3.8 Flash TTS vor und ermöglicht so die natürliche Sprachanpassung sowie eine 30-Sekunden-Replikation

Die Sprachsynthese erreicht neue Höhen der Präzision. Am 23. September stellte Google zwei fortschrittliche Text-zu-Sprache-Modelle vor – Gemini 3.8 Flash TTS und Gemini 3.8 Flash-Lite TTS –, die darauf ausgelegt sind, den vielfältigen Anforderungen von Entwicklern und Kreativen an personalisierte Sprachdarstellung und großflächige Audioproduktion gerecht zu werden.
Jedes Modell erfüllt einen spezifischen Zweck. Gemini 3.8 Flash TTS ist auf die Gestaltung von Stimme und Charakter spezialisiert und ermöglicht es Nutzern, individuelle Stimmen mithilfe natürlichsprachiger Eingabeaufforderungen zu generieren. Es bietet präzise Steuerung über Tonfall, Geschwindigkeit und Akzente auf Satzebene sowie eine effiziente Stimmklonung aus lediglich einem 30-Sekunden-Audioausschnitt. Derweil ist Gemini 3.8 Flash-Lite TTS auf die Generierung großer Audiovolumina und kosteneffiziente Workflows für die Sprachdarstellung optimiert.
Diese Modelle unterstützen über 100 Sprachen und Dialekte und umfassen 2.000 vordefinierte Stimmen, die sofort einsatzbereit sind. Diese robuste mehrsprachige Fähigkeit befähigt globale Entwickler und Content-Ersteller, mühelos ausgefeilte Sprachanwendungen zu entwickeln.
Verwandter Artikel
MiniMax Code 2.0 Desktop veröffentlicht: Lange Aufgaben frieren nicht mehr ein, Fernsteuerung und Browser-Übernahme kommen diesen Monat
Entwickler, die sich mit langkettigen Codierungsaufgaben befassen, kennen die Frustration nur zu gut, dass Agenten plötzlich den Kontext verlieren oder ohne Reaktion einfrieren, was zu verschwendeter Mühe und der Notwendigkeit manueller Bereinigung f
Google investiert über 1,5 Milliarden US-Dollar für den Erwerb von Mechanize AI und treibt den Wettbewerb im Programmierbereich voran.
Google prüft eine potenzielle Übernahme des in San Francisco ansässigen Startups Mechanize, wobei der Deal einen Wert von über 1,5 Milliarden US-Dollar hat und sowohl den Erwerb von Talenten als auch die Lizenzierung von Technologie umfasst. Laut mit
YouTube Podcasts stellen KI-Durchbruch mit automatischer Geschwindigkeitsanpassung vor
Während Streamingkonkurrenten das Video-Podcast-Angebot ausbauen, um die Kern-Hörer von Spotify und Apple Podcasts für sich zu gewinnen, hat YouTube am Donnerstag neue Premium-Funktionen vorgestellt. Das Update zielt darauf ab, das Hörerlebnis durch
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)

Die Sprachsynthese erreicht neue Höhen der Präzision. Am 23. September stellte Google zwei fortschrittliche Text-zu-Sprache-Modelle vor – Gemini 3.8 Flash TTS und Gemini 3.8 Flash-Lite TTS –, die darauf ausgelegt sind, den vielfältigen Anforderungen von Entwicklern und Kreativen an personalisierte Sprachdarstellung und großflächige Audioproduktion gerecht zu werden.
Jedes Modell erfüllt einen spezifischen Zweck. Gemini 3.8 Flash TTS ist auf die Gestaltung von Stimme und Charakter spezialisiert und ermöglicht es Nutzern, individuelle Stimmen mithilfe natürlichsprachiger Eingabeaufforderungen zu generieren. Es bietet präzise Steuerung über Tonfall, Geschwindigkeit und Akzente auf Satzebene sowie eine effiziente Stimmklonung aus lediglich einem 30-Sekunden-Audioausschnitt. Derweil ist Gemini 3.8 Flash-Lite TTS auf die Generierung großer Audiovolumina und kosteneffiziente Workflows für die Sprachdarstellung optimiert.
Diese Modelle unterstützen über 100 Sprachen und Dialekte und umfassen 2.000 vordefinierte Stimmen, die sofort einsatzbereit sind. Diese robuste mehrsprachige Fähigkeit befähigt globale Entwickler und Content-Ersteller, mühelos ausgefeilte Sprachanwendungen zu entwickeln.
MiniMax Code 2.0 Desktop veröffentlicht: Lange Aufgaben frieren nicht mehr ein, Fernsteuerung und Browser-Übernahme kommen diesen Monat
Entwickler, die sich mit langkettigen Codierungsaufgaben befassen, kennen die Frustration nur zu gut, dass Agenten plötzlich den Kontext verlieren oder ohne Reaktion einfrieren, was zu verschwendeter Mühe und der Notwendigkeit manueller Bereinigung f
Google investiert über 1,5 Milliarden US-Dollar für den Erwerb von Mechanize AI und treibt den Wettbewerb im Programmierbereich voran.
Google prüft eine potenzielle Übernahme des in San Francisco ansässigen Startups Mechanize, wobei der Deal einen Wert von über 1,5 Milliarden US-Dollar hat und sowohl den Erwerb von Talenten als auch die Lizenzierung von Technologie umfasst. Laut mit
YouTube Podcasts stellen KI-Durchbruch mit automatischer Geschwindigkeitsanpassung vor
Während Streamingkonkurrenten das Video-Podcast-Angebot ausbauen, um die Kern-Hörer von Spotify und Apple Podcasts für sich zu gewinnen, hat YouTube am Donnerstag neue Premium-Funktionen vorgestellt. Das Update zielt darauf ab, das Hörerlebnis durch











