Zum Inhalt springen
Google DeepMind·· vor 13 TagenAuswahlKI-Bewertung75

Google führt zwei Gemini-Modelle für Sprachausgabe ein

Gemini 3.8 text-to-speech says hello

KI-Überblick

Google führt Gemini 3.8 Flash TTS für gestaltbare Stimmen und Flash-Lite TTS für grosse Audiomengen ein; beide wandeln Text in Sprache um. Laut Google unterstützen beide mehr als 100 Sprachen und werden für Entwickler über die Gemini-Schnittstelle und Google AI Studio bereitgestellt. Flash TTS kann mit einer 30 Sekunden langen Aufnahme und Einwilligungsprüfung Stimmen nachbilden; diese Funktion ist in Google AI Studio in der Schweiz nicht verfügbar.

Grund für die Empfehlung

Für Schweizer Nutzer unterscheiden sich die Einsatzbereiche der Modelle und der Zugang zur Stimmnachbildung.

Quelle:Google DeepMind · deepmind.google