Google DeepMind·· vor 13 TagenAuswahlKI-Bewertung75
Google führt zwei Gemini-Modelle für Sprachausgabe ein
Gemini 3.8 text-to-speech says hello
KI-Überblick
Google führt Gemini 3.8 Flash TTS für gestaltbare Stimmen und Flash-Lite TTS für grosse Audiomengen ein; beide wandeln Text in Sprache um. Laut Google unterstützen beide mehr als 100 Sprachen und werden für Entwickler über die Gemini-Schnittstelle und Google AI Studio bereitgestellt. Flash TTS kann mit einer 30 Sekunden langen Aufnahme und Einwilligungsprüfung Stimmen nachbilden; diese Funktion ist in Google AI Studio in der Schweiz nicht verfügbar.
Grund für die Empfehlung
Für Schweizer Nutzer unterscheiden sich die Einsatzbereiche der Modelle und der Zugang zur Stimmnachbildung.
Quelle:Google DeepMind · deepmind.google