Google представив голосові моделі Gemini 3.8 Flash TTS для синтезу мовлення

Gemini 3.8 text-to-speech says hello

Google DeepMind випустив дві нові моделі синтезу мовлення — Gemini 3.8 Flash TTS та Flash-Lite TTS, які дозволяють створювати кастомні голоси персонажів і покроково керувати озвученням природною мовою. Моделі підтримують понад 100 мов, реплікацію голосу з підтвердженням згоди та водяні знаки SynthID, і вже доступні через Google AI Studio, Gemini API та інші продукти компанії.

Мовою оригіналу · EN

Google DeepMind introduced Gemini 3.8 Flash TTS and Flash-Lite TTS, its most expressive text-to-speech models yet, enabling custom character voices and line-by-line performance direction. The models…

Читати оригінал на Google DeepMind →

Чому в стрічці: Значний реліз голосових моделей Gemini від Google відповідає високому інтересу користувача до AI.

← Назад до стрічки