Google представила модели Gemini для преобразования текста в речь с поддержкой клонирования голоса более чем на 100 языках.
23 сентября Google представила модели Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS, позволяющие разработчикам создавать пользовательские голоса, вести прямые диалоги и воспроизводить голоса дикторов через Google AI Studio и Gemini API. Модели поддерживают более 100 языков и внедряются в Gemini Notebook, Google Vids и другие продукты. Варианты использования включают аудиокниги, игры, подкасты и диалоги двух собеседников. Доступ в Google AI Studio и через API открыт с этого момента. Аудио, сге
GOOGL-0,54 %
GateNews·09-24 01:55
