Содержание 2
Google добавила в семейство Gemini сразу две модели синтеза речи: Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS. Компания описывает это как переход от статичных голосовых пресетов к динамической студии: голос теперь создаётся по текстовому описанию, а не выбирается из списка.
Что умеют новые модели
Старшая версия рассчитана на творческие задачи и дизайн персонажей: голос создаётся с нуля по подсказке на естественном языке, отдельно настраиваются манера, темп и даже диалектные переходы. Младшая Flash-Lite ориентирована на массовое озвучивание, где важнее цена и объём, но тоже позволяет управлять тоном и нюансами подачи.
Клонирование голоса требует всего 30 секунд аудио. Чтобы этим нельзя было злоупотреблять, Google встроила проверку согласия: разработчик обязан предоставить запись, где владелец голоса разрешает создание копии. Дополнительно каждый сгенерированный фрагмент помечается водяным знаком SynthID и метаданными C2PA.
| Возможность | Что даёт |
|---|---|
| Клон голоса | образец 30 секунд, проверка согласия |
| Режиссура по строкам | свои указания к каждой реплике |
| Невербальные вставки | смех, вздох, реакция в диалоге |
| Маркировка | SynthID и C2PA в каждом файле |
| Языки | более 100 |
Кому это доступно
Разработчики могут попробовать обе модели в Gemini API и Google AI Studio уже сейчас, корпоративным клиентам обещают доступ через Gemini Enterprise. Обычный пользователь встретит их в продуктах Google: Flash TTS появится в Gemini Notebook, Flash-Lite — в Google Vids.
Отдельно стоит отметить заявленные результаты: в отраслевом индексе качества синтеза речи старшая модель заняла первое место, младшая — второе. Если цифры подтвердятся на практике, разница между «звучит как робот» и «звучит как человек» в озвучке видео и подкастов сократится ещё сильнее — а вместе с ней вырастет и цена вопроса о том, как отличать настоящий голос от сгенерированного.
Ещё одна деталь — языковой охват: заявлена поддержка более ста языков, а в слепых сравнениях на основных мировых языках обе модели вышли в лидеры. Для команд, которые делают озвучку сразу для нескольких рынков, это снимает необходимость искать отдельного исполнителя под каждый язык.
По теме: GPT-6 Sol и Luna подешевели вдвое, Яндекс открыл модель AliceAI-Foundation.
Текст TehnoRex. Дата: 2026-09-23.



