НОВОСТИ

Suno научилась говорить: функция Speech делает голос и музыку одной дорожкой

Платформа генеративной музыки добавила синтез речи: Speech создаёт озвучку по описанию или готовому сценарию и микшует её с собственным саундтреком.

Suno научилась говорить: функция Speech делает голос и музыку одной дорожкой
Содержание 6
  1. 01Как это работает: два режима и восемь минут
  2. 02Зачем объединять речь и музыку в один файл
  3. 03Компания сама предупреждает: бета значит бета
  4. 04Почему это важно для самой Suno
  5. 05Доступность и ситуация в Беларуси
  6. 06Текст: TehnoRex

Сервис Suno, известный генерацией песен по текстовому запросу, вышел в новую для себя категорию. Компания запустила функцию Speech, которая создаёт синтезированный голос по описанию или готовому сценарию — и сразу добавляет к нему фоновую музыку, так что на выходе получается одна готовая дорожка, а не два отдельных файла, которые потом нужно сводить в редакторе.

Как это работает: два режима и восемь минут

Speech уже открыт в публичной бете на веб-платформе и в мобильных приложениях сервиса. В простом режиме пользователь описывает желаемое словами — например, «пиратский капитан подбадривает команду» — и получает результат без лишних настроек. Продвинутый режим принимает собственный текст и позволяет выбрать пол голоса, стиль подачи и степень вариативности между генерациями. Максимальная длина дорожки — около восьми минут, чего хватает на короткий рассказ, рекламный ролик или аудиоверсию статьи. Музыку можно отключить одним переключателем, если нужен чистый голос.

Зачем объединять речь и музыку в один файл

Популярные сервисы синтеза речи решают задачу иначе: сначала генерируется голос, потом отдельно подбирается музыка, и всё это смешивается в стороннем редакторе. Suno предлагает другой путь — модель сама выстраивает баланс между голосом и сопровождением, что заметно упрощает работу над подкастами, аудиорекламой и короткими видео. Именно в этом главное отличие от существующих инструментов: конкуренты умеют либо говорить, либо играть, а здесь обе задачи решаются одним запросом.

ПараметрSpeech в Suno
Статуспубличная бета, веб и мобильные приложения
Входные данныеописание или собственный сценарий
Настройкипол голоса, стиль речи, вариативность
Музыкагенерируется вместе с голосом, отключается переключателем
Длина дорожкидо восьми минут

Компания сама предупреждает: бета значит бета

Директор по продукту Suno Джек Броуди прямо говорит, что функция далека от идеала и будет дорабатываться по обратной связи. В шутливом предупреждении он отметил, что британский акцент иногда «уходит в Австралию и возвращается», а драматические паузы выходят слишком драматичными. Такая честность объяснима: рынок синтеза речи сформирован задолго до Suno. Adobe выпустила собственный инструмент текст-в-речь, ElevenLabs стал одним из самых узнаваемых игроков с 2023 года, а исследовательские команды экспериментируют с глубоким синтезом уже десятилетие. Платформа приходит на готовый рынок и пытается взять не качеством отдельного голоса, а связкой с музыкой.

Почему это важно для самой Suno

У расширения в сторону речи есть и защитная логика. Музыкальный генератор компании уже собрал вокруг себя серию судебных исков, и диверсификация позволяет снизить зависимость от одного продукта. Похожие процессы идут у всех игроков генеративного ИИ: пока одни платформы воюют с правообладателями, другие ищут применения, где регуляторные риски ниже. О том, как регуляторы и суды влияют на рынок, мы писали в материалах о расследовании FTC против OpenAI и Anthropic и о том, как суд отклонил антимонопольные иски к Google из-за AI Overviews. Ещё один пример генеративной модели — «Яндекс» Sona для персональных рекомендаций.

Доступность и ситуация в Беларуси

Отдельного анонса для Беларуси у Suno нет: Speech открыт на тех же условиях, что и остальные функции сервиса, — через браузер и мобильные приложения, без локальной версии и без представительства в стране. Стоимость подписок платформа указывает в долларах, поэтому для белорусских пользователей фактическая сумма зависит от курса Нацбанка: на 2 октября он составляет 3,0051 рубля за доллар. Практический вывод для тех, кто делает подкасты или озвучку: Speech стоит проверить на коротких дорожках, пока функция в бете, а для больших проектов пока надёжнее держать под рукой запасной инструмент синтеза речи — качество и стабильность генерации у Suno обещают улучшать постепенно, а не сразу.

Текст: TehnoRex

ПОДПИШИТЕСЬ НА РАССЫЛКУ

Новые обзоры и сравнения — на почту