
Suno запустила Speech Beta для создания озвучки с автоматически сгенерированной фоновой музыкой. Модель доступна в веб-версии и мобильных приложениях.
Suno запустила Speech Beta — отдельную модель для создания озвучки, которая объединяет голос и фоновую музыку в единый аудиотрек. Это позволяет получать готовую озвученную композицию без необходимости отдельно генерировать речь и саундтрек, а затем объединять их.
В Speech можно вставить собственный текст, стихотворение или просто описать желаемую идею. Затем пользователь задаёт голос и музыкальный стиль, после чего модель создаёт готовый аудиотрек с озвучкой и автоматически сгенерированным музыкальным сопровождением.
Ключевая особенность Speech Beta заключается именно в совместной генерации голоса и музыки. Речь и фон не выступают двумя независимыми элементами, которые нужно сводить вручную: сервис формирует их как единую аудиокомпозицию.
Новая модель подходит для разных форматов, где обычной синтезированной речи недостаточно и требуется музыкальная атмосфера.
Например, с её помощью можно создавать:
Таким образом, Speech может быть интересна не только для генерации обычной озвучки, но и для создания законченных аудиоформатов, в которых голос является частью музыкальной композиции.
Speech пока находится в статусе Beta. Suno предупреждает, что акценты и паузы могут работать нестабильно. Поэтому результат генерации может потребовать дополнительных попыток, особенно если для конкретного текста важны точная интонация, расстановка пауз или характерное произношение.
При этом функция уже доступна всем пользователям Suno в веб-версии и мобильных приложениях.
Подробнее о запуске Speech Beta компания рассказывает в официальном анонсе.
Бесплатные промпты для нейросетей на русском, новости ИИ и уроки по генерации фото, видео и текста, доступные на всех площадках.