Документы

Руководство

По главам: левое меню переключает разделы — одна страница, одна глава. Подразделы на странице. Скриншоты из реального UI.

По текущим возможностям · соответствует холсту · статический пакет

09 / 194 min

Аудиоузлы

Аудиоузлы отвечают за голос и звук: текст в речь, клонирование и создание голоса, а также инструменты обработки звука, связанные с видео.

Текст в речь

В меню «Добавить узел» откройте «Аудио» → «Речь», чтобы создать узел синтеза речи:

  • Введите текст для озвучивания, выберите голос и параметры и сгенерируйте фрагмент;
  • На панели есть ползунки просодии — темп, высота и громкость — и вспомогательная разметка пауз / акцентов (часть из них — расширения модели; модель, которая их не поддерживает, читает разметку как обычный текст);
  • Длина текста ограничена примерно 50,000 символами — это мягкий счётчик на экране.
Open Audio from the Add-node menu to create a speech node
Open Audio from the Add-node menu to create a speech node

Клонирование и создание голоса

  • Клонирование голоса: загрузите образец записи, чтобы зарегистрировать собственный голос, которым затем можно синтезировать речь;
  • Создание голоса: создайте новый голос по описанию, без образца записи;
  • Регистрация голоса требует платы за регистрацию и выполняется асинхронно в фоне; голос в состоянии «Обрабатывается» нужно дождаться перехода в «Готов», прежде чем им пользоваться.

Связанные инструменты для звука

Многие возможности для звука на самом деле находятся на панели узла видео (см. «Узлы видео»): разделение видео и звука, наложение звука, разделение вокала и подобные извлекают или заменяют звук, в основном бесплатно.

У синтеза речи есть ползунки просодии и разметка пауз/акцентов · Клонирование / создание голоса платно и завершается асинхронно · Разделение/наложение и другие инструменты для звука находятся на панели узла видео