09 / 19⏳ 2 min
音訊節點
音訊節點覆蓋語音和聲音:文字轉語音、音色克隆與設計,以及配合影片的音訊處理工具。
語音生成(TTS)
從「新增節點」選單進入「音訊」→「語音」建立語音生成節點:
- 輸入要朗讀的文字,選擇音色和參數,生成一段語音;
- 生成欄裡帶有語速、音調、音量等韻律滑桿,以及停頓、強調等標記助手(部分參數屬於模型擴展能力,不支援的模型會把標記按普通文字讀出);
- 文字長度上限約 50,000 字,是一個介面上的軟提示計數。

音色克隆與設計
- 音色克隆:上傳一段參考音訊,註冊出一個專屬音色,之後可以用它來合成語音;
- 音色設計:不依賴參考音訊,通過描述設計一個新音色;
- 註冊音色會收取一筆註冊費,註冊在後台非同步完成,處於「處理中」的音色要等它變為「就緒」後才能選用。
音訊相關工具
很多音訊能力其實掛在影片節點的工具列上(見「影片節點」一章):分離影音、音軌混合、人聲分離等,都能把聲音單獨拆出來或替換掉,多為免費操作。
語音生成帶韻律滑桿和停頓/強調標記 · 克隆 / 設計音色要付註冊費且非同步就緒 · 分離/混音等音訊工具多在影片節點工具列