09 / 19⏳ 2 min
音频节点
音频节点覆盖语音和声音:文字转语音、音色克隆与设计,以及配合视频的音频处理工具。
语音生成(TTS)
从「添加节点」菜单进入「音频」→「语音」创建语音生成节点:
- 输入要朗读的文字,选择音色和参数,生成一段语音;
- 生成栏里带有语速、音调、音量等韵律滑杆,以及停顿、强调等标记助手(部分参数属于模型扩展能力,不支持的模型会把标记按普通文字读出);
- 文本长度上限约 50,000 字,是一个界面上的软提示计数。

音色克隆与设计
- 音色克隆:上传一段参考音频,注册出一个专属音色,之后可以用它来合成语音;
- 音色设计:不依赖参考音频,通过描述设计一个新音色;
- 注册音色会收取一笔注册费,注册在后台异步完成,处于「处理中」的音色要等它变为「就绪」后才能选用。
音频相关工具
很多音频能力其实挂在视频节点的工具栏上(见「视频节点」一章):分离音视频、音轨混合、人声分离等,都能把声音单独拆出来或替换掉,多为免费操作。
语音生成带韵律滑杆和停顿/强调标记 · 克隆 / 设计音色要付注册费且异步就绪 · 分离/混音等音频工具多在视频节点工具栏