文档

操作手册

按章节阅读:左侧切换章节,一页只看当前章。步骤说明对应真实界面,配图取自真实中文界面。

按当前产品界面编写 · 步骤可照着做 · 静态内容包

09 / 192 min

音频节点

音频节点覆盖语音和声音:文字转语音、音色克隆与设计,以及配合视频的音频处理工具。

语音生成(TTS)

从「添加节点」菜单进入「音频」→「语音」创建语音生成节点:

  • 输入要朗读的文字,选择音色和参数,生成一段语音;
  • 生成栏里带有语速、音调、音量等韵律滑杆,以及停顿、强调等标记助手(部分参数属于模型扩展能力,不支持的模型会把标记按普通文字读出);
  • 文本长度上限约 50,000 字,是一个界面上的软提示计数。
从「添加节点」菜单进入「音频」创建语音生成节点
从「添加节点」菜单进入「音频」创建语音生成节点

音色克隆与设计

  • 音色克隆:上传一段参考音频,注册出一个专属音色,之后可以用它来合成语音;
  • 音色设计:不依赖参考音频,通过描述设计一个新音色;
  • 注册音色会收取一笔注册费,注册在后台异步完成,处于「处理中」的音色要等它变为「就绪」后才能选用。

音频相关工具

很多音频能力其实挂在视频节点的工具栏上(见「视频节点」一章):分离音视频、音轨混合、人声分离等,都能把声音单独拆出来或替换掉,多为免费操作。

语音生成带韵律滑杆和停顿/强调标记 · 克隆 / 设计音色要付注册费且异步就绪 · 分离/混音等音频工具多在视频节点工具栏