09 / 19⏳ 2 min
音声ノード
音声ノードはボイスとサウンドを扱います。テキスト読み上げ、音声クローンとデザイン、そして動画に付随する音声処理ツールです。
テキスト読み上げ
ノード追加メニューで「音声」→「読み上げ」を開くと、テキスト読み上げノードを作成できます。
- 読み上げたいテキストを入力し、ボイスとパラメーターを選んでクリップを生成します。
- バーには速度・ピッチ・音量の韻律スライダーと、ポーズ / 強調のマークアップ補助があります(一部はモデルの拡張機能で、対応しないモデルではマークアップがそのまま読み上げられます)。
- テキストの長さは約 50,000 文字が上限で、画面上のカウンターはソフトリミットです。

音声クローンとデザイン
- 音声クローン:参照クリップをアップロードしてカスタムボイスを登録し、以後の合成に使えるようにします。
- 音声デザイン:参照クリップなしで、説明文から新しいボイスを設計します。
- ボイスの登録には登録料がかかり、バックグラウンドで非同期に処理されます。「処理中」のボイスは「準備完了」になってから使えます。
関連する音声ツール
多くの音声機能は、実際には動画ノードのツールバーにあります(「動画ノード」を参照)。音声・映像の分離、音声ミックス、ボーカル分離などは、いずれも音を取り出したり置き換えたりするもので、ほとんどが無料です。
テキスト読み上げには韻律スライダーとポーズ/強調のマークアップがあります · ボイスのクローン / デザインには料金がかかり、非同期で準備完了になります · 分離 / ミックスなどの音声ツールは動画ノードのツールバーにあります