会話・音楽・効果音の分離
MVSEPのDemucs4HT DnRを使い、言葉、劇伴、場面の音を分けます。研究上の出発点はDivide and Remasterによる映画音声の3音源分離で、曲のボーカル・ドラム・ベースとは異なる課題です。元のステムがない会話場面で背景を下げたり、劇伴を聴いたりできます。静かさだけで判断せず、子音、語尾、短い音符、衝撃音が欠けていないか同じ瞬間を比較してください。 出力は音声、音楽、効果音の3つです。話者別の分離や翻訳は行いません。同じ原音の同じ場面で、言葉の明瞭さだけでなく音楽の連続性と効果音の長さも確認してください。研究の評価値は、手元の素材での品質保証ではありません。
音源を分離する手順
- 01
「会話・音楽・効果音の分離」を選び、元の録音を分離します。
- 02
同じフレーズや場面を各出力と原音で聴き比べます。
- 03
必要な音の始まりと余韻を確認してから、練習や編集に使います。
出力と活用方法
| 設定・選択肢 | 効果と選び方 |
|---|---|
| 適切な音源を選ぶ | 3つの役割が同時にあり、語尾と効果音が近い場面を選びます。 |
| おすすめの用途 | 話し声の下の音楽を下げる 劇伴と効果音から場面のテンポを学ぶ 難所を別の映画音声モデルと比較する |
| 聴き比べるポイント | 子音や語尾が残るか 音楽に言葉の断片が混ざるか 衝撃音と環境音が続くか |
よくある質問
違います。こちらは音声・音楽・効果音、4ステムはボーカル・ドラム・ベース・その他です。
