对白、音乐与音效分离
成品影视声音把台词、配乐和场景声混在一起。此模式使用 MVSEP 的 Demucs4HT DnR 选项,将它们按角色拆成「语音」「音乐」「音效」。它对应电影音频分离任务:Divide and Remaster 研究框架把成品声音视为三类声源,而不是歌曲分轨常用的人声、鼓和贝斯。 没有原始分轨时,可以用它降低对白下方的配乐、观察说话时仍在演奏的音乐,或为场景剪辑准备可单独调整的声音层。先选短而有代表性的片段,其中同时出现讲话、音乐提示和清楚可辨的音效。输出按声音角色整理音频,不会翻译台词、识别每个说话人,也不会还原原始影视工程。 判断时重点是可懂度与连续性,而不只是背景是否安静。语音虽然更安静,辅音或字尾消失仍会降低可用性;音乐可能保留旋律却带着碎片化对白;音效与打击乐或音乐纹理相似时,也可能分散在多路中。应在同一场景事件处对照三条轨道,并按剪辑目的保留必要呼吸与环境声。遇到关键字、冲击声或配乐动机不完整时,再用同一原始片段比较另一种影视模式。
如何分离你的音频
- 01
选择对白、音乐与音效模式并分离音轨。
- 02
在同一代表性场景事件处试听语音、音乐和音效。
- 03
保留适合剪辑的层,关键台词或音效不完整时比较其他模式。
了解输出与使用方式
| 参数 / 选项 | 作用与选择依据 |
|---|---|
| 先选对音频素材 | 选三类声音都存在的片段,最好有靠近音效的清楚字尾。保留事件前后时序,便于发现辅音丢失或冲击声位置变化。 |
| 适合用途 | 降低讲话下方的配乐,而不把对白当作歌曲演唱处理。 分别听配乐和音效,理解场景节奏。 先得到初步结果,再在困难位置对比其他影视模型。 |
| 试听重点 | 语音中的辅音和短字尾是否保留。 音乐中是否仍有可听懂的对白碎片。 音效里的冲击与环境细节是否完整,音乐节奏是否被打碎。 |
常见问题
此模式按语音、音乐和音效划分影视声音;音乐四轨则针对人声、鼓、贝斯与其他。
接下来可以做什么
全部模式群众声与对白分离
从现场录音中拆出偏向观众声音的层次,保留其他演出内容用于比较与剪辑。
BandIt Plus 影视音轨分离
使用 BandIt Plus 拆出语音、音乐和音效,并围绕关键台词与场景事件比较结果。
BandIt v2 多语言影视音轨分离
使用具有多语言电影音频研究背景的 BandIt v2,将声音拆成语音、音乐和音效。
DnR v3 影视音轨分离
使用 MVSEP 的 DnR v3 模式拆出语音、音乐和音效,细致比较混合影视声音。
Braam 电影重击音效分离
提取 Braam 式电影重击,单独研究低频冲击、持续音色与衰减。
上升过渡音效分离
提取 Risers 上升音效,研究蓄势形状、乐句长度,以及 Drop 或副歌的到达时机。
FX 音效分离
从混合录音中拆出偏向效果的声音层,单独检查过渡、重音与纹理,并与剩余音频比较。
