群众声与对白分离
现场录音不只有表演:掌声、交谈、欢呼和口哨常会盖过乐句间的安静细节。这个模式返回两份文件:「群众声/对白」和「其他」。它在 MVSEP 中源于观众声移除模型,因此最合适的起点是判断观众活动能从演出中分开多少,而不是期待分别拿到语音、音乐、音效三条轨道。 目标音轨可用来观察观众反应何时增强;准备更安静的现场音乐片段时,则重点试听「其他」。选一段从音乐过渡到掌声的素材,能看出观众越来越响时演出是否仍自然。名称中的「对白」不代表说话人识别,也不保证每一句口播都会进入群众声层。近距离讲话与分散的观众聊天可能有不同表现。 尤其要检查与军鼓重合的拍手、靠近歌声音高的口哨,以及覆盖持续音乐的报幕。这些重叠比静音处的单独掌声更能检验结果。为了保留可信的现场氛围,不一定要去掉所有观众声音。可对比适量降低与完全移除,在决定剪辑前听清空间感是否跳变,以及演出中的打击乐或持续音是否受损。
如何分离你的音频
- 01
选择群众声/对白模式,分离现场录音。
- 02
分别比较裸露掌声与音乐重叠时的两路输出。
- 03
确定自然的观众声保留量,再裁出可用演出片段。
了解输出与使用方式
| 参数 / 选项 | 作用与选择依据 |
|---|---|
| 先选对音频素材 | 同时保留音乐转掌声和音乐下方仍有掌声的片段。只有静音处掌声的素材,不能说明重叠时演出是否完整。 |
| 适合用途 | 降低歌曲衔接处的掌声,同时保留自然现场气氛。 研究被观众声音掩盖的轻柔演奏细节。 独立观察观众反应层,辅助确定剪辑位置。 |
| 试听重点 | 拍手是否与军鼓或其他演出打击乐混淆。 口哨和欢呼是否带走部分歌声或乐器长音。 其他音轨在过渡处是否保留连续的现场空间感。 |
常见问题
不会。它输出群众声/对白与其他两路。需要三类独立文件时,请选择对白、音乐、音效三轨模式。
接下来可以做什么
全部模式对白、音乐与音效分离
使用 Demucs4HT DnR 模式,把混合配音拆成语音、音乐和音效三条音轨。
BandIt Plus 影视音轨分离
使用 BandIt Plus 拆出语音、音乐和音效,并围绕关键台词与场景事件比较结果。
BandIt v2 多语言影视音轨分离
使用具有多语言电影音频研究背景的 BandIt v2,将声音拆成语音、音乐和音效。
DnR v3 影视音轨分离
使用 MVSEP 的 DnR v3 模式拆出语音、音乐和音效,细致比较混合影视声音。
Braam 电影重击音效分离
提取 Braam 式电影重击,单独研究低频冲击、持续音色与衰减。
上升过渡音效分离
提取 Risers 上升音效,研究蓄势形状、乐句长度,以及 Drop 或副歌的到达时机。
FX 音效分离
从混合录音中拆出偏向效果的声音层,单独检查过渡、重音与纹理,并与剩余音频比较。
