TUNENOODLE / 音轨分离 / 音效与对白

对白、音乐与音效分离

使用 Demucs4HT DnR 模式,把混合配音拆成语音、音乐和音效三条音轨。

对白、音乐与音效分离

成品影视声音把台词、配乐和场景声混在一起。此模式使用 MVSEP 的 Demucs4HT DnR 选项,将它们按角色拆成「语音」「音乐」「音效」。它对应电影音频分离任务:Divide and Remaster 研究框架把成品声音视为三类声源,而不是歌曲分轨常用的人声、鼓和贝斯。 没有原始分轨时,可以用它降低对白下方的配乐、观察说话时仍在演奏的音乐,或为场景剪辑准备可单独调整的声音层。先选短而有代表性的片段,其中同时出现讲话、音乐提示和清楚可辨的音效。输出按声音角色整理音频,不会翻译台词、识别每个说话人,也不会还原原始影视工程。 判断时重点是可懂度与连续性,而不只是背景是否安静。语音虽然更安静,辅音或字尾消失仍会降低可用性;音乐可能保留旋律却带着碎片化对白;音效与打击乐或音乐纹理相似时,也可能分散在多路中。应在同一场景事件处对照三条轨道,并按剪辑目的保留必要呼吸与环境声。遇到关键字、冲击声或配乐动机不完整时,再用同一原始片段比较另一种影视模式。

如何分离你的音频

  1. 01

    选择对白、音乐与音效模式并分离音轨。

  2. 02

    在同一代表性场景事件处试听语音、音乐和音效。

  3. 03

    保留适合剪辑的层,关键台词或音效不完整时比较其他模式。

了解输出与使用方式
了解输出与使用方式
参数 / 选项作用与选择依据
先选对音频素材选三类声音都存在的片段,最好有靠近音效的清楚字尾。保留事件前后时序,便于发现辅音丢失或冲击声位置变化。
适合用途降低讲话下方的配乐,而不把对白当作歌曲演唱处理。 分别听配乐和音效,理解场景节奏。 先得到初步结果,再在困难位置对比其他影视模型。
试听重点语音中的辅音和短字尾是否保留。 音乐中是否仍有可听懂的对白碎片。 音效里的冲击与环境细节是否完整,音乐节奏是否被打碎。

常见问题

此模式按语音、音乐和音效划分影视声音;音乐四轨则针对人声、鼓、贝斯与其他。

接下来可以做什么

全部模式

按用量消耗积分

发送反馈

告诉我们哪里出了问题,或你希望有什么功能。每条消息我们都会看。

类型

来自页面 /zh/features/stem-splitter/dialogue-music-effects