TUNENOODLE / 音轨分离 / 音效与对白

BandIt v2 多语言影视音轨分离

使用具有多语言电影音频研究背景的 BandIt v2,将声音拆成语音、音乐和音效。

BandIt v2 多语言影视音轨分离

BandIt v2 保留「语音」「音乐」「音效」三种影视声音角色,并把 BandIt 模型家族与多语言 Divide and Remaster v3 数据集联系起来。2024 年的研究扩大了语言覆盖,并调整混合素材的构建方式。MVSEP 将这个模式链接到作者的 v2 实现,供应方默认选项为多语言模型。在 Tunenoodle 中选择模式即可,界面没有按语言选择专用模型的设置。 因此,多语言采访、带字幕场景或同一片段中切换语言的素材,都可以把它作为值得比较的选项。多语言训练是相关背景,并不保证所有口音、语言和录音环境表现相同。输出是分离后的音频,不会转写、翻译或给每个词添加标签。 检查语言转换时,应把它当作实际声音事件:听较弱音节、词尾,以及音乐进入时的讲话,再去另外两轨寻找残留词语。响亮完整的一句可能保留良好,紧接的简短回应却可能变弱。与 BandIt Plus 或 DnR v3 比较时保留同一原始片段,最终根据剪辑真正需要的讲话和场景细节选择,而不是仅依据版本号或数据集语言数量。

如何分离你的音频

  1. 01

    选择 BandIt v2,分离原始多语言片段。

  2. 02

    在三路音轨中检查每次说话人或语言转换。

  3. 03

    保留可用语音;关键字不完整时,用同一原素材比较其他影视模式。

了解输出与使用方式
了解输出与使用方式
参数 / 选项作用与选择依据
先选对音频素材保留短回应、语言或说话人切换,不要只测试响亮旁白。提交原始混音即可,不需要输入语言提示词。
适合用途比较同一场景切换语言前后的对白分离。 更清楚地听音乐提示下的简短回应,用于人工核对。 分离多语言采访语音,同时保留配乐和实景音效。
试听重点较弱音节是否与响亮句子一样完整。 语言或说话人改变时语音是否保持连贯。 音乐进入后,音乐或音效轨里是否出现词语碎片。

常见问题

不需要。此模式没有按语言选择模型的界面,应用请求供应方模式时不会额外指定语言模型选项。

接下来可以做什么

全部模式

按用量消耗积分

发送反馈

告诉我们哪里出了问题,或你希望有什么功能。每条消息我们都会看。

类型

来自页面 /zh/features/stem-splitter/bandit-v2