BandIt v2 多語言影視音軌分離
BandIt v2 保留「語音」「音樂」「音效」三種影視聲音角色,並把 BandIt 模型家族與多語言 Divide and Remaster v3 數據集聯繫起來。2024 年的研究擴大了語言覆蓋,並調整混合素材的構建方式。MVSEP 將這個模式鏈接到作者的 v2 實現,供應方默認選項為多語言模型。在 Tunenoodle 中選擇模式即可,界面沒有按語言選擇專用模型的設置。 因此,多語言採訪、帶字幕場景或同一片段中切換語言的素材,都可以把它作為值得比較的選項。多語言訓練是相關背景,並不保證所有口音、語言和錄音環境表現相同。輸出是分離後的音訊,不會轉寫、翻譯或給每個詞添加標籤。 檢查語言轉換時,應把它當作實際聲音事件:聽較弱音節、詞尾,以及音樂進入時的講話,再去另外兩軌尋找殘留詞語。響亮完整的一句可能保留良好,緊接的簡短回應卻可能變弱。與 BandIt Plus 或 DnR v3 比較時保留同一原始片段,最終根據剪輯真正需要的講話和場景細節選擇,而不是僅依據版本號或數據集語言數量。
如何分離你的音訊
- 01
選擇 BandIt v2,分離原始多語言片段。
- 02
在三路音軌中檢查每次說話人或語言轉換。
- 03
保留可用語音;關鍵字不完整時,用同一原素材比較其他影視模式。
了解輸出與使用方式
| 參數 / 選項 | 作用與選擇依據 |
|---|---|
| 先選對音訊素材 | 保留短回應、語言或說話人切換,不要只測試響亮旁白。提交原始混音即可,不需要輸入語言提示詞。 |
| 適合用途 | 比較同一場景切換語言前後的對白分離。 更清楚地聽音樂提示下的簡短回應,用於人工核對。 分離多語言採訪語音,同時保留配樂和實景音效。 |
| 試聽重點 | 較弱音節是否與響亮句子一樣完整。 語言或說話人改變時語音是否保持連貫。 音樂進入後,音樂或音效軌里是否出現詞語碎片。 |
一些實用解答
不需要。此模式沒有按語言選擇模型的界面,應用請求供應方模式時不會額外指定語言模型選項。
接下來可以做什麼
全部模式群眾聲與對白分離
從現場錄音中拆出偏向觀眾聲音的層次,保留其他演出內容用於比較與剪輯。
對白、音樂與音效分離
使用 Demucs4HT DnR 模式,把混合配音拆成語音、音樂和音效三條音軌。
BandIt Plus 影視音軌分離
使用 BandIt Plus 拆出語音、音樂和音效,並圍繞關鍵台詞與場景事件比較結果。
DnR v3 影視音軌分離
使用 MVSEP 的 DnR v3 模式拆出語音、音樂和音效,細緻比較混合影視聲音。
Braam 電影重擊音效分離
提取 Braam 式電影重擊,單獨研究低頻衝擊、持續音色與衰減。
上升過渡音效分離
提取 Risers 上升音效,研究蓄勢形狀、樂句長度,以及 Drop 或副歌的到達時機。
FX 音效分離
從混合錄音中拆出偏向效果的聲音層,單獨檢查過渡、重音與紋理,並與剩餘音訊比較。
