TUNENOODLE / 音軌分離 / 音效與對白

BandIt v2 多語言影視音軌分離

使用具有多語言電影音訊研究背景的 BandIt v2,將聲音拆成語音、音樂和音效。

BandIt v2 多語言影視音軌分離

BandIt v2 保留「語音」「音樂」「音效」三種影視聲音角色,並把 BandIt 模型家族與多語言 Divide and Remaster v3 數據集聯繫起來。2024 年的研究擴大了語言覆蓋,並調整混合素材的構建方式。MVSEP 將這個模式鏈接到作者的 v2 實現,供應方默認選項為多語言模型。在 Tunenoodle 中選擇模式即可,界面沒有按語言選擇專用模型的設置。 因此,多語言採訪、帶字幕場景或同一片段中切換語言的素材,都可以把它作為值得比較的選項。多語言訓練是相關背景,並不保證所有口音、語言和錄音環境表現相同。輸出是分離後的音訊,不會轉寫、翻譯或給每個詞添加標籤。 檢查語言轉換時,應把它當作實際聲音事件:聽較弱音節、詞尾,以及音樂進入時的講話,再去另外兩軌尋找殘留詞語。響亮完整的一句可能保留良好,緊接的簡短回應卻可能變弱。與 BandIt Plus 或 DnR v3 比較時保留同一原始片段,最終根據剪輯真正需要的講話和場景細節選擇,而不是僅依據版本號或數據集語言數量。

如何分離你的音訊

  1. 01

    選擇 BandIt v2,分離原始多語言片段。

  2. 02

    在三路音軌中檢查每次說話人或語言轉換。

  3. 03

    保留可用語音;關鍵字不完整時,用同一原素材比較其他影視模式。

了解輸出與使用方式
了解輸出與使用方式
參數 / 選項作用與選擇依據
先選對音訊素材保留短回應、語言或說話人切換,不要只測試響亮旁白。提交原始混音即可,不需要輸入語言提示詞。
適合用途比較同一場景切換語言前後的對白分離。 更清楚地聽音樂提示下的簡短回應,用於人工核對。 分離多語言採訪語音,同時保留配樂和實景音效。
試聽重點較弱音節是否與響亮句子一樣完整。 語言或說話人改變時語音是否保持連貫。 音樂進入後,音樂或音效軌里是否出現詞語碎片。

一些實用解答

不需要。此模式沒有按語言選擇模型的界面,應用請求供應方模式時不會額外指定語言模型選項。

接下來可以做什麼

全部模式

依用量消耗點數

傳送意見回饋

告訴我們哪裡出問題,或你希望有什麼功能。每則訊息我們都會看。

類型

來自頁面 /tw/features/stem-splitter/bandit-v2