Mix Online· Mix Staff·· 14 天前AI 评分72
AudioShake 发布对话分离工具 Multi-Speaker 2.0
AudioShake Releases Multi-Speaker 2.0
中文摘要
AudioShake 发布 Multi-Speaker 2.0,更新其对话分离工具,可将一段混合对话中的不同人声拆分为独立、干净的音轨,并针对笑声盖过对白、相邻领夹麦串音及多人重叠说话等 Crosstalk 场景隔离声音,同时尽量保留自然表达。
编辑可通过 AudioShake Studio 或 API 上传混合文件,导出与源素材采样率匹配的独立说话人音轨,以及包含房间声、交通声和背景噪声的独立环境声轨,用于压低、修饰或重建声场。系统还会提供定向置信度标记,把低置信度片段定位到 20 毫秒帧,便于编辑直接检查可能需要人工复听的位置。
报道称,2.0 版在嘈杂环境中的隔离更清晰,与 1.0 相比串音减少 32%,并提供 8 kHz 至 48 kHz 的全频段覆盖。AudioShake 称其采用纯声学模型而非预测式语言模型,以保留带口音的表达、多语言对话和重叠发声,避免产生臆造式编辑。Multi-Speaker 2.0 已在 AudioShake Studio 提供。
来源:Mix Online · mixonline.com