Demixr Pro 分离实验室
把复杂环境下的人声分离,推进到可试听、可制作的质量。
Demixr Pro 面向真实音乐场景优化:厚混响、密集编曲、低码率压缩和现场环境声都纳入实验评估。这里会持续展示不同环境下的分离结果、试听样本和模型迭代记录。
26.93 dB
内部验证平均 Vocal SDR
44.1k
立体声高分辨率分析
12L
深度时频分离核心
实验试听工作台
Demixr Pro Model Preview
持续更新

原曲
人声
伴奏
重混响室内
房间尾音、反射声与近讲人声共存
密集编曲
鼓组、合成器、吉他墙同时压在人声上
低码率音源
压缩伪影明显,仍保持声线轮廓
现场/环境声
掌声、背景噪声与空间感干扰
算法说明
Demixr Pro 的核心不是简单降噪,而是重新估计人声与伴奏的时频归属。
模型会先把音乐拆解成高分辨率频谱,再按人耳感知和音乐能量分布进行频带重组。随后,时频双轴网络同时判断某一瞬间属于人声、伴奏还是两者重叠,并输出细粒度掩码。最后通过多尺度频谱一致性校正,让人声边缘更自然、伴奏残留更少。
高分辨率频谱展开
输入音频以 44.1kHz 立体声解析,使用 2048 点频谱窗和细粒度 hop 捕捉齿音、瞬态和低频能量。
自适应频带切分
低频用更窄频带建模,高频用更宽频带聚合,让模型同时看清人声基频、泛音和伴奏纹理。
时频双轴注意力
12 层深度分离核心在时间轴追踪音节连接,在频率轴判断乐器遮挡,减少人声断裂和伴奏残留。
多尺度一致性约束
输出阶段同时检查多个频谱尺度,降低水声、金属边缘和瞬态抹除,让结果更适合试听与二次制作。
分离试听实验
真实样本的人声分离 A/B 试听。
以下样本来自本地 mp3 文件夹,已经使用 Demixr Pro 完成人声与伴奏分离。每组都可以直接对比原曲、人声和伴奏。
Experiment 01
和声分离
原曲
MP3
人声
MP3
伴奏
MP3
Experiment 02
伴奏分离实验
原曲
MP3
人声
MP3
伴奏
MP3
Experiment 03
复杂环境分离实验
原曲
MP3
人声
MP3
伴奏
MP3
Experiment 04
噪声环境分离实验
原曲
MP3
人声
MP3
伴奏
MP3