arxiv · arXiv · 2026-10-03 01:35 · 评分 74
重新审视人声合唱多音高估计中的输入时频表示。现有模型常用谐波常数Q变换(HCQT)提供频率自适应分辨率,但动态生成训练混合时特征提取成本高;论文将HCQT与替代表示进行对比,探讨更高效的输入方案。
原文:arXiv | 返回 AI 资讯列表