AI 编程 › AI 资讯 › 正文

Revisiting Input Time-frequency Representations in Multi-pitch Estimation for Vocal Ensembles

arxiv · arXiv · 2026-10-03 01:35 · 评分 74

重新审视人声合唱多音高估计中的输入时频表示。现有模型常用谐波常数Q变换(HCQT)提供频率自适应分辨率,但动态生成训练混合时特征提取成本高;论文将HCQT与替代表示进行对比,探讨更高效的输入方案。

原文:arXiv | 返回 AI 资讯列表