AI 编程 › AI 资讯 › 正文

Finding Emotions Where They Belong: Rethinking Audio Emotion Recognition through Masked Temporal Affective Grounding

arxiv · arXiv · 2026-09-27 01:27 · 评分 75

重新定义音频情感识别为时间情感接地任务,将情感与有界语音片段和声调描述关联。构建了带时间标注的情感数据集,改进多说话人、多情感事件场景下的识别精度,弥补传统整段单标签方法的不足。

原文:arXiv | 返回 AI 资讯列表