AI 编程 › AI 资讯 › 正文

Do Audio Language Models Hear and Read Distinctive Features Alike?

arxiv · arXiv · 2026-09-25 01:21 · 评分 86

研究音频语言模型在听语音和读文本时,是否以同一方向表征音位的区分性特征。通过比较语音流与文本流中特征方向的余弦相似度,检验跨模态表征是否一致。

原文:arXiv | 返回 AI 资讯列表