arxiv · arXiv · 2026-10-07 01:41 · 评分 80
该研究指出LLM刻板印象评估中单对对照语句比较可能不可靠,提出双最小对设置及数据增强框架,以更稳健地测量模型偏见。
原文:arXiv | 返回 AI 资讯列表