AI 编程 › AI 资讯 › 正文

User Model Extraction via Belief Self-Distillation

arxiv · arXiv · 2026-09-26 01:54 · 评分 87

研究者提出信念自蒸馏(BSD)框架,学习可读写的紧凑用户表征,冻结LLM作为自身教师从自然对话中蒸馏用户信念;该框架统一线性和因果探针,便于检查和干预模型的用户建模。

原文:arXiv | 返回 AI 资讯列表