AI 编程 › AI 资讯 › 正文

Controlled Decoding Attacks on Black-Box LLMs

arxiv · arXiv · 2026-09-29 15:58 · 评分 90

针对仅返回采样文本的黑盒大模型接口,现有解码攻击因无法获得权重或数值概率而失效。论文提出从采样输出重建概率的控制解码攻击方法,并解决有限采样导致的稀疏噪声估计与高查询成本问题。

原文:arXiv | 返回 AI 资讯列表