跳到正文
arXiv cs.CL· Tobias Braun, Nils Loose, Alexander Herzog, Virginia Ceccatelli, Marcus Rohrbach, Thomas Eisenbarth, Lorenzo Cavallaro·· 4 小时前AI 评分29

U-Space:揭示语言模型不确定性何时产生、为何产生

U-Space: Uncovering When and Why Uncertainty Arises in Language Models

AI 导读

研究者提出 U-Space,一个低维子空间,可将语言模型推理过程中不断变化的不确定性变得可测量、可解释。该方法通过定位"怀疑"与"确定"的语义锚点,将其 unembedding 方向映射回残差空间并构建正交基,U-Lens 据此生成 token 级不确定性图,也可聚合为标量置信度分数。

来源:arXiv cs.CL · arxiv.org