跳到正文
arXiv cs.LG· Tobias Hallmen, Elisabeth Andr\'e·· 9 小时前AI 评分22

语言承载专家印象:基于评分工具的 LLM 评委跨域迁移咨询质量评估并超越域内训练

Language Carries the Expert's Impression: Instrument-Anchored LLM Judges Transfer Counseling-Quality Assessment and Beat In-Domain Training

AI 导读

一项 arXiv 预印研究用小型开源权重 LLM 读取双人咨询转录文本,跨域迁移预测专家整体印象,留一域迁移的嵌套 Spearman ρ 达 0.54,高于目标域内训练的 ≤0.48,配对差距 +0.15,训练集规模匹配后仍为 +0.12。

来源:arXiv cs.LG · arxiv.org