跳到正文
arXiv cs.CL· Riju Marwah, Ritvik Garimella, Khusham Bansal, Atishay Jain, Amit Sheth·· 1 天前AI 评分26

多语言提示词污染下的输出语言混淆:MDI 评测协议揭示幻觉率指标混淆

Output Language Confusion under Multilingual Prompt Contamination

AI 导读

研究者提出 Multilingual Distractor Interference(MDI)评测协议,在 TruthfulQA 和 TriviaQA 上对五个指令微调 LLM 进行 40,000 次评测。

来源:arXiv cs.CL · arxiv.org