arXiv cs.CL· Riju Marwah, Ritvik Garimella, Khusham Bansal, Atishay Jain, Amit Sheth·· 1 天前AI 评分26
多语言提示词污染下的输出语言混淆:MDI 评测协议揭示幻觉率指标混淆
Output Language Confusion under Multilingual Prompt Contamination
AI 导读
研究者提出 Multilingual Distractor Interference(MDI)评测协议,在 TruthfulQA 和 TriviaQA 上对五个指令微调 LLM 进行 40,000 次评测。
来源:arXiv cs.CL · arxiv.org