跳到正文
热点事件持续更新

研究:LLM临床笔记混入无关信息干扰推理

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

一项发表于 arXiv 的研究测试了大语言模型在临床笔记中处理无关信息的表现。在 576 段医患对话中,前沿模型把闲聊写进 35% 的病历,3.7% 的病例中模型误用或误归属这些题外话。 在 57 段模拟录音中,-10 dB 的另一场就诊背景语音泄漏进 48.2% 的转录文本,四个开源权重模型生成的病历有 5.3% 被检出污染。作者 Krithik Vishwanath 等据此提出临床推理与干扰的双重编码假说,并建议临床使用前评估模型对无关信息的抵抗力。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv cs.CL
    LLM 会把闲聊和背景语音写进病历,干扰临床推理

    研究测试了 LLM 对患者就诊无关信息的敏感性:在 576 段医患对话中,前沿模型把闲聊写进 35% 的病历,3.7% 的病例中模型误用或误归属这些题外话。在 57 段模拟录音中,-10 dB 的另一场就诊背景语音泄漏进 48.2% 的转录文本,四个开源权重模型生成的病历有 5.3% 被检出污染。作者提出临床推理与干扰的双重编码假说,建议临床使用前评估模型对无关信息的抵抗力。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。