跳到正文
热点事件持续更新

研究:临床医生真实查询与AI基准任务分布不符

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

一项研究分析了 6342 名医生、高级执业护士和护士在八个月内部署期间向机构助手发送的 127833 条查询,发现临床医生实际使用语言模型的方式与公开基准的评测任务存在偏差。 研究称,这些查询中文档与行政类占 36.2%、知识检索占 28.9%,诊断仅占 3.7%;超过三分之一的查询按原样无法得到良好回答。该研究由 Krithik Vishwanath 等作者发表,对象为临床 AI 基准与真实使用任务的匹配度。

AI 根据报道生成 · 54 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv cs.CL精选
    研究:临床医生使用语言模型的方式与模型评测方式存在偏差

    一项研究分析了 6342 名医生、高级执业护士和护士在八个月内部署期间向机构助手发送的 127833 条查询,发现文档与行政类占 36.2%、知识检索占 28.9%,诊断仅占 3.7%,超过三分之一的查询按原样无法得到良好回答。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。