研究者发布法律幻觉检测基准PARCEL
热点事件持续更新
研究者发布法律幻觉检测基准PARCEL
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
研究者 M. Mikail Demir 和 M. Abdullah Canbaz 发布法律声明支撑性检测基准 PARCEL,用于判断法律声明是否被所引权威来源支持。数据集取自纽约州上诉法院近期判决,含 3,396 条括注式声明,标注为 Supported、Refuted 或 Not Found。 在零样本设置下评测多个 SOTA 大模型,最强模型准确率达 0.97,但仍会把无支撑声明误判为有支撑,即使提供完整判决书文本。缺失支撑比直接矛盾更难识别,伪造但看似合理的引注导致性能下降最大。
AI 根据报道生成 · 58 分钟前更新
最新进展10月9日 12:00
PARCEL:面向法律幻觉检测的声明级基准报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv cs.CLPARCEL:面向法律幻觉检测的声明级基准
研究者推出 PARCEL 基准,用于检测法律声明是否被所引权威来源支持,数据集基于纽约州上诉法院近期判决,包含 3,396 条括注式声明,标注为 Supported、Refuted 或 Not Found。在零样本设置下评测多个 SOTA LLM,最强模型准确率达 0.97,但仍会把无支撑声明误判为有支撑,即使提供完整判决书文本。缺失支撑比直接矛盾更难识别,伪造但看似合理的引注导致性能下降最大。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。