提出同能力风险暴露检索基准SameCapRisk-Bench
热点事件持续更新
提出同能力风险暴露检索基准SameCapRisk-Bench
2 篇报道1 个报道来源2 小时前更新
先了解这件事
报道摘要
SkillContrast 是一种免训练的选择器,通过比较检索到的 Agent 技能并保留其差异文本及局部上下文,供预训练重排序器使用。在 SameCapRisk-Bench 的 1,235 条请求上,相同输入长度下比 TF-IDF 查询选择多出 54-72 个 clean hits,覆盖 2 种检索器和 2 种重排序器规模。
摘自 arXiv cs.AI
最新进展10月9日 12:00
SkillContrast:用差异引导文本选择为 Agent 技能重排序事件进展
2 个进展
- 10月9日 12:00 · 1 篇报道提出同能力风险暴露检索基准SameCapRisk-BencharXiv cs.AI:SameCapRisk-Bench:Agent 技能检索中的同能力风险暴露评测
- 10月9日 12:00 · 1 篇报道SkillContrast:差异引导的Agent技能重排文本选择arXiv cs.AI:SkillContrast:用差异引导文本选择为 Agent 技能重排序
报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv cs.AISkillContrast:用差异引导文本选择为 Agent 技能重排序
SkillContrast 是一种免训练的选择器,通过比较检索到的 Agent 技能并保留其差异文本及局部上下文,供预训练重排序器使用。在 SameCapRisk-Bench 的 1,235 条请求上,相同输入长度下比 TF-IDF 查询选择多出 54-72 个 clean hits,覆盖 2 种检索器和 2 种重排序器规模。
- arXiv cs.AISameCapRisk-Bench:Agent 技能检索中的同能力风险暴露评测
研究者提出 SameCapRisk-Bench,包含 890 个单元和 1,314 个查询案例,覆盖五种机制与十二种冲突类型,用于评测同能力风险暴露检索。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。