研究:情感分析工具与LLM在推文上难达一致
热点事件持续更新
研究:情感分析工具与LLM在推文上难达一致
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
一项发表于 arXiv 的研究对比了三种情感分析工具(TextBlob、VADER、Twitter-roBERTa-base)、三个大语言模型(Qwen3-32B、GPT-OSS-120B、Llama-4-Maverick-17B)与六名人类标注者对 100 条推文的情感判断,结论是各方之间难以达成一致。 研究由 Himarsha R. Jayanetti 等作者完成,评估的是这些工具和模型与人类评分者之间的一致性水平。
AI 根据报道生成 · 2 小时前更新
最新进展10月8日 12:00
研究:人类、专用工具与 LLM 在社交媒体情感分析上难以达成一致报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- arXiv cs.CL研究:人类、专用工具与 LLM 在社交媒体情感分析上难以达成一致
一项针对 100 条推文的研究对比了 TextBlob、VADER、Twitter-roBERTa-base 三款专用工具与 Qwen3-32B、GPT-OSS-120B、Llama-4-Maverick-17B 三款 LLM 及六名人类标注者的情感判断一致性。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。