跳到正文
arXiv cs.CL· Himarsha R. Jayanetti, Sivakanesan Dhanushkanda, Shuai Hao, Michael L. Nelson, Michele C. Weigle·· 4 小时前AI 评分22

研究:人类、专用工具与 LLM 在社交媒体情感分析上难以达成一致

Nobody Truly Agrees on Sentiment: Humans, Bespoke Tools, and LLMs Struggle with Social Media Texts

AI 导读

一项针对 100 条推文的研究对比了 TextBlob、VADER、Twitter-roBERTa-base 三款专用工具与 Qwen3-32B、GPT-OSS-120B、Llama-4-Maverick-17B 三款 LLM 及六名人类标注者的情感判断一致性。

来源:arXiv cs.CL · arxiv.org