跳到正文
arXiv cs.CL· Akesh Gunathilake, Nadil Karunarathna, Tharusha Bandaranayake, Nisansa de Silva, Surangika Ranathunga, Nevidu Jayatilleke·· 3 小时前AI 评分22

LMSpell:用预训练语言模型做拼写纠错的首个跨语言实证研究

LMSpell: Spell Correction with Pre-Trained Language Models

AI 导读

研究首次系统比较三类预训练语言模型在多种语言(含低资源语言)上的拼写纠错效果,发现仅 270M 参数的 Gemma 3 和 mBART50 在 5k 句数据上微调后即可超越基于规则的纠错器。研究还以僧伽罗语为案例,揭示低资源语言拼写纠错的困境。

来源:arXiv cs.CL · arxiv.org