跳到正文
arXiv cs.CL· Marjan Celikik, Ana Peleteiro Ramallo, Javier Morales·· 3 小时前AI 评分34

微调 Qwen3.5 小模型部署语法标注:0.8B 模型精度超 GPT-5.4 与 GPT-5.6 Sol

Grammar Concept Annotation at Scale: Deployed Fine-Tuned Small Language Models Outperform Prompted Frontier Models

AI 导读

研究团队微调 Qwen3.5 小语言模型用于语法概念标注,并将 0.8B 模型部署到英语学习平台的语法掌握追踪器中。在两个人工标注基准上,该 0.8B 模型和 4B 对照模型在概念、证据片段、正确性三层嵌套匹配标准下的精确率与召回率均超过提示式 GPT-5.4 和 GPT-5.6 Sol,服务成本降低约 16 倍。

来源:arXiv cs.CL · arxiv.org