arXiv cs.LG· Nur A Zarin Nishat, Jens Lehmann, Andrei Aioanei, Sahar Vahdati·· 9 小时前AI 评分22
小语言模型在抽象推理任务上的系统性研究
A Systematic Study of Small Language Models on Abstract Reasoning Tasks
AI 导读
一项研究在 ARC-TGI 基准上对 decoder-only、encoder-decoder 和 MoE 三类小语言模型进行了超 1000 次监督微调实验,发现模型虽能达到较高的分布内准确率,但技能习得对优化敏感且在各任务族间分布不均。
来源:arXiv cs.LG · arxiv.org