跳到正文
arXiv cs.LG· Nur A Zarin Nishat, Jens Lehmann, Andrei Aioanei, Sahar Vahdati·· 9 小时前AI 评分22

小语言模型在抽象推理任务上的系统性研究

A Systematic Study of Small Language Models on Abstract Reasoning Tasks

AI 导读

一项研究在 ARC-TGI 基准上对 decoder-only、encoder-decoder 和 MoE 三类小语言模型进行了超 1000 次监督微调实验,发现模型虽能达到较高的分布内准确率,但技能习得对优化敏感且在各任务族间分布不均。

来源:arXiv cs.LG · arxiv.org