跳到正文
热点事件持续更新

提出掩码微调MFT方法

1 篇报道1 个报道来源9 小时前更新

先了解这件事

报道摘要

研究者提出 Mask Fine-Tuning(MFT),一种在不更新模型权重的前提下,对已充分微调的 LLM 学习并施加二值掩码的微调范式,用标准微调目标做监督。在 LLaMA2-7B 与 LLaMA3.1-8B 上,MFT 使用相同微调数据集在 IFEval 上平均提升 2.70/4.15。该方法可与现有 LLM 优化流程兼容,并将掩码操作从网络剪枝压缩拓展到更广泛的模型能力提升。

摘自 arXiv cs.AI

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv cs.AI
    Mask Fine-Tuning:不更新权重,用二值掩码微调提升 LLM 性能

    研究者提出 Mask Fine-Tuning(MFT),一种在不更新模型权重的前提下,对已充分微调的 LLM 学习并施加二值掩码的微调范式,用标准微调目标做监督。在 LLaMA2-7B 与 LLaMA3.1-8B 上,MFT 使用相同微调数据集在 IFEval 上平均提升 2.70/4.15。该方法可与现有 LLM 优化流程兼容,并将掩码操作从网络剪枝压缩拓展到更广泛的模型能力提升。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。