跳到正文
热点事件持续更新

研究者提出免训练两阶段低秩量化误差补偿方法

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

研究者提出一种免训练的两阶段闭式框架,用于改进极低比特量化大语言模型的低秩误差补偿:先做 Fisher 加权非对称对齐,再做秩约束自然梯度校正。 据该研究,在 QuIP# 2-bit 量化下,该方法将 Qwen3-8B 在 WikiText-2 上的困惑度从 12.43 降至 10.26,Qwen3-4B 从 21.11 降至 13.22。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv cs.LG
    Align, Then Correct:面向极低比特量化大语言模型的无训练两阶段低秩补偿

    研究者提出无训练两阶段闭式框架,通过 Fisher 加权非对称对齐与秩约束自然梯度校正,改进极低比特量化大语言模型的低秩误差补偿。在 QuIP# 2-bit 下,该方法将 Qwen3-8B 的 WikiText-2 困惑度从 12.43 降至 10.26,Qwen3-4B 从 21.11 降至 13.22。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。