arXiv cs.CL· Irina Proskurina, Guillaume Metzler, Julien Velcin·· 3 小时前AI 评分23
Fair-GPTQ:面向大语言模型的偏见感知量化方法
Fair-GPTQ: Bias-Aware Quantization for Large Language Models
AI 导读
Fair-GPTQ 是首个显式以降低大语言模型不公平性为目标的量化方法,通过在量化目标中加入群体公平性约束来引导舍入操作。该方法聚焦职业偏见及性别、种族、宗教相关的歧视性语言生成,在 zero-shot 基准上保留至少 90% 的基线准确率,相比半精度模型降低不公平性,同时保留 4-bit 量化的内存与速度优势。该论文已被 TACL 接收。
来源:arXiv cs.CL · arxiv.org