arXiv cs.LG· Shuo Yang, Changbai Li, Linlin Yang, Huobin Tan, Rongyu Chen, Tongfei Chen, Tian Wang, Sheng Xu, Baochang Zhang·· 5 小时前AI 评分22
DIPrune:面向高效多模态语言模型的双重要性任务感知 token 剪枝
DIPrune: Task-Aware Token Pruning with Dual Importance for Efficient Multimodal Language Models
AI 导读
DIPrune 是一种无需训练的多模态大语言模型 token 剪枝框架,通过基于排序的双重要性评分机制,联合优化层内静态特征显著性与层间动态语义演化。该方法将剪枝重构为最终任务损失失真最小化问题,并揭示了一个此前被忽视的跨层梯度项。在 LLaVA 和 Qwen-VL 上的实验表明,DIPrune 持续取得 SOTA 结果。
来源:arXiv cs.LG · arxiv.org