跳到正文
arXiv cs.LG· Xuanming Cui, Shlok Kumar Mishra, Wentao Bao, Aashu Singh, Zihao Wang, Xiangjun Fan, Jun Xiao, Ser-Nam Lim, Jianpeng Cheng·· 3 小时前AI 评分31

MoEMB:用高效混合专家模型扩展通用多模态嵌入

MoEMB: Scaling Universal Multimodal Embeddings with Efficient Mixture-of-Experts Models

AI 导读

MoEMB 通过混合专家(MoE)沿专家轴扩展通用多模态嵌入,在保持单向量、非自回归编码的同时提升编码器容量。仅用 3B 激活参数,MoEMB 在 MMEB-V2 和 MRMR 上超越激活参数超 4 倍的 TTE 类方法,且计算量显著更少。研究还首次系统考察了 MoE 嵌入的自适应计算,涵盖基于训练与仅推理的多种策略。

来源:arXiv cs.LG · arxiv.org