跳到正文
arXiv cs.LG· Jiachen Zhao, Antonia Januszewicz, Taeho Jung·· 10 小时前AI 评分24

提示词级差分隐私下的奖励驱动学习:RLVR 训练首个差分隐私保证

Reward-Driven Learning under Prompt-Level Differential Privacy

AI 导读

研究首次为 RLVR 训练给出差分隐私保证:以单个提示词的全部回复为隐私记录,聚合梯度后只裁剪一次并加高斯噪声,隐私预算与每个提示词的回复数量和裁剪范数无关。

来源:arXiv cs.LG · arxiv.org