跳到正文
热点事件持续更新

arXiv研究:方差感知UCB的分配稳定性与Wald推断

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

arXiv 发布一项针对双臂固定时域方差感知 UCB 策略的研究,给出由奖励差与方差决定的判别准则:最优臂的拉取次数能否用相对误差趋零的确定性近似,而次优臂的拉取次数始终稳定。 研究进一步指出,当各臂拉取次数与奖励方差之积依概率发散时,臂均值线性组合的普通 Wald 统计量对每个固定非零系数向量都有标准正态极限;但该高斯近似对确定性非零系数向量一致成立,当且仅当最优臂次数稳定。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv stat.ML
    方差感知 UCB 下的分配稳定性与 Wald 推断

    针对双臂固定时域方差感知 UCB 策略,研究给出由奖励差与方差决定的判别准则:最优臂拉取次数能否用相对误差趋零的确定性近似,而次优臂次数始终稳定。当各臂拉取次数与奖励方差之积依概率发散时,臂均值线性组合的普通 Wald 统计量对每个固定非零系数向量都有标准正态极限,但该高斯近似对确定性非零系数向量一致成立当且仅当最优臂次数稳定。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。