跳到正文
10月7日周三
  1. arXiv stat.ML22

    时空预测基准数据集与模型的批判性审计

    一项审计发现,GNN 在常用时空预测基准上的表现并不一致,重新评估时间线性基线后,GNN 在多个基准上的增益大幅缩水,在部分基准上甚至被线性基线超越。为 GNN 提供自回归残差可提升其表现,尤其在非交通类基准上;合成实验显示 GNN 对时间动态与空间图交互的异质性较为敏感。

  2. arXiv stat.ML22

    超越半圆律:具有指定平衡态的自由扩散模型

    针对协方差矩阵、核矩阵、MIMO 信道矩阵等本质为谱而非坐标向量的数据,逐坐标加噪的扩散模型会收敛到错误极限,因为特征值相互排斥而非独立运动。研究者提出状态依赖的自由波动率,通过闭式 Hilbert 变换漂移,为任意足够正则的紧支撑目标分布显式构造以该分布为平稳谱分布的自由 Fokker-Planck 流,突破了常系数自由扩散只能收敛到半圆律的限制。

  3. arXiv stat.ML12

    通过稳健灵活的知识迁移增强电子健康记录中的谱嵌入

    研究提出一种基于谱的无监督表示学习框架,从电子健康记录中为罕见病队列的临床概念和患者学习低维嵌入,通过引入来自更广泛人群的知识矩阵缓解高维小样本问题。该方法放宽了潜在数据矩阵与知识矩阵间严格的一对一信号对齐假设,采用两步谱嵌入:先剔除知识矩阵中的无关成分,再以投影方法分别恢复共享与异质成分。仿真和真实多发性硬化症队列分析显示,在共享信号微弱且仅部分对齐的困难场景下,该方法优于对比方法。

  4. arXiv stat.ML22

    深度时间序列预测十年综述:从自相关建模视角统一骨干架构与损失函数

    一篇被 IEEE TPAMI 接收的综述从自相关建模视角系统梳理了深度时间序列预测,指出该领域两大核心挑战是设计骨干架构建模历史序列自相关、设计损失函数建模标签序列自相关。该综述提出同时覆盖骨干架构与损失函数的分类体系,弥补了此前综述对损失函数覆盖不足的空白,并从统一的自相关视角分析文献动机与洞见。

  5. arXiv stat.ML17

    基于核化 Stein 差异的计算高效拟合优度检验

    研究者提出基于核化 Stein 差异(SKSD)的半参数拟合优度检验,并设计了一种无需重新拟合模型或从中采样的影响调整 wild bootstrap,用于构造 level-α 检验。该检验在经典正态性检验到难解似然模型的模拟中,以低数个数量级的计算成本取得相当或更优的检验功效,并已用于评估肺腺癌反向蛋白阵列数据的蛋白信号网络模型。

  6. arXiv stat.ML18

    含隐藏混杂因子的线性 ODE 系统可辨识性分析

    该论文对含隐藏混杂因子的线性 ODE 系统进行可辨识性分析,填补了潜变量与系统交互时可辨识条件的研究空白。研究分两种情况:潜混杂因子无因果关系但按时间 t 的多项式等函数形式演化;潜变量因果关系由 DAG 描述。作者在单/多轨迹的连续与离散观测条件下给出详细分析,并用仿真验证理论结果。

  7. arXiv stat.ML22

    面向时空时间序列的预测驱动推断方法

    研究者提出一种面向时空场景的预测驱动推断方法,在仅有短期带标签时间序列、较长无标签时间序列和不完美预测器的条件下,为各空间位置的未来期望标签提供可靠点估计与置信区间。该方法针对 PPI 的 i.i.d. 假设在时间依赖下失效的问题,结合 HAC 程序处理时序相关性,实验显示其优于自然替代方案。该工作已被 NeurIPS 2026 TS-LIMITS Workshop 接收。

  8. arXiv stat.ML10

    从噪声几何图中谱恢复点云

    研究从含噪高维数据生成的随机几何图中恢复低维潜在几何结构的问题,分析了 Signal+Noise Graph Model 上谱嵌入算法的性能。在点数 n 与环境维度 d 均趋于无穷的高维情形下,证明在谱间隙条件下,图邻接矩阵的顶部特征向量和特征值可将点云近似恢复到正交变换以内。结果在嵌套球面和高维正弦曲线采样的点云上得到验证。

  9. arXiv stat.ML12

    竞争风险下共形校准何时需要删失权重?失效原因预测集研究

    针对竞争风险标签的拆分共形预测集,完整案例校准在名义 0.900 下仅覆盖 0.8723(22% 受试者在预测期内无事件)。在 48 组额外设计中,有 4 组完整案例覆盖率低于名义值至少四个标准误,而正确设定的删失模型权重可将覆盖率维持在名义水平附近。研究将 Yi et al. (2025) 的论证扩展到原因标签,建立了带删失模型误差显式惩罚的有限样本覆盖下界,删失模型设定错误同样会导致覆盖不足。

  10. arXiv stat.ML22

    Transformer 强化学习分层推理奖励:达到 Minimax 最优速率

    研究将推理任务的奖励建模为响应空间上的分层函数,由无穷多个局部组件构成,每个组件仅在前序组件解决后才生效。基于 Transformer 的 actor-critic 算法在采样、拟合 critic 与策略更新间交替,在查询预算和正则化强度上达到 minimax 最优速率,对固定提示词数量也最优。

  11. arXiv stat.ML13

    对称感知特征学习的多项式分离:多指标模型研究

    研究证明对称感知与对称无关特征学习间存在多项式样本复杂度分离。在秩增长的多指标模型中,权重共享架构与全群数据增强均以 Õ(d^{p-1}) 样本实现弱方向恢复,而对称无关学习需 Õ(rd^{p-1});纯二次 Hermite 链接下对应复杂度为 Õ(d) 与 Õ(rd)。全群数据增强与架构权重共享样本效率相当,均优于无对称训练。

  12. arXiv stat.ML22

    Spectra:基于扩散模型的仿真推断测试时先验自适应方法

    Spectra 是一种面向扩散模型仿真推断(SBI)的测试时自适应方法,通过精确的 score-transport 恒等式,在冻结的扩散模型上以闭式解获得适配后的 score,无需额外仿真或训练。在六个 SBI 基准上,Spectra 在先验大幅偏移下实现准确适配,且在线采样成本低,使预训练 SBI 模型能在测试时纳入更新的先验信息。

  13. arXiv stat.ML20

    通过有限阶松弛将路径梯度扩展到离散随机变量

    研究者提出一种通用框架,可为 Poisson 等常见离散随机变量构造有限阶精确路径梯度估计器,该估计器是所有对次数不超过某阶多项式无偏的解中范数最小的解。它保留硬前向采样、无需温度调参,几行代码即可实现,且在所有可行解中唯一并最小化权重方差。实验显示,其低阶方法在线性、非线性和分层潜变量模型上匹配或超越调优基线,并在每项运行时基准中快于竞品。

  14. arXiv stat.ML17

    对抗训练过的线性 Transformer 是高斯混合模型的最优鲁棒上下文学习器

    一项理论研究证明,在多个高斯混合分类任务上对抗预训练的足够深的线性 Transformer,可通过干净示例的上下文学习,在未见任务上渐近达到鲁棒贝叶斯误差,而标准训练的模型做不到。研究还分析了梯度流下的收敛性、精度与鲁棒性的权衡以及示例复杂度。

  15. arXiv stat.ML10

    体积采样岭回归的精确校准与锐利风险几何

    研究从固定设计的恰好 s 个不同行进行岭回归,响应固定而仅子集随机,证明当 s 超过目标有效维度时,存在唯一惩罚项使所选岭回归拟合在期望上匹配全数据岭回归拟合。针对平衡符号坐标副本,严格扇区不等式给出从维度到行数减一各预算下的锐利风险及全部最大化响应,并构造出同样本无偏的岭—Horvitz—Thompson 混合估计,具有更低锐利风险与精确均值份额改进边界。

  16. arXiv stat.ML15

    重尾数据下经验风险最小化的渐近分析:基于 entry-wise i.i.d. 对称 α-stable 数据

    针对 entry-wise i.i.d. 对称 α-stable 重尾数据下的线性回归经验风险最小化,研究引入函数型序参量刻画每个系数对应的随机有效问题,并用复本方法完整刻画了样本量与特征维度按固定比例发散的高维极限下的泛化误差。该分析还建立了重尾普适性定律、典型误差与预测可靠性之间的 scaling law,以及 Bayes 最优预测误差。

  17. arXiv stat.ML22

    数据同化与机器学习的交叉领域综述

    数据同化(DA)通过将模型预报与观测结合来最优估计系统状态,对大气等混沌系统至关重要,全球业务预报中心通常每 6 小时执行一次。这篇 13 页综述讨论了机器学习(ML)与 DA 交叉这一新兴且快速发展的领域,概述了其中的主要课题与方法。

  18. arXiv stat.ML12

    用聚合归一化流链实现复杂仿真模型的似然近似与推断

    研究提出用 n-聚合归一化流链做仿真推断中的似然近似,前向复杂仿真模型的多组复制观测数据依次通过多组双射变换,前 k 组变换的参数按最优性顺序估计,不受其余 n-k 组影响。该框架通过经验似然估计与带混合分布的序贯决策两条数学路径更新和聚合归一化流参数,并附带一个以正向仿真参数为条件的代理模型,支持样本生成及贝叶斯范式下的推断、假设检验与不确定性量化。

  19. arXiv stat.ML19

    基于 Blackwell 序的多变量高斯冗余与协同信息分解

    研究者提出一种基于 Blackwell 序的多变量高斯系统部分信息分解(PID)方法,证明高斯信道在提取冗余信息和并集信息时均为最优,并给出直观的几何解释与高效数值算法。其并集信息与协同信息同 BROJA 度量一致,并推导出双信源下的闭式解;该方法可扩展到上千维或上千信源的系统,并在一个最优控制问题中识别出传感器与记忆之间的冗余和协同交互。

  20. arXiv stat.ML12

    HSS:跨相关任务的 Empirical-Bayes 谱部分池化方法

    研究者提出 Hierarchical Spectral Shrinkage(HSS),一个可扩展的 empirical-Bayes 框架,用于对任务特定的谱估计量进行部分池化。该方法将各任务的主导谱方向向数据自适应学习到的公共基正则化,并允许收缩程度随任务和谱分量变化。在合成实验和多研究基因表达数据上,HSS 在估计精度和样本外表现上均优于独立估计、完全池化和共享子空间方法。

  21. arXiv stat.ML22

    基于条件流匹配的马尔可夫过程间传输方法

    研究者提出一种基于流匹配的算法,在保持马尔可夫结构的前提下学习从源分布到目标轨迹分布的传输映射,并证明了其在总体极限下的一致性,在混合时间假设下给出了有限样本误差界。在 THINGS-EEG2 的 EEG 图像检索任务上,该方法为 ENIGMA 解码器在受试者特定时间映射前加入条件流,将平均 top-5 检索准确率从 43.87% 提升至 49.05%,相对提升 11.82%。

  22. arXiv stat.ML24

    语言模型中的柏拉图表示理论:多语言模型跨语言相似性为何在中层达到峰值

    一项理论研究为多语言语言模型中层跨语言表示相似性现象提供了理论解释。研究者用共享上层但下层产生式规则不同的概率上下文无关文法生成合成语言,证明贝叶斯最优下一 token 预测器即信念传播(BP),将其消息编码进连续层所得解析预测与在同数据上训练的 Transformer 高度吻合。

  23. arXiv stat.ML13

    ALCATRAs:面向部署不对称的多任务主动学习框架

    研究者提出 ALCATRAs 框架,在标注阶段按预算选择性采集辅助信息、部署阶段则无法获取这类信息,以解决由此产生的"设计性缺失"问题。该框架由任务选择策略与代理学习程序两部分组成,理论上可改善预测误差界。仿真实验与 UCI 心脏病队列应用显示,其样本效率优于基线方法。

  24. arXiv stat.ML26

    自我监控的测试时自适应为何失效:多步时间序列预测中的可交换性假设崩塌

    多步时间序列预测中,当监控与自适应共用同一预测误差反馈时,重叠目标与误差依赖会破坏监控统计保证所依赖的关键假设,导致无有害变化时也触发警报并进一步损害预测质量。研究还发现自适应会把持续性变化从自身监控中隐藏,而原始冻结模型反而保留更清晰的信号。

  25. arXiv stat.ML12

    平均场 Langevin 动力学中统计特征学习的几何理论

    研究提出监督回归中统计特征学习的几何框架,通过底-纤维分解定义特征学习,并证明球形平均场 Langevin 动力学具备该性质。在高斯多指标模型中,低温平稳分布集中于隐藏指标附近形成多尖峰结构,在温度 λ≍1 处发生急剧转变,并实现高概率参数恢复。高斯单指标模型的平稳测度则依奇偶性分别落在 S₂^{d-1} 或 ℝP^{d-1} 上,学习到的特征空间对齐回归信号,收敛速率为 d/N 与 Md/N。