跳到正文
今天10月7日周三547 条
  1. arXiv cs.LG12

    StaFIR:平稳性感知因果滤波器的凸学习

    StaFIR 是一种因果有限脉冲响应滤波器,通过可学习的非负指数滞后剖面混合,以凸优化目标在经验平稳性与输入相似度之间取得平衡。在 ARFIMA–GARCH 和滚动金融序列实验中,它能随序列持续性调整滤波强度,并在平稳状态下减少不必要的变换。下游预测中其精度与固定半阶差分无明显差异,但对原始信号的相似度更高。

  2. arXiv cs.LG14

    EEG BCI 解码的标签揭示在线更新基准测试

    研究提出一个面向 EEG 脑机接口解码的在线自适应基准,在时间有序的 prequential(先测后训)评估下比较 CSP 与黎曼协方差两类流水线。在四个数据集(三个运动想象、一个运动解码)上,标签揭示的在线更新在两个最大数据流中改善了 14 个模型/数据集组合中的 13 个,相对冻结模型准确率提升最高约 18%。

  3. arXiv cs.LG22

    LSA:可学习频谱激活函数改进隐式神经表示

    研究者提出可学习频谱激活函数(LSA),用残差截断傅里叶级数替代固定的神经元级非线性,谐波幅值在训练中学习。LSA 不扩展渐近函数类,而是改变表示的因子分解方式,使线性权重选择特征、激活系数控制频谱整形,两者由独立梯度更新。在音频、图像、神经辐射场和神经声场任务上,LSA 均提升了重建质量。

  4. arXiv cs.LG12

    用表格基础模型评估主动特征获取策略

    研究提出用 prior-data fitted networks(PFN)从有限离线数据中学习和评估主动特征获取策略。作者发现,在离线数据覆盖不均衡时,以总预测熵为奖励会引入认知偏差,惩罚对稀疏观测特征的获取,因为它把认知不确定性与偶然不确定性混为一谈。

  5. arXiv cs.LG32

    研究:pass@k 无法衡量后训练后的多样性与能力保留

    一项被 NeurIPS 2026 预训练到后训练 Workshop 接收的研究指出,pass@k 只依赖问题被答对的概率,无法反映答案分布。用 GRPO 和 RFT 训练 Qwen2.5-1.5B-Instruct 后,三项多样性指标走向相反,GRPO 正确解的词法多样性低 15%,但 pass@8 和 pass@32 在 GSM8K 上无一致赢家,仅在低 k 时出现分离。

  6. arXiv cs.LG17

    Fed-BRDECS:隐私保护且异构感知的联邦深度嵌入聚类

    Fed-BRDECS 是一个隐私保护且异构感知的联邦深度嵌入聚类框架,用本地可计算的样本稳定性损失替代全局归一化聚类目标,避免传输本地软分配分布。它引入预测均衡采样和质心级重启来应对非 IID 客户端分布,在图像与文本聚类基准的 IID 和非 IID 划分下均优于代表性联邦聚类与深度聚类基线。该框架还可用于联邦时间序列异常检测,在不增加推理成本的情况下提升基于重构的检测器。

  7. arXiv cs.LG20

    Lock-in EP:面向振荡硬件的原位训练算法

    研究者提出 lock-in equilibrium propagation(LIEP)训练方法,可为振荡网络中每个组件提供局部梯度信息,无需单独的前向与反向扫描,从而有望在模拟振荡硬件上实现原位学习。LIEP 既可用于从零训练,也能在预训练参数被扰动后恢复性能,并可表述为三因子更新规则。该方法目前仅在浅层网络上验证,作者认为其他架构或可将其扩展至深层大规模网络。

  8. arXiv cs.LG18

    BiToK-SD:面向大语言模型自蒸馏的双层 Top-K token 选择方法

    研究者提出 BiToK-SD,一种基于双层优化的 token 选择方法,用于在 on-policy 自蒸馏中自适应学习哪些 token 位置最值得蒸馏。该方法将 Top-K token 选择建模为可微的阈值松弛作为下层问题,上层问题则对选中位置执行知识蒸馏,使选择随学生策略演化而调整。在数学推理基准上,BiToK-SD 在全部对比方法中取得最佳平均性能,且仅需轻量额外计算。

  9. arXiv cs.LG22

    时间序列基础模型在协变量不确定性下的负荷预测基准测试

    研究对 4 个从零训练的模型和 4 个时间序列基础模型(TSFM)在 3 个真实负荷预测数据集上进行了基准测试,考察未来协变量信息可用性与质量不同的运行场景。结果显示 Chronos-2 在协变量可用或预测准确时,零样本和微调设置下均持续达到 SOTA,但随着协变量预测噪声增大性能下降,而 TimesNet 在严重协变量不确定性下表现更稳健。

  10. arXiv cs.LG31

    ResearchTrails:从人类研究决策轨迹中学习科学探索

    研究者构建了 ResearchTrails 数据集,从 Git 仓库的 commit 历史中提取结构化的人类研究轨迹,作为科学探索过程的代理,捕捉方法、实验与消融的连续变化。该数据集包含论文最终结果之外的中间研究决策信号,可用于在测试时检索人类研究经验作为外部技能,以及训练模型以提升对新研究决策的泛化能力。

  11. arXiv cs.LG15

    MetaHeta:在测定异质性下用元学习做小样本生物活性预测

    针对测定异质性会削弱元学习效果的问题,研究者提出 MetaHeta 框架,通过以相关测定的辅助数据为条件进行预测,并用线性注意力处理大规模辅助数据、精确注意力处理稀缺任务上下文。在 ChEMBL 和 BindingDB 的测定数据上,该方法提升了小样本生物活性预测及回顾性贝叶斯优化中的化合物优先级排序表现。

  12. arXiv cs.LG22

    重放必须保留什么?区分可校正偏差与类别对应关系

    研究提出一种诊断框架,将缓存预测视为时间异质监督,区分样本存储时已知的类别与之后学到的类别,并在任务级偏移前后评估模型。在 CIFAR-100 上使用 DER++,固定常数可在 1 个百分点等价范围内替代后学类别的未刷新存储分数,偏移将删除其匹配的代价从 14.9 降至 1.8 个百分点;而重分配存储时已知类别的非金标分数代价为 4.3 和 4.0 个百分点,图像蒸馏中同样存在。

  13. arXiv cs.LG20

    Sculpt:面向运动学可行城市风场预测的嵌套势框架

    研究者提出 Sculpt,一种嵌套势框架,将几何相关的耦合约束直接内置于参数化中,通过三维交错网格上体积矢量势的离散旋度生成无散度速度更新,并用共享标量势约束边界值以同时满足不可穿透性,无需逐步压力投影。该方法还引入覆盖多种城市形态与入流条件的 LES 数据集 UrbanWindFlow,用于同时评估精度与运动学可行性。

  14. arXiv cs.LG24

    冻结扩散模型的可识别世界模型:ConDA 对齐方法

    研究者提出 Contrastive Diffusion Alignment(ConDA),在冻结的预训练扩散模型潜变量之上仅学习一个轻量对齐映射,即可获得可识别的坐标表示。在 TCL/GCL 假设下,该方法能将潜在动力学状态识别到排列和逐分量可逆变换的程度,并保留潜在动态结构因果模型。在物理与机器人视频系统上,TCL 和 GCL 变体实现了近乎完美的分块状态恢复,并在模拟落体系统中实现精确恢复。

  15. arXiv cs.LG15

    Stock-JEPA:股票市场中的先验锚定潜在修正表征学习

    Stock-JEPA 提出一种联合嵌入预测框架,以低复杂度金融模型生成的多周期收益与风险统计作为先验锚点,再通过上下文条件修正预测器估计未来表征相对锚点的可预测位移。理论上最优修正可将先验锚点的期望平方误差降低 E[‖Δ‖₂²]。实验显示其在中国和美国股票市场上以 5 项关键指标超越 13 个强基线。

  16. arXiv cs.LG24

    福特汽车用无监督监测框架分析 End-of-Line 测试数据,F1 从 0.429 提升至 0.769

    福特汽车提出一种面向高维时序数据的多元监测框架,用于 End-of-Line 测试数据的无监督异常检测,采用两阶段流程:先清洗并对齐时间序列,再做非线性降维与基于控制图的 Phase I 监测。在福特真实生产数据上,该方法的准确率、召回率和 F1 分别从原有模型的 0.50、0.30、0.429 提升至 0.625、1.00、0.769。框架支持无监督与有监督两种设置,模块化结构便于适配不同领域。

  17. arXiv cs.LG17

    MemKD:面向紧凑循环神经网络的时间序列记忆保留知识蒸馏框架

    研究者提出知识蒸馏框架 MemKD,通过专门的损失函数捕捉教师与学生模型在时间序列子序列上的记忆保留差异,让紧凑循环神经网络更有效地模仿教师行为。实验显示 MemKD 显著优于现有 SOTA 知识蒸馏方法,并能在多种压缩比例下匹配教师模型性能,大幅减少参数量和内存占用而精度损失不显著。

  18. arXiv cs.LG18

    TEMPEST:基于角度间隔学习的时间嵌入实现可扩展驾驶员识别

    TEMPEST 是一种用 ArcFace 角度间隔损失训练的时间卷积网络嵌入模型,将 60 秒多模态驾驶窗口映射为 96 维嵌入,支持无需重训练的动态注册。在 45 名驾驶员的时序评测中,它取得 91.71% Rank-1 准确率,比最强 triplet-loss 基线高 58.4 个百分点;驾驶员池从 10 增至 45 时性能仅下降 4.3 个百分点。

  19. arXiv stat.ML10

    体积采样最小二乘中的接触几何与协方差亏缺

    论文刻画了固定设计下固定规模体积采样配合无权最小二乘何时达到其系数协方差上界:对无共线列的白化设计,接触空间在每个严格内点样本量下保持不变,其非零值构成有限正交族。研究给出全样本量的留一协方差亏缺比较、查询风险上下界及精确构造,并证明同一残差可精确达到整个查询当且仅当查询范围落在某一类空间内。

  20. arXiv stat.ML22

    时空预测基准数据集与模型的批判性审计

    一项审计发现,GNN 在常用时空预测基准上的表现并不一致,重新评估时间线性基线后,GNN 在多个基准上的增益大幅缩水,在部分基准上甚至被线性基线超越。为 GNN 提供自回归残差可提升其表现,尤其在非交通类基准上;合成实验显示 GNN 对时间动态与空间图交互的异质性较为敏感。

  21. arXiv stat.ML22

    超越半圆律:具有指定平衡态的自由扩散模型

    针对协方差矩阵、核矩阵、MIMO 信道矩阵等本质为谱而非坐标向量的数据,逐坐标加噪的扩散模型会收敛到错误极限,因为特征值相互排斥而非独立运动。研究者提出状态依赖的自由波动率,通过闭式 Hilbert 变换漂移,为任意足够正则的紧支撑目标分布显式构造以该分布为平稳谱分布的自由 Fokker-Planck 流,突破了常系数自由扩散只能收敛到半圆律的限制。