跳到正文
10月7日周三
  1. arXiv cs.AI26

    BoNG:面向测试时扩散模型对齐的 Best-of-N 引导方法

    研究者提出 Best-of-N Guidance(BoNG),将 BoN 采样直接融入反向扩散过程,通过去噪粒子间的非对称引导交互,把粒子群导向更高奖励区域。在 36 项对比中 BoNG 有 29 项表现最佳,对 SMC 和 Vanilla BoN 的胜率达 80.56%。该方法支持多输出,ImageReward 分数为最新基于采样的引导方法的 1.3 倍,速度提升 1.6 倍,代码已开源。

  2. arXiv cs.AI33

    WAMJET:面向 World Action Model 的智能体加速框架

    WAMJET 是一个智能体加速框架,通过为编码智能体配备可复用的优化指导与测量验证工具,加速 World Action Model(WAM)推理。它采用瓶颈驱动流程,让智能体分析推理、修改代码、验证效果并迭代优化加速栈,在六种 WAM、三种编码智能体和两种 GPU 架构上实现最高 9.95x 无损加速,近似与硬件感知优化还能进一步降低延迟且成功率相当。

  3. arXiv cs.AI23

    选择性状态空间模型的分布式学习:架构感知收敛分析

    研究针对 Mamba2 等选择性 SSM 在分布式学习中缺乏架构感知理论的问题,推导了单层与多层选择性 SSM 的梯度与平滑性边界,以及 FedAvg 和 FedProx 的收敛边界,刻画循环稳定性、输入相关离散化和状态投影范数对联邦优化的影响。作者在教师 SSM 生成的序列上数值验证了单层边界,并在六个文本域上对比九种联邦学习算法用于 Mamba2 语言建模。

  4. arXiv cs.AI22

    面向世界动作模型的完成感知引导(CAG)

    研究者提出 Completion Aware Guidance(CAG),一种免训练采样方法,用于解决 World Action Models(WAMs)在短片段控制下出现的任务不完整想象问题。在代表性 WAMs 上,CAG 将 RoboTwin 2.0 子集成功率从 64% 提升至 70%,零样本仿真中从 69% 提升至 75%,并将任务不完整想象从 79% 降至 40%。

  5. arXiv cs.AI36

    无需更多训练:SURGE 用 RL 历史检查点融合提升推理能力

    论文提出 policy-space scaling,通过融合同一次 RL 训练中的两个检查点,在不延长训练、不增加单次推理计算的前提下获得更强策略。方法 SURGE 将高精度 anchor 与生成更短回复的 donor 表示为相对共享初始化的更新,再对 anchor 更新做谱分解,保留其主导成分并融入 donor 的互补成分。

  6. arXiv cs.AI27

    局部稀疏性实现无监督 LLM 安全检测

    研究者提出基于局部掩码 SAE 的无监督异常检测框架,利用线性表示假设下邻近点共享小共同活跃支撑的特性,在多种架构和数据集上验证了 LLM 安全检测的可行性。当允许使用 1% 的分布外数据校准时,该方法达到接近最优的性能,且仅需 1-2% 的 SAE 神经元参与计算。该工作发表于 NeurIPS2026。

  7. arXiv cs.AI27

    SpliTEE:用 GPU 辅助 TEE 结合差分隐私实现快速私密 LLM 推理

    SpliTEE 将 LLM 推理拆分到 Intel TDX TEE 与不受信任的 GPU 之间,并用差分隐私保护中间表示,避免加密带来的量化问题。作者对 LLM 推理关键函数做了全局敏感度分析,并推导出掩码与噪声抵消的浮点误差上界。基于 Llama-3.2-3B 和 Qwen3-4B 的实现比全 TDX 推理快近 2 倍,比 Slalom 最多快 43% 且准确率更高。

  8. arXiv cs.AI24

    Latent Diagnostic Taxonomy:面向提示词注入检测的分类器构建与决策诊断框架

    论文提出 Latent Diagnostic Taxonomy 框架,用于构建作为防护层的分类器并诊断其哪些高置信决策可信。该框架通过交叉验证选择嵌入维度,定位约占训练样本 29% 的潜在支持向量,并据此构建诊断分类体系。在公开提示词注入数据集上,约 77% 的高置信决策在移除单个 token 后不再稳健,且脆弱性分为置信度校准失败与可被利用的捷径两类。

  9. arXiv cs.AI27

    PertMind:用细胞扰动数据强化学习激发 LLM 涌现生物推理能力

    PertMind 将细胞扰动图谱转化为强化学习环境,以实测基因响应作为可计算奖励,结合可信轨迹监督初始化与基因、通路、格式三级强化信号。该模型仅在正向扰动响应预测上训练,却在未见细胞环境中提升响应推断,并零样本迁移至反向扰动识别、双扰动推理、表型筛选优先级排序和生物过程解读。

  10. arXiv cs.AI32

    AI 天气模型真的会漏报极端天气吗?研究对比 12 个模型后发现并非如此

    一项研究用十个月欧洲地面观测数据,将 12 个物理与 AI 预报模型对照 ECMWF IFS 评估,覆盖 10 m 风速、2 m 气温、太阳辐射和降水。结果显示 AI 模型在极端条件下并无统一的尾部劣势:部分 AI 模型比 IFS 更准,另一些则明显退化,物理模型间也存在类似差异。所有模型都表现出高值低估、低值高估的共同条件误差模式,尾部表现取决于模型、变量和评估设置,而非是否由 AI 生成。

  11. arXiv cs.AI22

    财务披露文本中的细粒度不一致分类诊断研究

    研究基于合成基准 SBID-FD,将已知含冲突的段落分为 11 类不一致类型,并对比冻结编码器、微调编码器、证据增强分类器、提示式大语言模型与 LoRA 适配生成模型。结果显示任务特定适配显著优于冻结表示,微调后的 300M 编码器可与更大规模的提示与适配模型竞争。自动提取的证据能提供额外信号,但仅能恢复参考跨度带来的部分收益。

  12. arXiv cs.AI22

    多尺度结构特征助力持续、可理解的视觉识别:一种发展式学习框架

    研究者提出一种多尺度视觉特征表示,将边缘与轮廓特征及其空间关系编码后,集成进无梯度的发展式学习框架,在类增量 MNIST 上大幅提升识别准确率。该方法无需回放缓冲区或预设任务边界,存储量相当时可匹配或超越基于回放与正则化的基线,且不遗忘旧类别。学到的表示保持人类可解释性,基线方法则在训练周期内丢失大部分刚学类别后再重新学习。

  13. arXiv cs.AI22

    Prime Fourier Embeddings:面向模运算的原理性基

    研究者提出 Prime Fourier Embeddings(PFE),将整数编码为素数索引的 (cos, sin) 对,使模运算只需选择相关素数通道。基于 Schur 引理,作者证明任何对乘积群作用等变的线性映射必为块对角结构,每个素数对应一个独立块;中国剩余定理可预测无平方因子合数模的任务相关通道。

  14. arXiv cs.AI22

    SAE++:级联稀疏自编码器学习多模态 LLM 的多层级视觉概念

    SAE++ 是一种级联稀疏自编码器架构,通过在初级 SAE 的解码器权重上训练二级 SAE,学习多模态 LLM 中的层级视觉概念,避免嵌套式共享前缀耦合与朴素堆叠的瓶颈。在 Qwen3-VL、Gemma-3 和 LLaVA 上的多组视觉数据集实验中,SAE++ 在层级概念一致性上优于当前最优 SAE 基线,并支持对 MLLM 输出进行组级概念干预。代码已开源。

  15. arXiv cs.AI22

    面向潜在建模的敏感性塑造:提升生成动力学模型的 OOD 检测与安全规划

    研究者提出 support-conditioned control-sensitivity regularization,通过促进训练充分区域的局部响应性来保留控制引发的状态变化,解决学习动力学对控制不敏感、掩盖 OOD 信号的问题。该方法在视觉避障、操作和真实机器人导航实验中提升了 OOD 检测能力与闭环规划安全性,论文已被 CoRL 2026 接收。

  16. arXiv cs.AI24

    Characterize Then Distill:大输出空间中的机制化推理

    研究揭示推理训练语言模型在数千至数十万候选标签中做多标签选择时,依赖一组小型、全局、分阶段的注意力头,在 MIMIC-IV 临床编码任务(5,651 个诊断码全部入上下文)中经消融与 knock-in 验证为必要且充分。作者提出 MISTILL,在决策事件处额外监督学生模型的池化注意力,跨家族学生对比决策的因果恢复近乎翻倍。

  17. arXiv cs.AI24

    FFR:面向回归任务的前向-前向学习框架

    FFR 是首个将 Forward-Forward(FF)学习扩展到真实回归任务的框架,在六个真实回归基准上平均恢复 BP 精度的 98.5%,同时将深度 8 时的峰值训练内存降至 BP 的 27%、深度 32 时降至 8%,单次迭代时间约为 BP 的 72%。它引入序数竞争 goodness 函数、分层阶梯架构与带不确定性估计的层次化预测三项创新,显著优于所有无 BP 的竞争方法。

  18. arXiv cs.AI30

    任务多样性带来系统性迁移却抑制持续强化学习:Banyan 域研究

    研究团队提出 GPU 加速的持续强化学习域 Banyan,可参数化控制地图布局、交互对象和子目标依赖层级三个独立任务轴。实验发现,沿各轴增加多样性会带来系统性迁移,但多样性过高会抑制学习器持续适应新任务分布的能力:在新任务上成功率趋于平台,却在旧任务上持续提升。该现象在多种持续学习算法、记忆架构、模型规模以及物理控制域 Kinetix 中均成立。

  19. arXiv cs.AI22

    强化学习中的终端表示(Terminal Representation)

    研究提出终端表示(TR),一种结构上区别于后继表示(SR)和默认表示(DR)的新型强化学习表示方法。TR 与 DR 一样编码奖励加权轨迹,但可作为更低维对象学习,且无需特征分解即可直接用于选项发现、奖励塑形、迁移学习和探索等任务,同时绕开对称转移动态假设。

  20. arXiv cs.AI32

    SPATIALUNCERTAIN:VLM 能否判断何时不该回答空间问题?

    研究者提出 SPATIALUNCERTAIN 评测框架,用遮挡造成的证据缺失和透视造成的误导证据两类场景,考察视觉语言模型能否判断当前视角是否可靠。在八个开源与闭源 VLM 上,模型行为并不跟随视觉证据的可靠性:证据消失时不会更谨慎,透视冲突时判断更依赖投影外观而非未变的物理 3D 关系。