跳到正文
10月5日周一
  1. arXiv cs.CV22

    SpectralCache:通过谱特征缓存加速基于扩散的世界模型

    SpectralCache 是一种免训练谱缓存框架,利用扩散世界模型特征在相邻去噪步间奇异子空间高度稳定的特性,复用稳定子空间并通过线性外推估计低维奇异值,从而跳过部分主干网络计算。在 HunyuanWorld-Voyager-13B 上,它实现 5.22 倍加速,静态场景 WorldScore 保持 65.90,推理效率显著优于现有免训练缓存方法。

  2. arXiv cs.CL22

    WakeKV:面向会改变读取行为的注意力头的响应式可逆 KV 驻留策略

    WakeKV 是一种响应式 KV 驻留策略,将"冷却"的注意力头状态移入可恢复的 CPU 存储池,而非冻结或永久驱逐。研究在 1.5B-8B 三个模型、三种场景下测得多数注意力头在生成过程中至少改变一次读取行为,WakeKV 在匹配内存或预算下持续优于冻结分类与破坏性驱逐,并在 Mistral-7B 的 FlexiCache/vLLM 实现上验证了吞吐提升且保持 LongBench 质量。

  3. arXiv cs.CV24

    TRAC:面向高效自回归视频生成的轨迹感知复用与自适应校正框架

    TRAC 是一个无需训练的自回归视频生成加速框架,通过鲁棒累积调度(RCS)、自回归轨迹感知引导调度(ATGS)和频谱结构校正(SSC)三个组件,解决分块去噪轨迹中近似误差累积传播的问题。在 SkyReels-V2 和 FramePack-F1 上的实验显示,TRAC 相比现有方法同时实现了最高的推理效率和最佳生成质量。

10月4日周日
  1. Simon Willison38

    Simon Willison:按量付费服务需要默认硬性预算上限,AWS 已推出支出限额

    Simon Willison 呼吁按量付费的 API 和服务默认设置硬性预算上限,即达到每月 $X 后直接切断并返回错误,而非仅发警告邮件。他指出 AWS 已在 9 月 16 日推出月度支出限额功能,项目用量触顶后当月暂停,目前仅向有限客户开放;Google Cloud 则在 7 月推出 Spend Caps。

10月2日周五
  1. MIT Technology Review · AI15

    用自主 AI 重新定义企业智能

    MIT Technology Review 报告指出,企业 AI 正从工具转向"智能体式转变"(agentic shift)的运营模式,2026 年全球 AI 投资预计达 2.5 万亿美元,同比增长 44%。报告认为企业 AI 的规模化问题是结构性的,领先企业把流程重设计放在模型选型之前,并以数据就绪而非数据规模取胜。报告建议重建数据基础设施、用可组合架构替代固定技术栈,并解决 AI 主权问题。

  2. NVIDIA Blog62

    NVIDIA 推出 DGX Spark 64GB 本地 AI 配置,起售价 4,999 美元

    NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 DGX Spark 64GB 配置,保留 GB10 Grace Blackwell 超级芯片、DGX OS 和完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备本地运行。

    推荐理由:原文给出 64GB 新配置的价格、可跑模型规模与双机集群方式,便于判断本地跑智能体的门槛。

10月1日周四
9月30日周三
  1. 开源中国40

    MateClaw 2.3.0 发布:用不可变 JSON 验收长任务,Agent 不再"自报完成"

    MateClaw 2.3.0 于 2026 年 9 月 20 日发布,为 Persistent Goal 引入用户配置的托管 JSON 验收:Agent 发布不可变产物版本,服务端将检查结果绑定到当前要求与具体 generation,全部绑定有效后才允许完成目标。该版本还新增观察模式执行证据、Team Worker 受控干预以及 Skill 文档和文件夹上传。

  2. 开源中国68

    DeepSeek 开源面向华为昇腾的基础组件

    DeepSeek 于 9 月 30 日正式开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、计算库和分布式通信库,与此前面向英伟达平台的开源组件一一对应。其中 TileLang 昇腾版本被描述为最重的一块,DeepSeek 称要建立新一代自主可控的 GPU 软件生态,需先有通用且编程简单的工具。

9月29日周二
  1. MIT Technology Review · AI12

    让 AI 成为资产而非开支:HPE 谈 AI 从按 token 消费转向自有算力

    HPE 提出,当 AI 从试验走向生产、形成客服与 IT 等智能体驱动的常态化负载后,企业需重新权衡按 token 消费与自建算力的经济性。Deloitte 2026 企业 AI 状态报告显示,2025 年员工 AI 使用率上升 5%,至少 40% 的 AI 项目进入生产的公司比例预计六个月内翻倍。HPE 建议企业按实际负载测算自有算力的盈亏平衡点,并通过采用、治理与用例扩展保持产能利用率。

9月25日周五
9月24日周四
  1. GitHub Blog · AI & ML22

    GitHub Copilot 应用如何渲染超大 pull request

    GitHub Copilot 应用重建了 pull request 视图,用一个含 2,200 个文件、超 100 万行改动和 400 多条行内评论的开源 PR 做验证。它把文档高度拆成确定性的代码几何与动态评论块两套体系,代码行高提前算好,评论高度按需测量并锚定到文件、行和侧,避免滚动跳变。

  2. Microsoft Research62

    微软研究:将物理 AI 推理卸载到边缘或云端可提升机器人性能与续航

    微软研究院对移动操作机器人工作负载做了系统性测量,发现把物理 AI 推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务成功率、支持更大模型并延长续航。

    推荐理由:微软团队系统测量了机器人端侧与卸载推理的差异,并给出可复用的 Kubernetes 卸载工具链。

  3. Google DeepMind62

    Google DeepMind 为 Private AI Compute 引入服务端持久记忆

    Google DeepMind 公布 Private AI Compute 平台的新技术能力,将私密的服务端持久记忆引入该平台,使 AI 助手能在多设备间保留上下文,同时维持接近端侧处理的隐私标准。

    推荐理由:Google 公开了云端持久记忆的隐私架构,读者可了解跨设备 AI 记忆如何在加密与安全隔区下实现。

9月17日周四
  1. GitHub Blog · AI & ML82

    GitHub 用 Copilot 把 Copilot 运行时迁移到 Rust

    GitHub 用 GitHub Copilot app 和 Copilot CLI 把 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,AI 智能体写了其中大部分代码,跨 128 个 pull request 增量合入 main,而非一次性切换。

    推荐理由:作者以亲历者身份给出把 80 万行运行时从 TypeScript 迁到 Rust 的完整工程细节,可迁移到大规模 Agent 协作开发。

9月4日周五
  1. 阮一峰的网络日志34

    科技爱好者周刊(第 411 期):OpenClaw 2.0 是一个缩影

    OpenClaw 发布 2.0 版,共有 933 位贡献者、合并 16000 个 PR,而全职团队仅 9 人、兼职 26 人,作者据此判断这些 PR 未经代码审查、由 AI 合并。该版本源于 8 月改动,发布节奏已从每日一版改为每月一版。作者仍建议不要在办公电脑上运行 OpenClaw,而应放在独立物理机、虚拟机或云端。

9月3日周四
7月29日周三
  1. Berkeley AI Research60

    从 CUDA 到 MLX:K-Search 如何把数十年内核经验带到 Apple Silicon

    Berkeley AI Research 与 IBM Research 将 K-Search 进化式内核搜索框架扩展到 MLX,通过结构化的 CUDA-to-MLX 翻译层把已有 CUDA 内核经验迁移到 Apple Silicon。

    推荐理由:读者可以看到 CUDA 优化经验如何被结构化迁移到 Apple Silicon,以及翻译层对最终性能差距的具体影响。