跳到正文
10月4日周日
  1. Simon Willison38

    Simon Willison:按量付费服务需要默认硬性预算上限,AWS 已推出支出限额

    Simon Willison 呼吁按量付费的 API 和服务默认设置硬性预算上限,即达到每月 $X 后直接切断并返回错误,而非仅发警告邮件。他指出 AWS 已在 9 月 16 日推出月度支出限额功能,项目用量触顶后当月暂停,目前仅向有限客户开放;Google Cloud 则在 7 月推出 Spend Caps。

10月2日周五
  1. MIT Technology Review · AI15

    用自主 AI 重新定义企业智能

    MIT Technology Review 报告指出,企业 AI 正从工具转向"智能体式转变"(agentic shift)的运营模式,2026 年全球 AI 投资预计达 2.5 万亿美元,同比增长 44%。报告认为企业 AI 的规模化问题是结构性的,领先企业把流程重设计放在模型选型之前,并以数据就绪而非数据规模取胜。报告建议重建数据基础设施、用可组合架构替代固定技术栈,并解决 AI 主权问题。

  2. NVIDIA Blog62

    NVIDIA 推出 DGX Spark 64GB 本地 AI 配置,起售价 4,999 美元

    NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 DGX Spark 64GB 配置,保留 GB10 Grace Blackwell 超级芯片、DGX OS 和完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备本地运行。

    推荐理由:原文给出 64GB 新配置的价格、可跑模型规模与双机集群方式,便于判断本地跑智能体的门槛。

10月1日周四
9月30日周三
  1. 开源中国40

    MateClaw 2.3.0 发布:用不可变 JSON 验收长任务,Agent 不再"自报完成"

    MateClaw 2.3.0 于 2026 年 9 月 20 日发布,为 Persistent Goal 引入用户配置的托管 JSON 验收:Agent 发布不可变产物版本,服务端将检查结果绑定到当前要求与具体 generation,全部绑定有效后才允许完成目标。该版本还新增观察模式执行证据、Team Worker 受控干预以及 Skill 文档和文件夹上传。

  2. 开源中国68

    DeepSeek 开源面向华为昇腾的基础组件

    DeepSeek 于 9 月 30 日正式开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、计算库和分布式通信库,与此前面向英伟达平台的开源组件一一对应。其中 TileLang 昇腾版本被描述为最重的一块,DeepSeek 称要建立新一代自主可控的 GPU 软件生态,需先有通用且编程简单的工具。

9月29日周二
  1. MIT Technology Review · AI12

    让 AI 成为资产而非开支:HPE 谈 AI 从按 token 消费转向自有算力

    HPE 提出,当 AI 从试验走向生产、形成客服与 IT 等智能体驱动的常态化负载后,企业需重新权衡按 token 消费与自建算力的经济性。Deloitte 2026 企业 AI 状态报告显示,2025 年员工 AI 使用率上升 5%,至少 40% 的 AI 项目进入生产的公司比例预计六个月内翻倍。HPE 建议企业按实际负载测算自有算力的盈亏平衡点,并通过采用、治理与用例扩展保持产能利用率。

9月25日周五
9月24日周四
  1. GitHub Blog · AI & ML22

    GitHub Copilot 应用如何渲染超大 pull request

    GitHub Copilot 应用重建了 pull request 视图,用一个含 2,200 个文件、超 100 万行改动和 400 多条行内评论的开源 PR 做验证。它把文档高度拆成确定性的代码几何与动态评论块两套体系,代码行高提前算好,评论高度按需测量并锚定到文件、行和侧,避免滚动跳变。

  2. Microsoft Research62

    微软研究:将物理 AI 推理卸载到边缘或云端可提升机器人性能与续航

    微软研究院对移动操作机器人工作负载做了系统性测量,发现把物理 AI 推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务成功率、支持更大模型并延长续航。

    推荐理由:微软团队系统测量了机器人端侧与卸载推理的差异,并给出可复用的 Kubernetes 卸载工具链。

  3. Google DeepMind62

    Google DeepMind 为 Private AI Compute 引入服务端持久记忆

    Google DeepMind 公布 Private AI Compute 平台的新技术能力,将私密的服务端持久记忆引入该平台,使 AI 助手能在多设备间保留上下文,同时维持接近端侧处理的隐私标准。

    推荐理由:Google 公开了云端持久记忆的隐私架构,读者可了解跨设备 AI 记忆如何在加密与安全隔区下实现。

9月17日周四
  1. GitHub Blog · AI & ML82

    GitHub 用 Copilot 把 Copilot 运行时迁移到 Rust

    GitHub 用 GitHub Copilot app 和 Copilot CLI 把 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,AI 智能体写了其中大部分代码,跨 128 个 pull request 增量合入 main,而非一次性切换。

    推荐理由:作者以亲历者身份给出把 80 万行运行时从 TypeScript 迁到 Rust 的完整工程细节,可迁移到大规模 Agent 协作开发。

9月4日周五
  1. 阮一峰的网络日志34

    科技爱好者周刊(第 411 期):OpenClaw 2.0 是一个缩影

    OpenClaw 发布 2.0 版,共有 933 位贡献者、合并 16000 个 PR,而全职团队仅 9 人、兼职 26 人,作者据此判断这些 PR 未经代码审查、由 AI 合并。该版本源于 8 月改动,发布节奏已从每日一版改为每月一版。作者仍建议不要在办公电脑上运行 OpenClaw,而应放在独立物理机、虚拟机或云端。

9月3日周四
7月29日周三
  1. Berkeley AI Research60

    从 CUDA 到 MLX:K-Search 如何把数十年内核经验带到 Apple Silicon

    Berkeley AI Research 与 IBM Research 将 K-Search 进化式内核搜索框架扩展到 MLX,通过结构化的 CUDA-to-MLX 翻译层把已有 CUDA 内核经验迁移到 Apple Silicon。

    推荐理由:读者可以看到 CUDA 优化经验如何被结构化迁移到 Apple Silicon,以及翻译层对最终性能差距的具体影响。

7月7日周二
  1. Berkeley AI Research40

    智能免费之后怎么办?面向智能体、由智能体运行、由智能体构建的数据系统

    GPT-4 级能力从 2023 年初的约 $30/百万 token 降至如今不到 $1,部分厂商已低于 $0.10,推理价格年降幅在 9x 到 900x 之间、中位数约 50x。UC Berkeley 的 Aditya G. Parameswaran 等人提出近零推理成本下的三大数据系统挑战:为智能体设计的数据系统、运行智能体集群的数据系统、由智能体合成并需可验证的数据系统。

5月8日周五
4月20日周一
  1. Berkeley AI Research31

    GRASP:面向世界模型长时程规划的梯度规划器

    Berkeley AI Research 提出梯度规划器 GRASP,通过将轨迹提升到虚拟状态实现跨时间并行优化、直接向状态迭代加入随机性以探索、并重塑梯度避免高维视觉模型中的脆弱"状态-输入"梯度,使世界模型的长时程规划变得可行。现代世界模型长时程规划常因优化病态、非贪心结构导致的局部极小值和高维隐空间失败模式而脆弱。

4月16日周四
12月17日周三