跳到正文
今天10月7日周三12 条
  1. 掘金22

    从鸿蒙搬到 iOS 和 Android:仓颉棋盘游戏《驿路巡点》为何最终选择 CJMP

    仓颉棋盘游戏《驿路巡点》从鸿蒙迁移到 iOS 和 Android 时,先尝试仓颉 1.1.3 交叉编译加原生壳方案,只跑通 1 关,且发现 Canvas 在 iOS/Android 的引擎构建中未编入。团队随后转向 CJMP,使用 OpenSDK 0.2.2(内置 cjc 1.1.0),求解器层面 100 关全通,94 关测试在模拟器上完成。

  2. arXiv cs.CL34

    Common Corpus:面向 LLM 预训练的最大规模伦理数据集

    Common Corpus 是迄今最大的开放 LLM 预训练数据集,数据均为无版权或开放许可内容,总量约两万亿 token,涵盖从高资源欧洲语言到低资源语言及大量代码数据。研究团队在该数据集上训练了两个小型语言模型,性能与同规模模型相当,表明其适合多语言预训练。该数据集已被 ICLR 2026 接收为 Oral 论文。

  3. arXiv cs.AI42

    通过随机嵌入扰动越狱开放权重 LLM

    研究者提出 Perturbed Embedding Vector(PEV)攻击,仅向提示词的嵌入向量表示中加入独立高斯噪声,即可越狱六种不同规模的常见开放权重 LLM,在 JailbreakBench 上对所有模型、所有提示词均生成不安全回复。PEV 无需梯度计算、逐提示优化或修改模型内部权重,取得首次成功攻击的平均算力成本比此前方法低至多一个数量级,每个测试模型上首次越狱通常在一分钟内出现。

  4. Simon Willison32

    EmbeddingGemma 2 采用 Apache 2.0 许可

    EmbeddingGemma 2 采用 Apache 2.0 开源许可,Simon Willison 认为嵌入模型不应使用闭源、专有、仅托管的形式。嵌入模型应用通常需计算并存储数千乃至数百万条嵌入向量,一旦厂商停供该模型,用户仍需为重新计算这些已存向量付费。他本人不愿自行托管模型,更愿付费使用托管服务,同时保留在厂商停供时自行运行开放权重版本或另寻供应商的余地。

  5. TechCrunch · AI38

    LibreOffice 称“无 AI”如今是一项软件功能

    LibreOffice 背后的 The Document Foundation 宣布,在可预见的未来不会为这款开源文档编辑器加入 AI,默认安装中不含任何 AI 功能。该组织称这是“刻意设计立场”,以确保用户文档不被上传至服务器处理、软件无需联网即可运行,用户仍可通过安装扩展接入本地 AI 模型。

10月6日周二
  1. 掘金24

    中小企业上 WMS 该先上哪几块:JeeWMS 开源 Java 仓库管理系统的分批上线清单

    JeeWMS 给出中小企业分批上线 WMS 的清单:第一批只做“账做准”,含基础配置层、收货上架、拣货出库复核、库内调整与盘点,PDA 仅做收货和拣货;第二批补效率与稽核,第三批才接 RFID/AGV 设备与 ERP、MES 集成。该系统基于 Spring Cloud 微服务与 Vue 前端,采用 GPL-3.0 协议,官方仓库为 gitee.com/erzhongxmu/JEEWMS。

  2. AWS Machine Learning Blog62

    GLM 5.3 上线 Amazon Bedrock

    智谱(Z.ai)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码与长周期智能体任务,通过全托管 API 提供跨区域推理、提示词缓存和服务层级,目前面向符合条件的企业客户开放。

    推荐理由:原文给出 GLM 5.3 在 Bedrock 上的接入方式与提示词缓存用法,可据此评估自建推理与托管调用的取舍。

10月3日周六
10月2日周五
9月30日周三
  1. 开源中国68

    DeepSeek 开源面向华为昇腾的基础组件

    DeepSeek 于 9 月 30 日正式开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、计算库和分布式通信库,与此前面向英伟达平台的开源组件一一对应。其中 TileLang 昇腾版本被描述为最重的一块,DeepSeek 称要建立新一代自主可控的 GPU 软件生态,需先有通用且编程简单的工具。

9月29日周二
9月24日周四
  1. NVIDIA Blog62

    NVIDIA 联合 Google DeepMind 等开放 2800 多种病毒的蛋白复合物结构数据集

    NVIDIA 加入由 Google DeepMind、EMBL-EBI 等组成的全球研究联盟,通过 AlphaFold Database 开放 2800 多种病毒的蛋白复合物预测 3D 结构,供任何科学家免费使用。

    推荐理由:NVIDIA 联合 Google DeepMind 等机构开放 2800 多种病毒的蛋白复合物预测结构,读者可了解开放科学在疫情准备中的具体做法。

9月11日周五
9月4日周五
  1. 阮一峰的网络日志34

    科技爱好者周刊(第 411 期):OpenClaw 2.0 是一个缩影

    OpenClaw 发布 2.0 版,共有 933 位贡献者、合并 16000 个 PR,而全职团队仅 9 人、兼职 26 人,作者据此判断这些 PR 未经代码审查、由 AI 合并。该版本源于 8 月改动,发布节奏已从每日一版改为每月一版。作者仍建议不要在办公电脑上运行 OpenClaw,而应放在独立物理机、虚拟机或云端。

8月21日周五
  1. Microsoft Research38

    微软 Skala 1.1 发布:训练数据增至 2.5 倍,并集成进 CP2K 等主流 DFT 软件

    微软研究院发布深度学习交换关联泛函 Skala 1.1,训练数据量为此前公开版本的 2.5 倍,在 GMTKN55 基准 55 个类别中 32 项排名第一,加权平均误差 2.8 kcal/mol。Skala 现已在 CP2K 中可用,并正集成进 Psi4、FHI-aims、ORCA 和 VASP,同时推出持续追踪各版本计算性能的 living benchmark。