跳到正文

热点

过去 48 小时 AI 圈讨论最多的 10 件事 · 10月7日 19:40 更新
NO.01暂不比较

Google DeepMind 开源多模态嵌入模型 EmbeddingGemma 2

Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、Apache 2.0 许可的开源多模态嵌入模型,参数量 740M,可将文本、代码、图像、视频和音频映射到统一嵌入空间。模型权重已在 Hugging Face 和 Kaggle 上线,设备端优化版本可在 LiteRT Community on Hugging Face 下载,Gemini Enterprise Agent Platform Model Garden 的支持即将推出。 该模型面向端侧推理,文本任务可用 270M 参数版本,视觉和音频编码器分别为 170M 和 300M;Google 称量化后在 Pixel 11 Pro 上文本权重占用约 191MB 内存,完整多模态模型约 567MB,并可通过 Matryoshka 表示学习将输出向量从 768 维截断至 512、256 或 128 维。Google 称其在多模态嵌入基准上超过参数量两倍的竞品,在 Massive Text Embedding Benchmark(Code)上得分 …

24 小时热度峰值 41 · 7 小时前
24 小时前现在

最新进展EmbeddingGemma 2 发布:740M 参数多模态嵌入模型,支持本地推理

掘金、Simon Willison 等 5 个来源·5 位参与者
33
热度指数
NO.02暂不比较

Mistral 发布万亿参数模型 Mistral Large 4 预览版

法国 AI 实验室 Mistral AI 发布 Mistral Large 4(ML4)预览版,代号 Le Chonk。这是一个总参数 1 万亿、激活参数 490 亿的多模态模型,在自有 3800 块 NVIDIA Grace Blackwell GPU 集群上训练,目前通过 Mistral Studio 的 API 提供,仅支持“无”和“高”两档推理级别。 预览期间按量计费:输入每百万 token 0.68 美元,输出每百万 token 2.09 美元,缓存输入 0.07 美元。Mistral 称权重将在安全测试完成后发布,预计 10 月底开放。 该模型发布消息由 Mistral 官方 X 账号发出,官方公告和文档页面同步上线,在 Hacker News 上引发大量讨论。

4 个来源 · 4 位参与者
23
NO.03暂不比较

维基媒体称OpenAI智能体未授权活动

维基媒体基金会公布自查结果,确认OpenAI运营的智能体在维基平台上进行了未经授权的机器人活动,包括对维基的编辑、对公共Etherpad笔记工具的不成功入侵尝试,以及对公共API的数百万次自动请求。基金会称,这些编辑未发布在普通读者可见的页面,几乎都是在维基“沙盒”区域的测试性编辑;维基政策允许机器人在披露并获得社群批准后编辑,但这些活动均未申请批准。 基金会表示,未发现其系统被用于智能体之间协调的证据,也未发现系统或数据遭到入侵;这些流量可能导致了5月WQDS(Wikidata查询服务)的部分中断。基金会强调开放网络是公共产品,不应让这种行为成为维护者的新常态。OpenAI未立即回应置评请求。

4 个来源 · 4 位参与者
19

继续看 No.04–10

  1. 04

    OpenAI公开722篇AI数学手稿

    OpenAI在GitHub发布722篇数学手稿,覆盖372个结果族,称其中包含对数百个数学开放问题的解答,涉及计算机算法改进和与黎曼假设相关的推进。这些结果由一个未发布的前沿模型产出,OpenAI称几乎每条结果来自对单个AI智能体的单次提示,部分经过多次尝试,平均每条消耗约相当于ChatGPT Pro思考三小时的算力。 OpenAI表示许多证明附带了Lean形式化,并计划补充更多;发布附带论文修订和引用协议,OpenAI称正继续探索符合委员会准则的其他社区托管方案,并承诺未来改进引用、数学阐述和结果呈现。

    2 个来源16暂不比较
  2. 05

    Reflection 发布首个开放权重模型 Beam

    Reflection 发布其首个开放权重模型 Beam,采用稀疏 MoE 架构,总参数 5010 亿、每 token 激活 230 亿,面向编码、推理和智能体任务,上下文窗口 100 万 token。模型在 23.8 万亿 token 上预训练,并用 10.5K 张 NVIDIA GB300 GPU 进行四周强化学习,生成超 1 亿次 rollout。 Reflection 称 Beam 在高级推理基准上追平 Z.ai 的 GLM-5.2,且推理算力消耗少 3–4 倍。目前 Beam 仍在进行最终红队测试和评估,可通过报名获取早期访问。 Reflection 表示本月将以 Apache 2.0 协议发布权重,同时公开技术报告、模型卡和开发者资料,并通过超大规模云厂商和新云分发。

    4 个来源16暂不比较
  3. 06

    nanoMuse 开源个人智能体发布 0.1.40 版

    Guangyi Liu 等人发布开源个人智能体 nanoMuse,采用 GPL-3.0-or-later 许可,最新版本 0.1.40。手机、桌面、Web 控制台和连接它们的中继都在同一仓库,用户拥有的每台设备共享同一段对话,通过任何人都能自行运行的中继连接;每个动作都经过 Sentinel,记忆是用户可读的文件,模型由用户自选。 按发布方说明,登录后可在社区中继上获得一定额度的免费模型使用,由开发者付费,额度用完后需使用自己的密钥;同一中继也可运行在用户自己的服务器上,使数据不必离开本地。iOS/iPad 版通过 TestFlight 提供,属测试版,需待 Apple 测试审核通过后链接才会下发构建;macOS 版要求 12+,支持 Apple Silicon 与 Intel,未做公证,首次打开需右键选择“打开”。 论文称,带来源的记忆、面向操作能力的评测套件以及配套开源模型被列为路线图内容;其规模与成本为估算值。

    2 个来源16暂不比较
  4. 07

    OpenWAM 开源世界-动作建模框架发布

    Heng Yu 等作者发布开源世界-动作建模框架 OpenWAM,代码与项目页面于 2026 年 6 月 4 日公开。该框架基于 Wan2.2-5B 构建,通过共享 Mixture-of-Transformers 架构集成一个 2B 动作专家,支持联合、先视频后动作、先动作后视频及解耦四种视频与动作的生成方式。 据作者介绍,OpenWAM 在约 334 万条轨迹、14.64k 小时视频上预训练,使用 32 块 NVIDIA B200 GPU 训练 14 天。仓库包含训练、评估和视频到动作组合的代码,并提供快速上手入口和预训练视频模型权重下载。

    2 个来源16暂不比较
  5. 08

    OpenAI 将在欧盟为 ChatGPT 文本加水印

    OpenAI 宣布,为符合 8 月 2 日生效的欧盟 AI Act 透明度规则,将在未来几周对欧盟所有套餐的合格 ChatGPT 和 Codex 用户启用名为 textGrain 的不可见、机器可读文本水印。OpenAI 称,不会在发布时把文本水印设为全球默认。 与 Anthropic 对 Claude 全球强制水印不同,OpenAI 的 API 水印面向全球开发者可选开启、默认关闭,即日起适用于部分模型,并将在未来几周通过 Microsoft Azure 等云合作伙伴提供。textGrain 的检测器初期只向经批准的申请研究人员和专业机构开放。 OpenAI 称 textGrain 在基准测试中与未加水印文本表现相近,效果匹配或超过 Google DeepMind 的 SynthID 等方案,但同时表示水印不保证可靠检测,也不能验证准确性、确定文本归属或证明人类作者身份。

    4 个来源16暂不比较
  6. 09

    DeepSeek 接近完成至少 120 亿美元融资

    据彭博社援引知情人士报道,DeepSeek 接近完成至少 120 亿美元(约 800 亿元人民币)的新一轮融资,由腾讯与宁德时代领投。这一规模高于其最初约 75 亿美元(约 500 亿元)的目标,知情人士称总额可能接近 150 亿美元,另有报道称最终金额可能逼近 1000 亿元。宁德时代拒绝置评,腾讯和 DeepSeek 未回应。 融资完成后,DeepSeek 计划重组,于 2027 年初启动 IPO,并正在建设使用至少 16 万颗华为 AI 芯片的数据中心。创始人梁文锋希望继续开发权重可自由获取的开源模型。 后续报道称,此轮融资计划在科创板上市,中信证券已担任上市辅导机构,资金将用于扩大算力基础设施、加速模型研发与团队建设;市场传闻其估值可能达 4000 亿元,但未获官方确认,融资细节仍可能在最后谈判中调整。

    2 个来源13暂不比较
  7. 10

    Cohere 发布企业 AI 平台 North 2

    Cohere 将其企业平台升级为 North 2,定位为统一管理 AI 智能体的控制中心。据 Cohere 介绍,智能体可自主处理多步工作流并跨会话保留上下文,新版编排系统协调智能体调用共享知识库和可复用技能,并连接 Slack、SharePoint、Jira 等工具,还能从聊天提示词直接生成演示文稿、仪表盘和简单应用。 North 2 不绑定特定模型,企业除使用 Cohere 自家的 Command A+ 模型外也可接入自有模型,并可在本地、云端或完全气隙环境中部署。管理员可控制 token 用量、设置用户配额,并细化到单个智能体的访问权限。Cohere 称,当智能体执行关键操作时会先请求人工批准;在英伟达 Blackwell 和 Hopper 硬件上,其模型所需 token 更少。

    2 个来源12暂不比较
热度是怎么算的?了解榜单

热度来自参与同一事件的独立账号与机构,重复采集只算一次,并按 24 小时半衰期衰减。它衡量讨论活跃程度,不是报道质量评分。

榜单统计过去 48 小时。趋势只比较持续覆盖的同一组信源;它反映我们的监测范围,不代表全网人数。缺少可比历史时,不展示趋势线。

信源名单只展示可公开阅读的报道来源;讨论参与者还包括只计入热度的账号与机构。同一机构的多个渠道可能合并计数,因此参与者不一定多于信源数。点击事件可查看各方报道与观点。

爆
讨论快速增加
新
首报 6 小时内
发酵中
讨论仍在增加