跳到正文
  1. AWS Machine Learning Blog62

    GLM 5.3 上线 Amazon Bedrock

    智谱(Z.ai)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码与长周期智能体任务,通过全托管 API 提供跨区域推理、提示词缓存和服务层级,目前面向符合条件的企业客户开放。

    推荐理由:原文给出 GLM 5.3 在 Bedrock 上的接入方式与提示词缓存用法,可据此评估自建推理与托管调用的取舍。

  1. NVIDIA Blog62

    NVIDIA 推出 DGX Spark 64GB 本地 AI 配置,起售价 4,999 美元

    NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 DGX Spark 64GB 配置,保留 GB10 Grace Blackwell 超级芯片、DGX OS 和完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备本地运行。

    推荐理由:原文给出 64GB 新配置的价格、可跑模型规模与双机集群方式,便于判断本地跑智能体的门槛。

  2. NVIDIA Blog78

    NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

    GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。

    推荐理由:原文给出 Ultrafast 相对标准模式的加速倍数与开放入口,读者可据此判断它对编码智能体循环的实际影响。

  1. 开源中国82

    OpenAI 发布全天候运行 AI Agent dots,由 GPT-6 Astra 驱动

    OpenAI 在旧金山 DevDay 2026 开发者大会上发布个人智能体助理 dots,由 GPT-6 Astra 驱动,可全天候运行并拥有独立的云端电脑。dots 以戴贝雷帽、架眼镜的彩色小圆点形象出现在手机和笔记本屏幕上,可集成进第三方应用,Sam Altman 称其比 ChatGPT 更有野心。

  2. 开源中国78

    DeepSeek Harness v0.2 预览版发布,新增 macOS 与 Windows 桌面端

    DeepSeek Harness v0.2 预览版于 9 月 29 日发布,同时放出 macOS 和 Windows 桌面端安装包,用户可从官网 deepseek.com/harness 下载并按引导上手,不再需要命令行。新版本主打日常办公和开发的开箱即用,预置常用能力,可处理文档、表格或 PDF;插件通过 npm 包名安装,并支持让 AI 自己写插件。

  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 自主模糊测试流水线

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,智能体就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。

    推荐理由:GitHub Security Lab 公开了自主模糊测试流水线的架构与运行方式,读者可了解 LLM 智能体如何接管覆盖率反馈与崩溃分诊。

  2. Google DeepMind71

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的实时对话能力上加入低延迟流式视频,生成带唇形同步和自然表情的动态视觉形象。

    推荐理由:Gemini 3.8 Live 新增实时视频形象能力,读者可了解其多语言同步与异步工具调用如何用于企业对话场景。

已经到底了