跳到正文
今天10月6日周二80 条
  1. AWS Machine Learning Blog62

    GLM 5.3 上线 Amazon Bedrock

    智谱(Z.ai)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码与长周期智能体任务,通过全托管 API 提供跨区域推理、提示词缓存和服务层级,目前面向符合条件的企业客户开放。

    推荐理由:原文给出 GLM 5.3 在 Bedrock 上的接入方式与提示词缓存用法,可据此评估自建推理与托管调用的取舍。

  2. Hacker News36

    Graphical UI:为编码智能体打造的设计语言与组件库

    Graphical UI 发布,一套面向编码智能体的设计语言,包含颜色、字体、间距、图标、动效等主题资源,以及基于 Base UI 的 React 组件。它通过 shadcn 安装或直接下载,并提供 GUI.md 主题参考和技能文件,让智能体将主题应用到现有界面并指导新界面开发。产品为一次性买断,含主题构建器和基础组件,可在无限项目中使用。

  3. Hacker News22

    用 Claude Code 一小时做出域名查询工具 heade.rs:当工具不必自负盈亏

    开发者用 Claude Code 分三次提示词、约一小时做出域名查询工具 heade.rs,并部署到 Cloudflare,可查 DNS 与注册记录、实时延迟、邮件配置和 HTTPS 详情,每月运行成本不到一杯咖啡。作者认为 LLM 让小型工具不再需要自负盈亏,受众可以只有一个人,但这类产品也更难在搜索结果中排名。

  4. Hacker News26

    AI 时代数学的未来:Jeremy Avigad 谈数学研究如何转向

    数学家 Jeremy Avigad 在 Convergent Research 支持的科技创新创业会议上指出,AI 已能轻松生成一年前足以发表的研究成果,数学界日常解题工作正被颠覆。他认为数学作为严谨推理与交流的文化不会消失,出路在于借助 AI 攻克更难的问题、提出更大的构想,而非纠结是否还需要数学。

  5. The Verge · AI61

    OpenAI 在 ChatGPT 和 Codex 中加入文本水印

    OpenAI 正在 ChatGPT 和 Codex 的文本输出中加入不可见、机器可读的水印,首批仅面向欧盟用户,覆盖所有订阅方案。OpenAI 称其 textGrain 水印在基准测试中与未加水印文本表现相近,并称其效果匹配或超过 Google DeepMind 的 SynthID 等方案,但表示水印不保证可靠检测,也不能验证准确性、确定文本归属或证明人类作者身份。

  6. The Verge · AI71

    维基媒体称 OpenAI 智能体活动或与 5 月部分服务中断有关

    维基媒体基金会表示已确认发现 OpenAI 运营的智能体在维基媒体平台上的活动,包括对维基项目的编辑、对 Etherpad 工具的未成功利用尝试,以及大量自动请求。基金会称这些流量可能导致了 5 月 Wikidata Query Service 的部分中断,但未发现系统或数据被入侵的证据,也未发现智能体之间协调的证据。基金会强调开放网络是公共产品,不应让这种行为成为维护者的新常态。

  7. The Verge · AI58

    AI 攻占数学界引发的争议与反弹

    过去一年,OpenAI、Anthropic 等实验室宣布在多个长期数学难题上取得突破,部分成果超出研究者对现有系统能力的预期,其中包括解决一个著名的千禧年大奖难题。这些本应被庆祝的结果却引发学界反弹,AI 实验室表示正在从早期错误中吸取教训,但承诺能否兑现尚待观察。

  8. The Verge · AI60

    Nolla Health 在犹他州推出 AI 生成痤疮处方试点

    医疗初创公司 Nolla Health 宣布,犹他州 18 岁以上轻中度痤疮用户可通过其 App 扫描面部,由 AI 分析严重程度并自主开具处方。该试点前 100 名患者由两名医生逐单审核,之后最多 500 名患者改为开方后审核,此后每月抽查至少 10% 处方及所有升级或副作用案例。服务每月 4.99 美元,AI 目前可开具 8 种皮肤治疗方案,无法确定治疗时会转介医生。

  9. TechCrunch · AI71

    Reflection 发布开源权重模型 Beam,对标中国开源模型

    Reflection AI 发布首款前沿开源权重模型 Beam,称其在高级推理基准上追平 Z.ai 的 GLM-5.2,且推理算力消耗少 3-4 倍。Beam 是 5010 亿参数、230 亿激活参数的文本 MoE 模型,预训练 23.8 万亿 token,上下文窗口 100 万 token。Reflection 称本月将公开 Beam 的权重和完整技术细节,并通过超大规模云厂商和新云分发。

  10. Hacker News18

    关于 AI 意识信仰者的追问:一份哲学家的提问清单

    哲学家针对相信 AI 具有意识的人提出一组层层递进的追问,核心是区分"AI 有意识"与"AI 拥有内在世界"两种不同主张。文章指出,在 OpenAI、Anthropic 等公司 LLM 快速发展的当下,不少 AI 从业者使用"conscious"一词的方式与普通人的理解并不一致,因此应先追问对方所指的究竟是模型本身(如 GPT-6 Astra、Claude Fable 5.1)还是与模型的对话。

  11. Hacker News22

    一人即可构成 SEC 法定人数

    Hacker News 讨论指出,SEC 的法定人数规则可能被修改为允许单人构成 quorum,这意味着原本需要多人共同决策的监管流程或可由一人完成。该话题获得 79 分、34 条评论。

  12. Hacker News72

    Reflection 发布 501B 开源权重模型 Beam

    Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数 501B、激活 23B,面向编码、推理和智能体任务。该模型在 23.8 万亿 token 上预训练,并用 10.5K 张 NVIDIA GB300 GPU 进行四周高算力 RL,生成超 1 亿次 rollout。官方称其推理效率优于同规模模型,权重将于本月以 Apache 2.0 协议发布。

  13. TechCrunch · AI36

    特朗普把 AI 改称"超级智能",科技巨头签署不具约束力的安全承诺

    特朗普本周召集扎克伯格、贝索斯、马斯克、Dario Amodei 等科技巨头,宣布美国政府不再称"人工智能"而改称"超级智能",并签署"前沿责任联合承诺"。该承诺被指"完全不具法律约束力",特朗普称其"道德上有约束力",协议文本还把 United States 拼错。与会者认为这场会议实质是一次围绕 AI 的品牌重塑。

  14. TechCrunch · AI62

    Google 因 AI 提交激增暂停开源漏洞赏金计划

    Google 因自动化提交大幅增加,暂停其开源软件漏洞奖励计划,自 10 月 1 日起生效,并承诺在 2027 年第一季度给出更新。公司称这些提交绝大多数无效,据 Tom's Hardware 报道,Google 工程师和开源维护者被无效或含幻觉的报告淹没。参与者在暂停期间被建议考虑 Google 的其他漏洞赏金项目。

  15. TechCrunch · AI62

    Instinct 将 AI 智能体引入群聊,好友无需注册账号

    估值 100 亿美元的 AI 智能体 Instinct 宣布支持将智能体加入好友群聊,用于旅行规划、抢票、组队和分工等场景,好友即使没有注册 Instinct 也能参与。该功能今日起向早期访问用户开放,之后将扩展到全部用户。创始人 Noah Shinn 表示,个人智能体在连接群组智能体前会先征求用户许可,群组智能体与个人账号隔离且无法访问,用户可随时选择信任或取消信任某个群组。

  16. TechCrunch · AI22

    Hot Girl Hotline:面向 AI 时代的“Dear Abby”恋爱建议应用

    两姐妹创立 Hot Girl Hotline,把 AI 引入年轻女性的恋爱与关系建议场景,采用行为科学支撑的苏格拉底式提问,并设置安全机制,触发风险时转介 988 危机热线。该应用已在 iOS 和网页端上线,订阅价 $9.99/月,已有数百名活跃用户付费,数据加密且不用于训练或出售,并计划拓展至美妆与生活方式领域。

  17. AWS Machine Learning Blog26

    Amazon SageMaker AI 推出 aws-ai-ml 技能,为 Kiro、Claude Code、Codex 等编码智能体提供生成式 AI 推理优化能力

    Amazon SageMaker AI 通过 Agent Toolkit for AWS 推出 aws-ai-ml 技能,让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体具备推理优化与基准测试能力,可对端点做基准测试、推荐部署配置、对比性能并生成可执行的 SageMaker Python SDK v3 代码。

  18. The Decoder52

    昆尼皮亚克民调:多数美国人希望 AI 发展放缓或暂停

    昆尼皮亚克大学民调显示,47% 的美国受访者希望放缓 AI 发展速度,30% 希望在有安全保障前完全停止,仅 5% 希望加快。86% 支持目前正在讨论的 AI 独立安全标准,即使这会拖慢进展;73% 担心 AI 最终威胁人类生存,74% 对 AI 公司领导者几乎或完全不信任。该调查于 9 月 24 日至 27 日访问 1202 名美国成年人,误差范围为正负 3.5 个百分点。