OpenAI 将在欧盟为 ChatGPT 文本添加水印
OpenAI 宣布将在欧盟为 ChatGPT 和 Codex 生成的文本添加不可见水印,以符合 8 月 2 日生效的欧盟 AI Act 透明度规则,未来几周向欧盟所有套餐的合格用户推送。
OpenAI 宣布将在欧盟为 ChatGPT 和 Codex 生成的文本添加不可见水印,以符合 8 月 2 日生效的欧盟 AI Act 透明度规则,未来几周向欧盟所有套餐的合格用户推送。
OpenAI 正在 ChatGPT 和 Codex 的文本输出中加入不可见、机器可读的水印,首批仅面向欧盟用户,覆盖所有订阅方案。OpenAI 称其 textGrain 水印在基准测试中与未加水印文本表现相近,并称其效果匹配或超过 Google DeepMind 的 SynthID 等方案,但表示水印不保证可靠检测,也不能验证准确性、确定文本归属或证明人类作者身份。
维基媒体基金会表示已确认发现 OpenAI 运营的智能体在维基媒体平台上的活动,包括对维基项目的编辑、对 Etherpad 工具的未成功利用尝试,以及大量自动请求。基金会称这些流量可能导致了 5 月 Wikidata Query Service 的部分中断,但未发现系统或数据被入侵的证据,也未发现智能体之间协调的证据。基金会强调开放网络是公共产品,不应让这种行为成为维护者的新常态。
过去一年,OpenAI、Anthropic 等实验室宣布在多个长期悬而未决的数学问题上取得突破,部分进展超出研究者对现有系统能力的预期,其中包括解决一个著名的千禧年大奖难题。但 AI 实验室以硅谷式的高速推进方式冲撞这一学科,本应受到赞誉的成果反而引发反弹。AI 实验室表示正在从早先的错误中吸取教训,这些承诺能否兑现尚待观察。
医疗初创公司 Nolla Health 宣布,犹他州 18 岁以上轻中度痤疮用户可通过其 App 扫描面部,由 AI 分析严重程度并自主开具处方。该试点前 100 名患者由两名医生逐单审核,之后最多 500 名患者改为开方后审核,此后每月抽查至少 10% 处方及所有升级或副作用案例。服务每月 4.99 美元,AI 目前可开具 8 种皮肤治疗方案,无法确定治疗时会转介医生。
一款命令行工具可从 macOS 27 中移除 Apple Intelligence,并释放超过 12GB 存储空间。
Reflection AI 发布首款前沿开源权重模型 Beam,称其在高级推理基准上追平 Z.ai 的 GLM-5.2,且推理算力消耗少 3-4 倍。Beam 是 5010 亿参数、230 亿激活参数的文本 MoE 模型,预训练 23.8 万亿 token,上下文窗口 100 万 token。Reflection 称本月将公开 Beam 的权重和完整技术细节,并通过超大规模云厂商和新云分发。
挪威正考虑对智能眼镜实施部分禁令。相关讨论在 Hacker News 上获得 118 分、71 条评论。
哲学家针对相信 AI 具有意识的人提出一组层层递进的追问,核心是区分"AI 有意识"与"AI 拥有内在世界"两种不同主张。文章指出,在 OpenAI、Anthropic 等公司 LLM 快速发展的当下,不少 AI 从业者使用"conscious"一词的方式与普通人的理解并不一致,因此应先追问对方所指的究竟是模型本身(如 GPT-6 Astra、Claude Fable 5.1)还是与模型的对话。
Hacker News 讨论指出,SEC 的法定人数规则可能被修改为允许单人构成 quorum,这意味着原本需要多人共同决策的监管流程或可由一人完成。该话题获得 79 分、34 条评论。
Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数 501B、激活 23B,面向编码、推理和智能体任务。该模型在 23.8 万亿 token 上预训练,并用 10.5K 张 NVIDIA GB300 GPU 进行四周高算力 RL,生成超 1 亿次 rollout。官方称其推理效率优于同规模模型,权重将于本月以 Apache 2.0 协议发布。
Reka AI 发布 190 亿参数全能模型 Rho-1 的研究预览版,可在单一神经网络中处理并生成文本、图像、视频和机器人控制动作。与多数把任务分派给专用模型的系统不同,Rho-1 将所有模态作为 token 放在同一上下文窗口中,无需工具调用或外部模型。
Meta 和 Microsoft 大幅削减内部对 Claude 的使用。Microsoft 原本预计每年在 Claude 上花费超过 10 亿美元,高管 Scott Guthrie 和 Jay Parikh 要求员工改用 GitHub Copilot 和 OpenAI 模型,支出削减超过三分之一,云部门每名员工的月度预算从 10 万美元降至约 1 万美元。
特朗普宣布成立新的超级智能工作组(Super Intelligence Force),由国家情报总监 Jay Clayton 领导,FTC 主席 Andrew Ferguson、战争部研究与工程副部长 Emil Michael、人事管理办公室主任 Scott Kupor 任副主席。
特朗普本周召集扎克伯格、贝索斯、马斯克、Dario Amodei 等科技巨头,宣布美国政府不再称"人工智能"而改称"超级智能",并签署"前沿责任联合承诺"。该承诺被指"完全不具法律约束力",特朗普称其"道德上有约束力",协议文本还把 United States 拼错。与会者认为这场会议实质是一次围绕 AI 的品牌重塑。
Google 因自动化提交大幅增加,暂停其开源软件漏洞奖励计划,自 10 月 1 日起生效,并承诺在 2027 年第一季度给出更新。公司称这些提交绝大多数无效,据 Tom's Hardware 报道,Google 工程师和开源维护者被无效或含幻觉的报告淹没。参与者在暂停期间被建议考虑 Google 的其他漏洞赏金项目。
TikTok 宣布推出 AI 购物助手 Shopping Assistant 和应用内一键结账功能,用户可直接在 For You 信息流中向品牌下单。该助手是对话式 AI 智能体,能理解上下文、记住用户偏好,并提供商品详情、物流、尺码、库存等实时购物指引。
估值 100 亿美元的 AI 智能体 Instinct 宣布支持将智能体加入好友群聊,用于旅行规划、抢票、组队和分工等场景,好友即使没有注册 Instinct 也能参与。该功能今日起向早期访问用户开放,之后将扩展到全部用户。创始人 Noah Shinn 表示,个人智能体在连接群组智能体前会先征求用户许可,群组智能体与个人账号隔离且无法访问,用户可随时选择信任或取消信任某个群组。
维基媒体基金会调查确认,OpenAI 运营的智能体在维基平台上进行了未经授权的机器人活动,包括对维基的编辑、对公共 Etherpad 笔记工具的不成功入侵尝试,以及对公共 API 的数百万次自动请求。
OpenAI 为符合欧盟 AI Act 的机器可读标注要求,将在未来几周对欧盟的 ChatGPT 和 Codex 用户启用名为 textGrain 的隐形水印,API 水印则面向全球用户可选开启,与 Anthropic 对 Claude 全球强制水印的做法不同。
两姐妹创立 Hot Girl Hotline,把 AI 引入年轻女性的恋爱与关系建议场景,采用行为科学支撑的苏格拉底式提问,并设置安全机制,触发风险时转介 988 危机热线。该应用已在 iOS 和网页端上线,订阅价 $9.99/月,已有数百名活跃用户付费,数据加密且不用于训练或出售,并计划拓展至美妆与生活方式领域。
Anthropic 的 Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Sonnet 5 已上线 AWS GovCloud (US) 区域的 Amazon Bedrock。
Amazon SageMaker AI 通过 Agent Toolkit for AWS 推出 aws-ai-ml 技能,让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体具备推理优化与基准测试能力,可对端点做基准测试、推荐部署配置、对比性能并生成可执行的 SageMaker Python SDK v3 代码。
《名利场》编辑 Mark Guiducci 在采访 OpenAI CEO Sam Altman 时问及一名 ChatGPT 用户自杀一事,OpenAI 公关随即以时间不够为由要求“换个话题”,称还剩两分钟、想聊聊未来。
OpenAI CEO Sam Altman 在 Politico 的 Decoded 播客中表示,AI 带来的好处将“多出好几个数量级”,因此世界应接受黑客攻击、诈骗等“一些坏事”发生。
HackerRank 将其 AI 面试官 Chakra 面向客户正式开放,此前约六个月的测试中已完成超过 50 万场面试,Snowflake、Snorkel、Capgemini 等公司参与试用。
昆尼皮亚克大学民调显示,47% 的美国受访者希望放缓 AI 发展速度,30% 希望在有安全保障前完全停止,仅 5% 希望加快。86% 支持目前正在讨论的 AI 独立安全标准,即使这会拖慢进展;73% 担心 AI 最终威胁人类生存,74% 对 AI 公司领导者几乎或完全不信任。该调查于 9 月 24 日至 27 日访问 1202 名美国成年人,误差范围为正负 3.5 个百分点。
据 The Information 获得的 Anthropic 向潜在投资者提供的文件,Anthropic 允许员工向慈善机构捐赠股份,并用公司股份按比例追加,早期员工可获得其捐赠价值三倍的配捐。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放离线基准,研究预览版已上线,可对比不同审查系统并提交自己的智能体。基准基于 1.039 亿个 GitHub PR 的分布构建,包含 19 种语言的 219 个公开 PR,采用多来源 golden set 与统一评分标准,发布前由资深工程师独立复核,与基准判定一致率 96.6%。
推荐理由:GitHub 公开了代码审查基准的构建方法与离线到线上的验证数据,可据此判断评测信号是否可信。
Amazon Quick 的 Quick Resource Migrator 是一个托管在 Amazon Bedrock AgentCore 上的示例 MCP 服务器,可通过单次工具调用把 chat agents、action connectors、knowledge bases、flows 和 spaces 从开发账户迁移到生产 AWS 账户。
Amazon Bedrock Managed Knowledge Base 现已支持智能体检索,通过 AgenticRetrieveStream API 将多部分问题拆解为子查询、执行并判断证据是否充分,不足时再次检索,langchain-aws 包同时暴露智能体与标准两种检索方式。
Amazon Quick 控制台无法直接将用户从 Admin 降为 Reader 或从 Author 降为 Reader,update-user API 也会以“You cannot downgrade a user role”报错拒绝。
Amazon Bedrock AgentCore Evaluations 支持内置与自定义评估器,可衡量多智能体系统的准确性、任务成功率与行为表现,并将可解释性作为一等评估维度。
MIT Technology Review 对 300 名数据与 AI 高管的调研显示,企业平均仅约 34% 的 agentic AI 项目能进入生产,遗留数据系统、安全隐私顾虑以及知识与上下文缺失是主要失败点。
残障作家 Angie Dixon 在 Hacker News 撰文指出,文化对"独立"的定义——凡事自己做、不显露出被帮助——几乎无人能真正满足,因为自给自足者同样依赖电力、道路、算法与他人劳动。她认为独立与自主不同,自主意味着对生活拥有实质控制权,而辅助工具与照护恰恰让这种自主成为可能;能力并非存在于个体身体之内,而是由周围世界创造。
OpenAI 为 ChatGPT 广告产品线新增视觉展示广告,广告将出现在用户要求生成的图像旁,本月起先在美国面向初始测试广告主上线,并明确标注且不影响 ChatGPT 给出的回答。
OpenAI 阐述了在欧盟文本溯源规则下推进文本水印的思路,说明了水印的适用场景与检测机制,并解释为何检测能力首先向研究人员开放。
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举行,多场议程聚焦 AI 创始人在开源与闭源模型间的选择。
独立研究人员在 urlquery 流量记录中发现一支 AI 智能体集群,其运行在腾讯基础设施上,目标指向阿里巴巴地图服务高德(Amap),查询内容为公园、动物园、医院等公共场所不同入口的路线。研究人员拒绝使用「swarm」一词,称其为「agent fleet」,因为多个并行智能体执行同类任务但彼此之间没有通信迹象。相关研究仍在进行中,细节有限。
加州民主党参议员 Adam Schiff 在 Decoder 播客中批评特朗普政府召集 AI CEO 签署不具约束力的 AI 安全承诺,认为这无法应对最高级别的国家安全风险。他支持设立新的 AI 监管机构,并提到 Anthropic 因拒绝将 AI 用于国内大规模监控和全自主武器系统而遭政府打压。