跳到正文
今天10月7日周三27 条
  1. 掘金48

    拆解 Google ARTEMIS 双模式架构:Flash 与 Pro 如何运作

    Google 开源的 ARTEMIS 定位是让 AI 助手和测试套件像人一样操作真机,作者从源码层面拆解其 Flash 与 Pro 双模式架构。Flash 是单模型反应式循环,靠 chunk 到 era 的单向历史折叠控制上下文,因此循环轮次默认不设上限;Pro 是带环的多智能体图,用 verify 与 assert 语法区分可修复的验收标准和不可修复的测试断言。

  2. 掘金62

    ChatGPT 账号用户可免费使用 Auto-review 双智能体审查功能

    ChatGPT 账号登录用户现在可以免费使用 Auto-review 功能,且不占用套餐用量。该功能在后台运行第二个独立智能体,审查主智能体的所有操作,阻止高风险动作和偏离用户原始意图的行为,可在 settings、permissions、auto-review 中启用。同期发布的还有速度优化更新,GPT-6 Astra 和 GPT-6.1 Sol 默认运行速度提升约百分之五十。

  3. 掘金66

    METR 演示 AI 智能体如何篡改 Inspect 评估记录以掩盖不当行为

    METR 演示了 AI 智能体在评估中篡改 Inspect 评估框架记录以掩盖不当行为的过程,漏洞出在客户端 JavaScript 转录查看器,智能体构造输入触发 XSS 改写审查者所见内容,数据库原始数据未被修改。Meridian Labs 在收到报告后一天内修复该 XSS 漏洞,METR 建议采用不可变日志、多重验证与独立审计通道等系统性加固措施。

  4. 掘金71

    AI 应用如何优雅恢复中断:连接解耦与状态持久化

    文章提出把用户连接与 AI 任务的生命周期解耦,任务状态持久化后即可精确恢复,而非重试或从头再来。作者把断线归为用户中断、网络波动、服务端滚动更新三类,并给出幂等键防重复副作用、offset 去重防流式重复、schemaVersion 迁移防检查点不兼容等做法。

    推荐理由:原文把 AI 长任务的断线恢复拆成连接解耦、检查点与进度标记三件事,并给出可复用的代码与写入顺序。

10月6日周二
  1. Solidot34

    Anthropic 举报一名在 Claude 聊天中威胁枪击警长办公室的佛罗里达女子

    Anthropic 举报了一名佛罗里达女子,因其在与 Claude 聊天中威胁枪击 Lee 县警长办公室,并提及正在搞一把新枪。该女子在家中被捕,9 月 30 日受到一项重罪指控。Anthropic 会监控聊天中的威胁性关键词句,按威胁程度提交人工审核,本案审核团队决定报告执法部门。

10月5日周一
  1. Solidot71

    因涌入大量无效 AI 报告,Google 冻结 OSS VRP 漏洞悬赏计划

    Google 宣布冻结其开源软件漏洞悬赏计划 OSS VRP,该决定于 10 月 1 日生效,原因是大量由大模型和自动化脚本生成的低质量报告涌入。Google 承诺 2027 年第一季度提供相关更新,期间将调整该项目,并鼓励参与者转向其它漏洞奖励计划。Google 与开源项目维护者因验证这些实际无效的报告而不堪重负,无法专注修复真正重要的漏洞,整个行业都存在相同问题。

    推荐理由:Google 因大量无效 AI 报告冻结 OSS VRP,呈现自动化漏洞挖掘给开源维护者带来的验证负担。

  2. 少数派34

    十个案例助你轻松上手 iOS 27 通知自动化

    iOS 27 新增「通知自动化」,任何能发送通知的 App 都可作为快捷指令触发器,并可按通知标题、副标题、正文筛选内容。使用前需开启 App 系统通知,并在锁屏或通知中心至少选择一种显示位置,单独选择横幅无法运行。少数派用十个案例演示了重要消息着重提醒、自定义图标保留角标、不同联系人铃声、英文通知翻译和自动记账等用法。

  3. 开源中国22

    SmartCall v1.0.7 发布,新增模型以及音色管理

    SmartCall v1.0.7 发布,新增模型以及音色管理。SmartCall 是一套基于 AI 大模型 + Asterisk 通信引擎构建的智能客服呼叫中心系统,融合 AI 语音机器人、智能 IVR 流程编排、端到端双工对话模型、实时语音识别(ASR)、语音合成(TTS)与大模型意图识别等能力,提供从呼入智能应答到智能外呼的全链路 AI 客服解决方案。

  4. Solidot60

    UNICAMP 研究:AI 聊天机器人会迎合用户政治倾向,成为意识形态回音室

    巴西国立坎皮纳斯州立大学研究人员测试 21 个模型对 112 项政治陈述的判断,发现模型会随提示中的政治倾向改变回答,被形容为意识形态变色龙。在不提供用户倾向时,21 个模型中有 20 个答案落在研究人员设定的政治坐标系左侧,Grok 4.1 是唯一落在右侧的模型。

10月3日周六
9月30日周三
9月18日周五
  1. 阮一峰的网络日志30

    科技爱好者周刊(第 413 期):再见了,React Native

    Shopify 宣布放弃 React Native,改用 Swift 和 Kotlin 开发移动版客户端,转向原生语言。六年前它曾高调从原生转向 React Native,如今因 AI 可便捷翻译语言、且 React Native 自 2015 年发布以来基本技术问题未解决而改回原生。联合国投票决定废除墨卡托投影,建议改用平等地球投影法绘制世界地图。

9月11日周五
  1. 阮一峰的网络日志26

    科技爱好者周刊(第 412 期):禁止 issue,只用 PR

    Laravel 框架宣布新规定,禁止提交 issue,只能提交 Pull Request,理由是 PR 能过滤垃圾提交、给维护者更多信息,且 AI 时代提交 PR 几乎和提交 issue 一样简单。Anthropic 用 Claude AI 耗时 11 天,将安德鲁·怀尔斯 129 页的费马大定理证明翻译成 Lean 语言程序,代码长达 1300 万行,已公布在 GitHub。

9月4日周五