跳到正文
10月5日周一
  1. Solidot66

    因涌入大量 AI 报告,Google 冻结 OSS VRP 漏洞悬赏计划

    Google 宣布因涌入大量无效的 AI bug 报告,冻结其开源软件漏洞悬赏计划 OSS VRP,该决定于 10 月 1 日生效。Google 承诺将在 2027 年第一季度提供相关更新,期间对项目进行调整,并鼓励参与者转向其它 bug 奖励计划。大模型与漏洞搜寻自动化脚本的流行导致大量低质量报告涌入,维护者需耗费大量时间验证无效报告,无法专注修复真正重要的漏洞,整个行业都面临同样问题。

  2. 掘金22

    独立开发者的"富矿地带":哪些垂直领域值得押注一辈子?

    独立开发者应放弃通用型SaaS红海,转向"无聊"但刚需的工具型产品、创作者经济周边工具、AI驱动的垂直SaaS等方向。一位开发者靠精细化运营在饱和细分市场把MRR做到2.1万美元,验证了垂直深耕的可行性。筛选标准包括用户是否已为类似问题付费、行业是否有稳定预算、竞品是否只做了70%功能。

  3. MIT Technology Review · AI10

    从预测到自主决策:预测分析如何进入智能体 AI 时代

    企业 AI 的焦点已从预测模型能否超越统计预测转向让预测系统自主决策而不偏离业务意图。深度学习与生成式 AI 驱动的智能分析支持实时训练,使 AI 持续演进而非等待季度刷新,其数据来源也从规整数值记录扩展到非结构化交互数据。Everest Group 合伙人 Vishal Gupta 称,"analytics"一词正让位于 AI。

  4. 掘金22

    315 之后 AI 改规矩了:怎么让豆包和 DeepSeek 认得出你

    315 AI 投毒风波后,豆包、DeepSeek、元宝、讯飞星火改信源规则,不再只认单一自媒体平台,改为政府网站、行业垂直网站、带 ICP 备案的官网交叉验证,信源不足直接判定投毒,严重者品牌封杀。这套让 AI 在回答中引用到你的做法叫 GEO,但单价 50 元以下的商品意义有限,高客单价、决策慎重的生意更适用。

  5. The Verge · AI50

    OpenAI 将在 ChatGPT 中测试图片广告

    OpenAI 将于本月晚些时候在美国开始测试 ChatGPT 图片广告,赞助商品的图片会出现在生成图像旁,但不会影响 ChatGPT 给出的回答。该视觉广告格式初期面向一组广告主开放,Plus、Pro 和 Enterprise 订阅用户不会看到广告。ChatGPT 今年 2 月已上线仅含公司名称、logo 和链接的文字赞助内容。

  6. NVIDIA Blog22

    NVIDIA Inception 初创公司如何用 AI 补齐乳腺癌诊疗缺口

    NVIDIA Inception 计划中的多家初创公司正用 AI 补齐乳腺癌诊疗缺口:iSono Health 的 FDA 获批 ATUSA 可穿戴 3D 超声系统约两分钟完成单侧乳房标准化扫描,公司称灵敏度比手持 2D 超声高 28%;Whiterabbit.ai 的 FDA 获批 WRDensity 已用于数十万患者,并研发可自动筛除阴性乳腺钼靶的新一代 AI。

  7. Hacker News26

    德国 RobCo 估值达 10 亿美元

    德国机器人公司 RobCo 估值达到 10 亿美元,跻身独角兽行列。该消息在 Hacker News 上引发 314 点热度、291 条评论讨论。

  8. 掘金17

    机器人越来越多以后,谁来把它们组织起来?

    当工厂里机器人从几十台增至几百台,生产能力并不会自动翻倍,核心问题从"单台机器人能做什么"变成"如何把分散能力组织成整体"。文章提出AI负责理解与判断、系统负责组织与调度、机器人负责落地执行,三者连接才构成完整的机器生产能力,系统让机器人围绕同一生产目标形成可运行的整体。

  9. 掘金62

    Agentic RAG 三种架构对比:检索自纠错、CRAG 与 Self-RAG

    文章对比 Agentic RAG 的三种架构演进形态:基础检索自纠错(本地循环重搜)、标准 CRAG(双阈值打分加联网兜底与句子级去噪)和带回环的 Self-RAG(前置门控加本地与网络两段式加质检回环)。文中给出三者的状态流转逻辑、核心实现代码与生产避坑指南,并建议将 CRAG 作为企业主力架构,仅在法律、医疗等场景开启带计数器的 Self-RAG 质检回环。

  10. MIT Technology Review · AI24

    人们一边痛恨 AI,一边为什么又离不开它?

    调查显示美国成年人中认为 AI 会带来负面影响的比例已超过正面预期,71% 反对在本地新建 AI 数据中心,但 ChatGPT 在 5 月月活用户突破 10 亿,Gemini 7 月达 9.5 亿,半数美国成年人已在用聊天机器人。作者认为,人们反感的并非技术本身,而是科技公司无孔不入的推销方式。

  11. Hacker News52

    华为与高通宣布广泛专利许可协议

    华为与高通宣布达成一项多年期广泛专利许可协议,包含双方在 5G、计算、AI 和网络等技术领域的专利组合交叉授权,以及高通购买华为在计算、AI、网络等领域的部分美国专利。该交易将在获得必要监管批准后完成,双方表示协议符合 FRAND 原则。

  12. arXiv stat.ML22

    ENCORE:用副本交换实现扩散生成精确非平衡控制

    研究者提出 ENCORE,首个精确的并行推理时控制方法,通过让每个副本存储生成轨迹,将向上移动变为截断,从而避免模拟难以处理的逆时间过程。该方法证明了目标不变性,并在合成目标、生物分子玻尔兹曼采样和图像生成中取得有竞争力的精度与多样性,还能应用于现有 RE 校正无法处理的蒸馏采样器。

  13. arXiv stat.ML12

    Expected Utility Regret 规则:投资组合选择的 Minimax 与 Bayes 最优解

    研究提出 Expected Utility Regret(EUR)规则,可同时选择投资组合类别并估计其权重,在正则参数化收益模型中,单一 EUR 规则无需先验分布即可同时达到 minimax 与 Bayes 下界(含主常数项)。均值—方差组合与风险平价组合被推导为该框架的特例;当收益除以波动率的联合分布与资产顺序无关时,EUR 规则与风险平价组合一致。

  14. arXiv cs.AI24

    用程序精化与 LLM 智能体发现认知算法

    研究者提出一种混合系统,将认知算法发现视为程序精化问题:人类构建的认知模型以概率程序形式交给一组 LLM 智能体,由其识别模型与行为的不匹配、在研究者设定的约束内提出代码级修改并验证结构保真度,修改结果再传入概率推理模块完成隐变量推理与数据似然计算。在暴露多种认知算法的问题解决范式人类行为数据上,修订后的模型拟合度持续优于原始模型,并揭示出一小组反复出现的创新。

  15. arXiv cs.LG24

    自适应批处理为何有助于 LLM 预训练?无界方差视角下的解释

    研究提出广义 BG-a 噪声模型,在方差有界(a=0)与 BG-0 噪声(a=2)之间插值,并推导出增长相关的信息论下界 Ω(ε^-(4+a)) 及匹配上界。基于此设计的自适应批调度器在 C4 上预训练最高 1B 参数的 OLMo2 模型,在相同 token 预算下验证损失低于固定小批量与大批量训练,且迭代次数不到小批量训练的 10%。