TechCrunch Disrupt 2026 公布 Startup Battlefield 200 决赛评委名单
TechCrunch Disrupt 2026 公布 Startup Battlefield 决赛五位评委,均为其所在投资机构的创始人或联合创始人,将于 10 月 13 日至 15 日从 200 家入围初创中评出最终冠军。
TechCrunch Disrupt 2026 公布 Startup Battlefield 决赛五位评委,均为其所在投资机构的创始人或联合创始人,将于 10 月 13 日至 15 日从 200 家入围初创中评出最终冠军。
Google 宣布因涌入大量无效的 AI bug 报告,冻结其开源软件漏洞悬赏计划 OSS VRP,该决定于 10 月 1 日生效。Google 承诺将在 2027 年第一季度提供相关更新,期间对项目进行调整,并鼓励参与者转向其它 bug 奖励计划。大模型与漏洞搜寻自动化脚本的流行导致大量低质量报告涌入,维护者需耗费大量时间验证无效报告,无法专注修复真正重要的漏洞,整个行业都面临同样问题。
作者用 Claude Code 的多代理工作流(模型 Opus 5.5),仅凭一段未修改的需求、不使用任何外部素材,做出了浏览器端第三人称 3D 动作解谜游戏《云海神殿》,含五个章节和一个 Boss。
Aleph Alpha 发布德英双语模型 Kolibri,总参数 78B,采用混合专家架构,每个 token 约激活 3B 参数。
TechCrunch Disrupt 2026 将于 10 月 13 日至 15 日在旧金山 Moscone West 举行,Disrupt Stage 完整阵容公布。
开源命令行工具 RemoveMacAI 能一键关闭 Apple Intelligence 的 Siri、Writing Tools、Genmoji、Image Playground、ChatGPT 扩展及各类摘要功能,删除其基础模型并阻止 macOS 重新下载。
挪威希望对可录制旁人的 AI 眼镜争取时间以制定永久性规则,这成为 AI 眼镜面临的首个重大政府监管行动。
独立开发者应放弃通用型SaaS红海,转向"无聊"但刚需的工具型产品、创作者经济周边工具、AI驱动的垂直SaaS等方向。一位开发者靠精细化运营在饱和细分市场把MRR做到2.1万美元,验证了垂直深耕的可行性。筛选标准包括用户是否已为类似问题付费、行业是否有稳定预算、竞品是否只做了70%功能。
企业 AI 的焦点已从预测模型能否超越统计预测转向让预测系统自主决策而不偏离业务意图。深度学习与生成式 AI 驱动的智能分析支持实时训练,使 AI 持续演进而非等待季度刷新,其数据来源也从规整数值记录扩展到非结构化交互数据。Everest Group 合伙人 Vishal Gupta 称,"analytics"一词正让位于 AI。
315 AI 投毒风波后,豆包、DeepSeek、元宝、讯飞星火改信源规则,不再只认单一自媒体平台,改为政府网站、行业垂直网站、带 ICP 备案的官网交叉验证,信源不足直接判定投毒,严重者品牌封杀。这套让 AI 在回答中引用到你的做法叫 GEO,但单价 50 元以下的商品意义有限,高客单价、决策慎重的生意更适用。
OpenAI 将于本月晚些时候在美国开始测试 ChatGPT 图片广告,赞助商品的图片会出现在生成图像旁,但不会影响 ChatGPT 给出的回答。该视觉广告格式初期面向一组广告主开放,Plus、Pro 和 Enterprise 订阅用户不会看到广告。ChatGPT 今年 2 月已上线仅含公司名称、logo 和链接的文字赞助内容。
NVIDIA Inception 计划中的多家初创公司正用 AI 补齐乳腺癌诊疗缺口:iSono Health 的 FDA 获批 ATUSA 可穿戴 3D 超声系统约两分钟完成单侧乳房标准化扫描,公司称灵敏度比手持 2D 超声高 28%;Whiterabbit.ai 的 FDA 获批 WRDensity 已用于数十万患者,并研发可自动筛除阴性乳腺钼靶的新一代 AI。
JavaManus 是一个纯 Java 实现的 ReAct Agent 框架,基于 Spring AI 1.1.0 和 Spring Boot 3.4,默认接入火山引擎 Ark(豆包),整体不到 30 个 Java 文件。
OpenAI 将在美国 ChatGPT 的图像生成加载页测试展示广告,广告以轮播或产品图排列形式出现在生成图像下方,并标注为广告、与生成图像分开。该测试本月晚些时候启动,首批为部分广告主。
卡内基梅隆大学 Safe AI 实验室主任 Ding Zhao 联合创立 Safeworld,用搭载真实人体模型的仿真环境评估生成式 AI 驱动的机器人控制系统。
LangChain 通过 BaseCallbackHandler 钩子接口实现可观测,框架在链、模型、工具的关键节点自动调用 handler,BaseCallbackManager 负责将事件广播给多个 handler,tracers 则将事件收敛为可回放的 Run 树。
开发者发布小说转漫画 skill(github.com/aiskyhub/no…),为 Codex 安排从读原文、写分镜到排版导出的完整制作顺序,并让程序按字体排入审过的对白、由生图模型专责画面,避免重绘改字。
LangChain 用 BaseChatMessageHistory 把对话历史建模成可增删改查的对象,其内存实现 InMemoryChatMessageHistory 将消息存在 Python 列表里,进程重启即丢失,持久化需自行继承实现。
MIT 于 2026 年 6 月发布的报告指出,AI 正在削弱大学体验的核心环节:到办公室答疑的学生减少、线上讨论参与度下降、宿舍和图书馆的学习小组变少,教师也越来越难判断学生真正学到了什么。
marketingskills 是一套面向 Claude Code、OpenAI Codex、Cursor 等支持 Agent Skills 规范工具的开源营销技能库,涵盖 CRO、文案、SEO 与增长工程等 50 多个技能。
michael-denyer 的 pstack-claude 项目将 Lauren Tan 在 Cursor 上构建的技能栈移植到 Claude Code、Codex、Pi 等代理框架,通过基础原语翻译机制保持跨框架语义一致。
gstack 是 Garry Tan 发布的开源项目,将 Claude Code、OpenAI Codex 等模型能力封装为 23 个专家角色,通过 8 个核心命令覆盖从产品构思、架构设计、代码生成到测试部署的端到端流程。
德国机器人公司 RobCo 估值达到 10 亿美元,跻身独角兽行列。该消息在 Hacker News 上引发 314 点热度、291 条评论讨论。
Cloudflare 发布 Web Search API 测试版,让 AI 智能体和应用搜索互联网,用实时信息支撑回答,而不是猜测 URL 或受限于模型训练截止时间。
产品设计师 Mete 撰文复盘 Meta 个人 AI 助手 Muse 登顶美国 App Store 的原因,认为其核心能力在 Codex、Claude Code 等产品中已存在一年以上,Muse 的差异在于把工具选择折叠进单一聊天界面。
当工厂里机器人从几十台增至几百台,生产能力并不会自动翻倍,核心问题从"单台机器人能做什么"变成"如何把分散能力组织成整体"。文章提出AI负责理解与判断、系统负责组织与调度、机器人负责落地执行,三者连接才构成完整的机器生产能力,系统让机器人围绕同一生产目标形成可运行的整体。
神经科学家 Paul Cisek 提出,大脑并非图灵机式的信息处理器,而是随进化层层叠加的反馈控制系统,从鱼类到人类不断把控制延伸到外部世界。作者 Benjamin Riley 据此认为,AI 更像认知层面的垃圾食品,迎合当下却侵蚀人类数千年演化出的认知系统。
OpenAI 在 ChatGPT 中引入新的视觉广告形式,并扩展了面向广告主的衡量工具、归因合作与品牌适配能力。此次更新针对人们使用 AI 的方式设计广告,同时强化广告效果的可衡量性与品牌安全性。
文章对比 Agentic RAG 的三种架构演进形态:基础检索自纠错(本地循环重搜)、标准 CRAG(双阈值打分加联网兜底与句子级去噪)和带回环的 Self-RAG(前置门控加本地与网络两段式加质检回环)。文中给出三者的状态流转逻辑、核心实现代码与生产避坑指南,并建议将 CRAG 作为企业主力架构,仅在法律、医疗等场景开启带计数器的 Self-RAG 质检回环。
掘金「deepseek实战」第 28 期用造物台四轮对话、约 186 积分做出倒计时看板,可同屏盯多个事件,每个事件一个环形进度并按秒刷新,支持按天/按小时全局切换。
开源项目 workbuddy-to-dsh 通过只监听 127.0.0.1 的本地桥,把本机 WorkBuddy 桌面端已登录的模型能力暴露成 OpenAI 兼容接口,任何支持自定义 Base URL 的客户端都能直接调用。
纯向量检索在专有名词、数字版本号、代码命令等精确匹配场景下召回率往往只有 60-70%,需要 Hybrid Search 即向量检索加 BM25 关键词检索互补。
调查显示美国成年人中认为 AI 会带来负面影响的比例已超过正面预期,71% 反对在本地新建 AI 数据中心,但 ChatGPT 在 5 月月活用户突破 10 亿,Gemini 7 月达 9.5 亿,半数美国成年人已在用聊天机器人。作者认为,人们反感的并非技术本身,而是科技公司无孔不入的推销方式。
华为与高通宣布达成一项多年期广泛专利许可协议,包含双方在 5G、计算、AI 和网络等技术领域的专利组合交叉授权,以及高通购买华为在计算、AI、网络等领域的部分美国专利。该交易将在获得必要监管批准后完成,双方表示协议符合 FRAND 原则。
据 TechSpot 报道,一名佛罗里达女子使用 Claude 记录日记,Anthropic 将该日记内容报告给警方,该女子因此面临重罪指控。Hacker News 上该帖获得 731 分、563 条评论。
Hinton、Bengio等22位作者发表论文《What if automating AI R&D triggers an intelligence explosion?
研究者提出 ENCORE,首个精确的并行推理时控制方法,通过让每个副本存储生成轨迹,将向上移动变为截断,从而避免模拟难以处理的逆时间过程。该方法证明了目标不变性,并在合成目标、生物分子玻尔兹曼采样和图像生成中取得有竞争力的精度与多样性,还能应用于现有 RE 校正无法处理的蒸馏采样器。
研究提出 Expected Utility Regret(EUR)规则,可同时选择投资组合类别并估计其权重,在正则参数化收益模型中,单一 EUR 规则无需先验分布即可同时达到 minimax 与 Bayes 下界(含主常数项)。均值—方差组合与风险平价组合被推导为该框架的特例;当收益除以波动率的联合分布与资产顺序无关时,EUR 规则与风险平价组合一致。
研究者提出一种混合系统,将认知算法发现视为程序精化问题:人类构建的认知模型以概率程序形式交给一组 LLM 智能体,由其识别模型与行为的不匹配、在研究者设定的约束内提出代码级修改并验证结构保真度,修改结果再传入概率推理模块完成隐变量推理与数据似然计算。在暴露多种认知算法的问题解决范式人类行为数据上,修订后的模型拟合度持续优于原始模型,并揭示出一小组反复出现的创新。
研究提出广义 BG-a 噪声模型,在方差有界(a=0)与 BG-0 噪声(a=2)之间插值,并推导出增长相关的信息论下界 Ω(ε^-(4+a)) 及匹配上界。基于此设计的自适应批调度器在 C4 上预训练最高 1B 参数的 OLMo2 模型,在相同 token 预算下验证损失低于固定小批量与大批量训练,且迭代次数不到小批量训练的 10%。