AI Skill(技能)从入门到评测:一个"会议纪要小秘书"的诞生记
一个示例工程拆解了 AI Skill 的完整落地路径:把会议纪要生成固化为 SKILL.md,靠 YAML 头部的 name 和 description 决定技能是否被触发,正文写工作流程与输出模板。
一个示例工程拆解了 AI Skill 的完整落地路径:把会议纪要生成固化为 SKILL.md,靠 YAML 头部的 name 和 description 决定技能是否被触发,正文写工作流程与输出模板。
Anthropic 的 Felix Rieseberg 表示,新版 Cowork 将模型推理和 VM 都放到云端运行,每个会话拥有独立沙箱、不与其他会话共享状态。旧版在云端做模型推理、但把 Anthropic 提供的 VM 装到用户电脑上执行工具调用,用户不满其磁盘、电池和性能开销,以及合上笔记本就中断工作。当 VM 需要访问用户设备上的文件时,由桌面应用负责该文件访问的工具调用。
开发者用 Claude Code 分三次提示词、约一小时做出域名查询工具 heade.rs,并部署到 Cloudflare,可查 DNS 与注册记录、实时延迟、邮件配置和 HTTPS 详情,每月运行成本不到一杯咖啡。作者认为 LLM 让小型工具不再需要自负盈亏,受众可以只有一个人,但这类产品也更难在搜索结果中排名。
过去一年,OpenAI、Anthropic 等实验室宣布在多个长期数学难题上取得突破,部分成果超出研究者对现有系统能力的预期,其中包括解决一个著名的千禧年大奖难题。这些本应被庆祝的结果却引发学界反弹,AI 实验室表示正在从早期错误中吸取教训,但承诺能否兑现尚待观察。
Meta 和 Microsoft 大幅削减内部对 Claude 的使用。Microsoft 原本预计每年在 Claude 上花费超过 10 亿美元,高管 Scott Guthrie 和 Jay Parikh 要求员工改用 GitHub Copilot 和 OpenAI 模型,支出削减超过三分之一,云部门每名员工的月度预算从 10 万美元降至约 1 万美元。
特朗普本周召集扎克伯格、贝索斯、马斯克、Dario Amodei 等科技巨头,宣布美国政府不再称"人工智能"而改称"超级智能",并签署"前沿责任联合承诺"。该承诺被指"完全不具法律约束力",特朗普称其"道德上有约束力",协议文本还把 United States 拼错。与会者认为这场会议实质是一次围绕 AI 的品牌重塑。
Anthropic 的 Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Sonnet 5 已上线 AWS GovCloud (US) 区域的 Amazon Bedrock。
据 The Information 获得的 Anthropic 向潜在投资者提供的文件,Anthropic 允许员工向慈善机构捐赠股份,并用公司股份按比例追加,早期员工可获得其捐赠价值三倍的配捐。
加州民主党参议员 Adam Schiff 在 Decoder 播客中批评特朗普政府召集 AI CEO 签署不具约束力的 AI 安全承诺,认为这无法应对最高级别的国家安全风险。他支持设立新的 AI 监管机构,并提到 Anthropic 因拒绝将 AI 用于国内大规模监控和全自主武器系统而遭政府打压。
作者用 Claude Code 的多代理工作流(模型 Opus 5.5),仅凭一段未修改的需求、不使用任何外部素材,做出了浏览器端第三人称 3D 动作解谜游戏《云海神殿》,含五个章节和一个 Boss。
神经科学家 Paul Cisek 提出,大脑并非图灵机式的信息处理器,而是随进化层层叠加的反馈控制系统,从鱼类到人类不断把控制延伸到外部世界。作者 Benjamin Riley 据此认为,AI 更像认知层面的垃圾食品,迎合当下却侵蚀人类数千年演化出的认知系统。
TechSpot 报道称,Anthropic 将一名佛罗里达女子在 Claude 中记录的日记内容报告给警方,该女子因此面临重罪指控。Hacker News 上该帖获得 417 分、342 条评论。
Hinton、Bengio等22位作者发表论文《What if automating AI R&D triggers an intelligence explosion?
量子位访谈了六位 FDE(前线部署工程师)从业者,发现他们的工作内容差异很大:有人驻场梳理企业 Ontology,有人基本不驻场只做线上技术对接,也有独立开发者一人接单做企业 AI 改造。
Latent Space 的 AINews 汇总了 10 月 1 日至 2 日的 AI 动态:OpenAI 发布 GPT-6.1 Sol,定价为每百万输入/输出 token 2 美元和 10 美元。
通过 Amazon Bedrock AgentCore Gateway,可将 Claude Desktop 接入由 Amazon 网页索引支持的 Web Search,覆盖数百亿文档,查询流量全程留在 AWS 内、无需外部 API key。
Anthropic 前沿红队评估智谱 GLM-5.3,认为它是首个能像五个月前 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎未设拒绝护栏就放出的模型。五个月前 Anthropic 发布 Claude Mythos Preview 时,曾称其是首个能自主构建复杂端到端漏洞利用的 AI 模型。
推荐理由:Anthropic 红队对 GLM-5.3 的评估显示其攻击能力接近 Claude Mythos Preview,但护栏缺失,可对照两份模型的安全策略差异。
OpenAI 在 DevDay 2026 上发布 Dots 常驻智能体、GPT-6.1 Sol、Ultrafast 模式、Decisions API、ChatGPT Spaces 与 Marketplace,并称 ChatGPT 周活达 12 亿。
推荐理由:汇总了 DevDay 2026 的发布清单与第三方评测数据,可对照价格、基准与套餐变化判断实际取舍。
Anthropic 前沿红队在内部 Binary Exploitation 基准上随机选取 100 个任务评测多个模型,GLM-5.3 在 4% 的试验中实现了完整的控制流劫持,Claude Mythos Preview 为 6%。
Anthropic 发布 Claude 5.5 家族第二个成员 Sonnet 5.5,定位为 Opus 5.5 的快而省互补款,主打高频日常任务、修 bug、文档和表格。官方称其比 Sonnet 5 速度快 30% 以上、多数任务成本低 30%,Agent 编程评测成绩从 10% 提升到 70%。
推荐理由:Anthropic 新模型在 Agent 编程评测上的大幅提升,为关注编码智能体选型的人提供了对比依据。
Laravel 框架宣布新规定,禁止用户提交 issue,只能提交 Pull Request,理由是 PR 能过滤垃圾反馈、给维护者更多信息,且 AI 时代让用户借 AI 生成 PR 几乎和提 issue 一样简单。