跳到正文
今天10月6日周二8 条
  1. Simon Willison62

    Anthropic 的 Cowork 将模型推理与 VM 迁移至云端

    Anthropic 的 Felix Rieseberg 表示,新版 Cowork 将模型推理和 VM 都放到云端运行,每个会话拥有独立沙箱、不与其他会话共享状态。旧版在云端做模型推理、但把 Anthropic 提供的 VM 装到用户电脑上执行工具调用,用户不满其磁盘、电池和性能开销,以及合上笔记本就中断工作。当 VM 需要访问用户设备上的文件时,由桌面应用负责该文件访问的工具调用。

  2. Hacker News22

    用 Claude Code 一小时做出域名查询工具 heade.rs:当工具不必自负盈亏

    开发者用 Claude Code 分三次提示词、约一小时做出域名查询工具 heade.rs,并部署到 Cloudflare,可查 DNS 与注册记录、实时延迟、邮件配置和 HTTPS 详情,每月运行成本不到一杯咖啡。作者认为 LLM 让小型工具不再需要自负盈亏,受众可以只有一个人,但这类产品也更难在搜索结果中排名。

  3. The Verge · AI58

    AI 攻占数学界引发的争议与反弹

    过去一年,OpenAI、Anthropic 等实验室宣布在多个长期数学难题上取得突破,部分成果超出研究者对现有系统能力的预期,其中包括解决一个著名的千禧年大奖难题。这些本应被庆祝的结果却引发学界反弹,AI 实验室表示正在从早期错误中吸取教训,但承诺能否兑现尚待观察。

  4. TechCrunch · AI36

    特朗普把 AI 改称"超级智能",科技巨头签署不具约束力的安全承诺

    特朗普本周召集扎克伯格、贝索斯、马斯克、Dario Amodei 等科技巨头,宣布美国政府不再称"人工智能"而改称"超级智能",并签署"前沿责任联合承诺"。该承诺被指"完全不具法律约束力",特朗普称其"道德上有约束力",协议文本还把 United States 拼错。与会者认为这场会议实质是一次围绕 AI 的品牌重塑。

10月5日周一
10月4日周日
10月3日周六
10月2日周五
9月30日周三
  1. 开源中国78

    Anthropic 红队评估 GLM-5.3:攻击能力追平 Mythos,拒绝护栏缺失

    Anthropic 前沿红队评估智谱 GLM-5.3,认为它是首个能像五个月前 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎未设拒绝护栏就放出的模型。五个月前 Anthropic 发布 Claude Mythos Preview 时,曾称其是首个能自主构建复杂端到端漏洞利用的 AI 模型。

    推荐理由:Anthropic 红队对 GLM-5.3 的评估显示其攻击能力接近 Claude Mythos Preview,但护栏缺失,可对照两份模型的安全策略差异。

9月29日周二
  1. 开源中国82

    Anthropic 发布 Claude Sonnet 5.5:速度提升 30%,Agent 编程评测从 10% 升至 70%

    Anthropic 发布 Claude 5.5 家族第二个成员 Sonnet 5.5,定位为 Opus 5.5 的快而省互补款,主打高频日常任务、修 bug、文档和表格。官方称其比 Sonnet 5 速度快 30% 以上、多数任务成本低 30%,Agent 编程评测成绩从 10% 提升到 70%。

    推荐理由:Anthropic 新模型在 Agent 编程评测上的大幅提升,为关注编码智能体选型的人提供了对比依据。

9月11日周五