手写 Claude Code 复刻:Anthropic 并行 tool_result 回喂为何 400
手写 Claude Code 复刻项目 codeAgent 在并行工具调用回喂时踩坑:按 OpenAI 习惯逐条回喂 tool 结果,切到 Anthropic 端点直接 400,因为 Anthropic 要求所有 tool_result 装在同一条 user 消息里且不允许两条 user 消息相邻。
手写 Claude Code 复刻项目 codeAgent 在并行工具调用回喂时踩坑:按 OpenAI 习惯逐条回喂 tool 结果,切到 Anthropic 端点直接 400,因为 Anthropic 要求所有 tool_result 装在同一条 user 消息里且不允许两条 user 消息相邻。
dots 是一个 3 天斩获 2.4K Star 的 Web AI Agent 项目,核心卖点是对 Firefox 引擎做 C++ 源码补丁,使指纹在引擎层生成而非 JS 注入,从而规避反爬检测。
XiaoMate(小美同学)新增 screen_capture MCP 工具,通过 mss 截取全屏并调用 OpenAI 兼容的 Vision 模型分析屏幕内容,让语音助手获得视觉感知能力。该工具支持 Windows/macOS/Linux 与多显示器,采用 asyncio 异步非阻塞调用,可应用于网购比价、快递单号识别、体检报告解读等场景,目前仅支持全屏截图,暂不支持指定区域。
作者开源了一个 MCP server,让 Claude Desktop、Cursor、Cline 等 MCP 宿主里的 AI 以可见形象进入其浏览器多人 3D 世界,真人可在 30m 内看到 AI 走动、说话并与之对话。
LangChain Agent 开发中可用五种方式定义工具:@tool 基础装饰器、@tool 加 parse_docstring、StructuredTool、继承 BaseTool 以及 Runnable 转 Tool,分别对应快速原型、多参数规范工具、存量函数复用、生产复杂工具和已有 Runnable 链路复用。
gstack 是一个开源工具集,通过 23 个结构化 AI 角色把 Claude Code 转化为虚拟工程团队,覆盖产品设计到部署的全流程。
Agency Agents 是一套支持多平台、跨工具安装的 AI 智能体协作系统,包含 230 余个专业化角色,覆盖工程、营销、销售、运营等 8 大部门。它提供针对 Claude Code、Cursor、GitHub Copilot、Gemini CLI、OpenCode、Kimi Code 等 14 种 AI 编码助手的安装脚本,可通过一行命令部署并交互式选择工具与代理群组。
Agent-Reach 是一个开源项目,作为能力层替 agent 选型、安装和体检各平台读取工具,官方列出网页、X、Reddit、YouTube、B 站、小红书等 16 个平台,今年 2 月在 GitHub 建仓,现接近 9 万星。
MIT 开源的 Windows AI 编程工作台 Termexo 发布 v0.10.10,将终端、任务和部分设置开放为 19 个本地 MCP 工具。新版支持在 Termexo 新启动的 Claude Code、Codex、OpenCode、Grok Build 和 Antigravity 终端中自动添加连接,Agent 可查询工作区和终端。
独立研究者 Syed Anas Mohiuddin 测试了 Google、摩根大通、Weaviate、Rapid7、法国政府跨部门数字局和美国联邦政府的智能体,发现 MCP(Model Context Protocol)存在信任缺口,可被利用实施提示注入。
TikTok 宣布推出 AI 购物助手 Shopping Assistant 和应用内一键结账功能,用户可直接在 For You 信息流中向品牌下单。该助手是对话式 AI 智能体,能理解上下文、记住用户偏好,并提供商品详情、物流、尺码、库存等实时购物指引。
Amazon SageMaker AI 通过 Agent Toolkit for AWS 推出 aws-ai-ml 技能,让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体具备推理优化与基准测试能力,可对端点做基准测试、推荐部署配置、对比性能并生成可执行的 SageMaker Python SDK v3 代码。
Amazon Quick 的 Quick Resource Migrator 是一个托管在 Amazon Bedrock AgentCore 上的示例 MCP 服务器,可通过单次工具调用把 chat agents、action connectors、knowledge bases、flows 和 spaces 从开发账户迁移到生产 AWS 账户。
Amazon Bedrock AgentCore Evaluations 支持内置与自定义评估器,可衡量多智能体系统的准确性、任务成功率与行为表现,并将可解释性作为一等评估维度。
marketingskills 是一套面向 Claude Code、OpenAI Codex、Cursor 等支持 Agent Skills 规范工具的开源营销技能库,涵盖 CRO、文案、SEO 与增长工程等 50 多个技能。
Cloudflare 发布 Web Search API 测试版,让 AI 智能体和应用搜索互联网,用实时信息支撑回答,而不是猜测 URL 或受限于模型训练截止时间。
开源项目 workbuddy-to-dsh 通过只监听 127.0.0.1 的本地桥,把本机 WorkBuddy 桌面端已登录的模型能力暴露成 OpenAI 兼容接口,任何支持自定义 Base URL 的客户端都能直接调用。
针对长程工具调用中结果奖励难以做信用分配的问题,研究者提出 Comparative Inference for Tool-use Agents(CITA),训练 Comparative Inference Model(CIM),用贝叶斯工具图模拟器与 LLM 比较判断生成的配对信号,估计候选下一步工具调用对任务成功的价值。
AWS 提出 Adjudicated Query 设计模式,让业务用户在 Amazon Quick 聊天界面提问合规问题,实际判定交由确定性(非 AI)规则引擎完成。
通过 Amazon Bedrock AgentCore Gateway,可将 Claude Desktop 接入由 Amazon 网页索引支持的 Web Search,覆盖数百亿文档,查询流量全程留在 AWS 内、无需外部 API key。
Earendil 旗下 Pi 发布 1.0 版本,新增对 MCP、Jev 和图像模型的原生支持、虚拟模型扩展、延迟工具加载、Anthropic 模型缓存预热、对话中途系统消息、新 TUI 主题以及默认全屏模式。
2Do 于今年 8 月推出全新重构版本,换上现代化界面并加入原生多窗口、自然语言识别与全维度跨维度 OR 过滤等能力。同步引擎从底层重写,带来原生 iCloud 同步与 Apple 提醒事项双向同步,并预告 WebDAV 支持。定价为 iOS 9.99 美元、iPadOS 19.99 美元买断,macOS 49.99 美元终身许可证含 18 个月功能更新,续订价 39.99 美元/18 个月。
一位作者用小红书 AI 搜索助手「点点」加本地 Agent(如 ZCode、Claude Code、Workbuddy)完成国庆七天山西至河南自驾攻略,先由人定主线,再让 Agent 微调细化。他把最终攻略转成单文件 HTML 发进家庭群,手机离线也能打开,并用高德地图「地图小程序」标注景点、酒店与美食生成路线。文中还提到智谱 GLM-5.3-Flash 可识别景区票价牌截图并提取信息。
GitHub Copilot 应用中的 canvas 是一种可自定义的共享界面,用户只需在 agent 会话中输入 /create-canvas 并用自然语言描述需求,即可生成看板、发布清单或仪表盘等工具,无需编写代码。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,智能体就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 公开了自主模糊测试流水线的架构与运行方式,读者可了解 LLM 智能体如何接管覆盖率反馈与崩溃分诊。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者为智能体提供连接工具和数据的标准接口;RAG 也并未消亡,它让模型基于训练数据之外的信息作答,减少 token 浪费并降低答案不完整的概率。