LangChain 实战:用 Runnable 串起检索、记忆、工具调用与流式的客服助手
一篇 LangChain 教程把检索、记忆、工具调用、流式输出和回调可观测五个零件,用 Runnable 和竖线 `|` 拼成一个可运行的电商客服助手,并用免 key 脚本完整跑通。
一篇 LangChain 教程把检索、记忆、工具调用、流式输出和回调可观测五个零件,用 Runnable 和竖线 `|` 拼成一个可运行的电商客服助手,并用免 key 脚本完整跑通。
一篇观点文章认为,在 LLM 能快速写代码之后,Common Lisp 因读写期、编译期与运行期无实质区分而成为最佳编程语言:其基于镜像的运行方式可即时替换函数、出错时进入调试器而非崩溃,便于 LLM 修复并继续运行。作者称自己用 Common Lisp 写的应用比 Python 版本短约六到七倍,代码更少意味着 token 更少、更易放进 LLM 上下文窗口。
手写 Claude Code 复刻项目 codeAgent 在并行工具调用回喂时踩坑:按 OpenAI 习惯逐条回喂 tool 结果,切到 Anthropic 端点直接 400,因为 Anthropic 要求所有 tool_result 装在同一条 user 消息里且不允许两条 user 消息相邻。
dots 是一个 3 天斩获 2.4K Star 的 Web AI Agent 项目,核心卖点是对 Firefox 引擎做 C++ 源码补丁,使指纹在引擎层生成而非 JS 注入,从而规避反爬检测。
针对 Agent 流式输出中 Nginx 缓冲截留、多节点 SSE 连接孤岛、事件类型混乱三大生产环境问题,该方案基于 Spring Boot 3 的 SseEmitter 构建会话管理器,配合 Redis Pub/Sub 实现跨集群节点的事件广播。
arXiv 论文 AgentLens 将 1,136 条通过轨迹分为 Ideal(20.2%)、Solid(69.1%)和 Lucky(10.7%)三档,Lucky Pass 在八个模型后端间跨度达 46 倍,而 pass rate 排名与过程质量排名全部不一致。
作者开源了一个 MCP server,让 Claude Desktop、Cursor、Cline 等 MCP 宿主里的 AI 以可见形象进入其浏览器多人 3D 世界,真人可在 30m 内看到 AI 走动、说话并与之对话。
一位不懂编程的物料计划人员用 WorkBuddy(豆包桌面端)通过9轮对话,把每天40分钟的手工导出汇总流程做成双击一次38秒完成的自动化工具,全程未写一行代码。文中给出提需求四层法(目的、步骤、文件与规则、边界与例外)、报错三步法(截图、复制原文、说明操作)和三条底线(先备份、交代禁区、密码别写在聊天里),并附可直接填空的模板。
Cloudflare 于 9 月 28 日发布全新命令行工具 cf,覆盖其接近 3000 项公开 API 操作,并支持用自然语言搜索命令、默认返回 JSON。官方统计显示,2026 年 3 月 AI Agent 已贡献 Wrangler 四分之一使用量,到 cf 发布前一周升至 48%。
文章以 Codex Rust 版 commit 2685e3a4 源码为证据,梳理编程 Agent 的提示词注入面,包括 README、代码注释、测试 fixture、commit/PR 文本、issue 正文、依赖包、MCP 工具返回和 web 搜索结果八个入口。
一个示例工程拆解了 AI Skill 的完整落地路径:把会议纪要生成固化为 SKILL.md,靠 YAML 头部的 name 和 description 决定技能是否被触发,正文写工作流程与输出模板。
LangChain Agent 开发中可用五种方式定义工具:@tool 基础装饰器、@tool 加 parse_docstring、StructuredTool、继承 BaseTool 以及 Runnable 转 Tool,分别对应快速原型、多参数规范工具、存量函数复用、生产复杂工具和已有 Runnable 链路复用。
一份实践思路指出,用 Ollama 等工具在本机部署 AI Agent,可让代码、文档、日志全部留在本地,16GB 内存即可流畅运行 7B 级别量化模型,且开源模型一次部署长期复用、不按次计费。
Anthropic 的 Felix Rieseberg 表示,新版 Cowork 将模型推理和 VM 都放到云端运行,每个会话拥有独立沙箱、不与其他会话共享状态。旧版在云端做模型推理、但把 Anthropic 提供的 VM 装到用户电脑上执行工具调用,用户不满其磁盘、电池和性能开销,以及合上笔记本就中断工作。当 VM 需要访问用户设备上的文件时,由桌面应用负责该文件访问的工具调用。
gstack 是一个开源工具集,通过 23 个结构化 AI 角色把 Claude Code 转化为虚拟工程团队,覆盖产品设计到部署的全流程。
Agency Agents 是一套支持多平台、跨工具安装的 AI 智能体协作系统,包含 230 余个专业化角色,覆盖工程、营销、销售、运营等 8 大部门。它提供针对 Claude Code、Cursor、GitHub Copilot、Gemini CLI、OpenCode、Kimi Code 等 14 种 AI 编码助手的安装脚本,可通过一行命令部署并交互式选择工具与代理群组。
Agency Agents 是一个跨平台桌面应用与脚本套件,可将超过 230 个专业化 AI 智能体安装到 Claude Code、Cursor、GitHub Copilot、Gemini CLI 等主流编程工具中。
Wavestone 四位研究者发布 83 页论文《Harness Engineering》,逐行阅读 Claude Code、Codex CLI、Gemini CLI。
Agent-Reach 是一个开源项目,作为能力层替 agent 选型、安装和体检各平台读取工具,官方列出网页、X、Reddit、YouTube、B 站、小红书等 16 个平台,今年 2 月在 GitHub 建仓,现接近 9 万星。
GitHub 日榜 2026-10-06 显示,Swift 工具 RemoveMacAI 以 24h +1,577 Star 登顶,可关闭 macOS 27 的 Apple Intelligence 并删除其下载模型。
文章围绕多租户 LLM 应用的 Prompt 隔离问题,提出从 Layer 0 平台级 System Prompt 到用户输入的四层 Prompt 架构,并给出 Jinja2 SandboxedEnvironment 渲染。
Google 的 Gemini "Call for Me" 功能可能从商务通话扩展到亲友通话。Android Authority 在 APK 拆解中发现"Gemini Calling"引导页,示例包括"打电话给妈妈,告诉她我会晚到 15 分钟"。该功能预计仍限于类似短信的简短通话,并可能提供细粒度应用权限,让用户选择是否接收 Gemini 的自动来电。
智谱(Z.ai)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码与长周期智能体任务,通过全托管 API 提供跨区域推理、提示词缓存和服务层级,目前面向符合条件的企业客户开放。
推荐理由:原文给出 GLM 5.3 在 Bedrock 上的接入方式与提示词缓存用法,可据此评估自建推理与托管调用的取舍。
Graphical UI 发布,一套面向编码智能体的设计语言,包含颜色、字体、间距、图标、动效等主题资源,以及基于 Base UI 的 React 组件。它通过 shadcn 安装或直接下载,并提供 GUI.md 主题参考和技能文件,让智能体将主题应用到现有界面并指导新界面开发。产品为一次性买断,含主题构建器和基础组件,可在无限项目中使用。
开发者用 Claude Code 分三次提示词、约一小时做出域名查询工具 heade.rs,并部署到 Cloudflare,可查 DNS 与注册记录、实时延迟、邮件配置和 HTTPS 详情,每月运行成本不到一杯咖啡。作者认为 LLM 让小型工具不再需要自负盈亏,受众可以只有一个人,但这类产品也更难在搜索结果中排名。
独立研究者 Syed Anas Mohiuddin 测试了 Google、摩根大通、Weaviate、Rapid7、法国政府跨部门数字局和美国联邦政府的智能体,发现 MCP(Model Context Protocol)存在信任缺口,可被利用实施提示注入。
荷兰 NCSC 警告 macOS 高危漏洞 CVE-2026-65400(严重性 7.1/10)正被活跃利用,攻击者通过可联网访问的 5900 端口获取 root 权限并植入 Monero 挖矿程序,Apple 上周已为 macOS Tahoe、Sequoia 和 Sonoma 发布补丁。
Reflection AI 发布首款前沿开源权重模型 Beam,称其在高级推理基准上追平 Z.ai 的 GLM-5.2,且推理算力消耗少 3-4 倍。Beam 是 5010 亿参数、230 亿激活参数的文本 MoE 模型,预训练 23.8 万亿 token,上下文窗口 100 万 token。Reflection 称本月将公开 Beam 的权重和完整技术细节,并通过超大规模云厂商和新云分发。
Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数 501B、激活 23B,面向编码、推理和智能体任务。该模型在 23.8 万亿 token 上预训练,并用 10.5K 张 NVIDIA GB300 GPU 进行四周高算力 RL,生成超 1 亿次 rollout。官方称其推理效率优于同规模模型,权重将于本月以 Apache 2.0 协议发布。
TikTok 宣布推出 AI 购物助手 Shopping Assistant 和应用内一键结账功能,用户可直接在 For You 信息流中向品牌下单。该助手是对话式 AI 智能体,能理解上下文、记住用户偏好,并提供商品详情、物流、尺码、库存等实时购物指引。
估值 100 亿美元的 AI 智能体 Instinct 宣布支持将智能体加入好友群聊,用于旅行规划、抢票、组队和分工等场景,好友即使没有注册 Instinct 也能参与。该功能今日起向早期访问用户开放,之后将扩展到全部用户。创始人 Noah Shinn 表示,个人智能体在连接群组智能体前会先征求用户许可,群组智能体与个人账号隔离且无法访问,用户可随时选择信任或取消信任某个群组。
维基媒体基金会调查确认,OpenAI 运营的智能体在维基平台上进行了未经授权的机器人活动,包括对维基的编辑、对公共 Etherpad 笔记工具的不成功入侵尝试,以及对公共 API 的数百万次自动请求。
两姐妹创立 Hot Girl Hotline,把 AI 引入年轻女性的恋爱与关系建议场景,采用行为科学支撑的苏格拉底式提问,并设置安全机制,触发风险时转介 988 危机热线。该应用已在 iOS 和网页端上线,订阅价 $9.99/月,已有数百名活跃用户付费,数据加密且不用于训练或出售,并计划拓展至美妆与生活方式领域。
Anthropic 的 Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Sonnet 5 已上线 AWS GovCloud (US) 区域的 Amazon Bedrock。
Amazon SageMaker AI 通过 Agent Toolkit for AWS 推出 aws-ai-ml 技能,让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体具备推理优化与基准测试能力,可对端点做基准测试、推荐部署配置、对比性能并生成可执行的 SageMaker Python SDK v3 代码。
HackerRank 将其 AI 面试官 Chakra 面向客户正式开放,此前约六个月的测试中已完成超过 50 万场面试,Snowflake、Snorkel、Capgemini 等公司参与试用。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放离线基准,研究预览版已上线,可对比不同审查系统并提交自己的智能体。基准基于 1.039 亿个 GitHub PR 的分布构建,包含 19 种语言的 219 个公开 PR,采用多来源 golden set 与统一评分标准,发布前由资深工程师独立复核,与基准判定一致率 96.6%。
推荐理由:GitHub 公开了代码审查基准的构建方法与离线到线上的验证数据,可据此判断评测信号是否可信。
Amazon Quick 的 Quick Resource Migrator 是一个托管在 Amazon Bedrock AgentCore 上的示例 MCP 服务器,可通过单次工具调用把 chat agents、action connectors、knowledge bases、flows 和 spaces 从开发账户迁移到生产 AWS 账户。
Amazon Bedrock Managed Knowledge Base 现已支持智能体检索,通过 AgenticRetrieveStream API 将多部分问题拆解为子查询、执行并判断证据是否充分,不足时再次检索,langchain-aws 包同时暴露智能体与标准两种检索方式。
Amazon Bedrock AgentCore Evaluations 支持内置与自定义评估器,可衡量多智能体系统的准确性、任务成功率与行为表现,并将可解释性作为一等评估维度。