LangChain 之八:流式与透传
LangChain 源码系列第八篇解析流式与透传机制,源码基于 langchain-core 1.3.2。BaseChatModel 在 chat_models.py:710 覆写 stream,逐格吐出 AIMessageChunk,并在流尾补一个 content 为空、chunk_position 为 last 的空 token 作为终止信号。
LangChain 源码系列第八篇解析流式与透传机制,源码基于 langchain-core 1.3.2。BaseChatModel 在 chat_models.py:710 覆写 stream,逐格吐出 AIMessageChunk,并在流尾补一个 content 为空、chunk_position 为 last 的空 token 作为终止信号。
一篇 LangChain 教程把检索、记忆、工具调用、流式输出和回调可观测五个零件,用 Runnable 和竖线 `|` 拼成一个可运行的电商客服助手,并用免 key 脚本完整跑通。
一篇观点文章认为,在 LLM 能快速写代码之后,Common Lisp 因读写期、编译期与运行期无实质区分而成为最佳编程语言:其基于镜像的运行方式可即时替换函数、出错时进入调试器而非崩溃,便于 LLM 修复并继续运行。作者称自己用 Common Lisp 写的应用比 Python 版本短约六到七倍,代码更少意味着 token 更少、更易放进 LLM 上下文窗口。
开发者通过 LLM 逆向工程 iChat 的 SNATMAP 协议,自建 UDP 服务器并修改 /etc/hosts,让运行 Leopard 或 Snow Leopard 的老 Mac 重新实现 iChat 音视频通话。
手写 Claude Code 复刻项目 codeAgent 在并行工具调用回喂时踩坑:按 OpenAI 习惯逐条回喂 tool 结果,切到 Anthropic 端点直接 400,因为 Anthropic 要求所有 tool_result 装在同一条 user 消息里且不允许两条 user 消息相邻。
dots 是一个 3 天斩获 2.4K Star 的 Web AI Agent 项目,核心卖点是对 Firefox 引擎做 C++ 源码补丁,使指纹在引擎层生成而非 JS 注入,从而规避反爬检测。
向量数据库与普通数据库的核心差异不在存储而在检索:普通库只能全表扫描做 O(N) 暴力遍历,向量库靠 HNSW、IVFFlat 等 ANN 索引把复杂度降到 O(log N),RAG 端到端延迟可控制在 10ms~50ms。
针对 Agent 流式输出中 Nginx 缓冲截留、多节点 SSE 连接孤岛、事件类型混乱三大生产环境问题,该方案基于 Spring Boot 3 的 SseEmitter 构建会话管理器,配合 Redis Pub/Sub 实现跨集群节点的事件广播。
arXiv 论文 AgentLens 将 1,136 条通过轨迹分为 Ideal(20.2%)、Solid(69.1%)和 Lucky(10.7%)三档,Lucky Pass 在八个模型后端间跨度达 46 倍,而 pass rate 排名与过程质量排名全部不一致。
一位开发者用业余时间从零搭建了 YOLO 训练管理平台,技术栈为 FastAPI + SQLite + Vue 3,训练通过 subprocess 调用 ultralytics 的 yolo CLI,支持数据集导入、在线标注、版本快照、串行训练队列和模型管理,Windows 优先部署。
一位开发者用 FastAPI + SQLite 单进程后端、Vue 3 + Vite 前端和 subprocess 调用 ultralytics yolo CLI 的方式,把 YOLO 训练管理平台做成网页版,覆盖素材库、在线标注、数据集版本快照、在线训练、模型版本管理、试模型和两级权限七项功能。
XiaoMate(小美同学)新增 screen_capture MCP 工具,通过 mss 截取全屏并调用 OpenAI 兼容的 Vision 模型分析屏幕内容,让语音助手获得视觉感知能力。该工具支持 Windows/macOS/Linux 与多显示器,采用 asyncio 异步非阻塞调用,可应用于网购比价、快递单号识别、体检报告解读等场景,目前仅支持全屏截图,暂不支持指定区域。
作者开源了一个 MCP server,让 Claude Desktop、Cursor、Cline 等 MCP 宿主里的 AI 以可见形象进入其浏览器多人 3D 世界,真人可在 30m 内看到 AI 走动、说话并与之对话。
一位不懂编程的物料计划人员用 WorkBuddy(豆包桌面端)通过9轮对话,把每天40分钟的手工导出汇总流程做成双击一次38秒完成的自动化工具,全程未写一行代码。文中给出提需求四层法(目的、步骤、文件与规则、边界与例外)、报错三步法(截图、复制原文、说明操作)和三条底线(先备份、交代禁区、密码别写在聊天里),并附可直接填空的模板。
Cloudflare 于 9 月 28 日发布全新命令行工具 cf,覆盖其接近 3000 项公开 API 操作,并支持用自然语言搜索命令、默认返回 JSON。官方统计显示,2026 年 3 月 AI Agent 已贡献 Wrangler 四分之一使用量,到 cf 发布前一周升至 48%。
一个声称对拍 CPU 参考实现的 WebGPU 数学同源审计门禁,实际对拍的是 JavaScript 模拟内核,真正的 WGSL 文本从未被 GPU 编译执行过。
文章以 Codex Rust 版 commit 2685e3a4 源码为证据,梳理编程 Agent 的提示词注入面,包括 README、代码注释、测试 fixture、commit/PR 文本、issue 正文、依赖包、MCP 工具返回和 web 搜索结果八个入口。
JeeWMS 给出中小企业分批上线 WMS 的清单:第一批只做“账做准”,含基础配置层、收货上架、拣货出库复核、库内调整与盘点,PDA 仅做收货和拣货;第二批补效率与稽核,第三批才接 RFID/AGV 设备与 ERP、MES 集成。该系统基于 Spring Cloud 微服务与 Vue 前端,采用 GPL-3.0 协议,官方仓库为 gitee.com/erzhongxmu/JEEWMS。
一个示例工程拆解了 AI Skill 的完整落地路径:把会议纪要生成固化为 SKILL.md,靠 YAML 头部的 name 和 description 决定技能是否被触发,正文写工作流程与输出模板。
发表于《Transactions of the Institute of Measurement and Control》的研究提出控制感知域对抗网络(CA-DANN),从"控制-诊断协同"视角切入变工况故障诊断。该方法以船用柴油机燃油喷射系统为对象,将主动控制信号与被动状态响应通过门控加权融合,并把传统二值域判别扩展为多类机动工况的细粒度对抗对齐,以消解工况调节与喷孔堵塞故障的表征混叠问题。
LangChain Agent 开发中可用五种方式定义工具:@tool 基础装饰器、@tool 加 parse_docstring、StructuredTool、继承 BaseTool 以及 Runnable 转 Tool,分别对应快速原型、多参数规范工具、存量函数复用、生产复杂工具和已有 Runnable 链路复用。
一份实践思路指出,用 Ollama 等工具在本机部署 AI Agent,可让代码、文档、日志全部留在本地,16GB 内存即可流畅运行 7B 级别量化模型,且开源模型一次部署长期复用、不按次计费。
Anthropic 的 Felix Rieseberg 表示,新版 Cowork 将模型推理和 VM 都放到云端运行,每个会话拥有独立沙箱、不与其他会话共享状态。旧版在云端做模型推理、但把 Anthropic 提供的 VM 装到用户电脑上执行工具调用,用户不满其磁盘、电池和性能开销,以及合上笔记本就中断工作。当 VM 需要访问用户设备上的文件时,由桌面应用负责该文件访问的工具调用。
内容为 Go 语言中指针引用的相关讲解,原始标题与正文均围绕"Go 中指针引用"这一主题重复展开,未提供具体版本、参数或可用性等可核验细节。
gstack 是一个开源工具集,通过 23 个结构化 AI 角色把 Claude Code 转化为虚拟工程团队,覆盖产品设计到部署的全流程。
Agency Agents 是一套支持多平台、跨工具安装的 AI 智能体协作系统,包含 230 余个专业化角色,覆盖工程、营销、销售、运营等 8 大部门。它提供针对 Claude Code、Cursor、GitHub Copilot、Gemini CLI、OpenCode、Kimi Code 等 14 种 AI 编码助手的安装脚本,可通过一行命令部署并交互式选择工具与代理群组。
Agency Agents 是一个跨平台桌面应用与脚本套件,可将超过 230 个专业化 AI 智能体安装到 Claude Code、Cursor、GitHub Copilot、Gemini CLI 等主流编程工具中。
Wavestone 四位研究者发布 83 页论文《Harness Engineering》,逐行阅读 Claude Code、Codex CLI、Gemini CLI。
Agent-Reach 是一个开源项目,作为能力层替 agent 选型、安装和体检各平台读取工具,官方列出网页、X、Reddit、YouTube、B 站、小红书等 16 个平台,今年 2 月在 GitHub 建仓,现接近 9 万星。
GitHub 日榜 2026-10-06 显示,Swift 工具 RemoveMacAI 以 24h +1,577 Star 登顶,可关闭 macOS 27 的 Apple Intelligence 并删除其下载模型。
文章围绕多租户 LLM 应用的 Prompt 隔离问题,提出从 Layer 0 平台级 System Prompt 到用户输入的四层 Prompt 架构,并给出 Jinja2 SandboxedEnvironment 渲染。
作者实测用开源客户端 Cherry Studio 搭配硅基流动、阿里云百炼的免费 API Key(DeepSeek-V3、DeepSeek-R1、Qwen2.5-7B)和 BAAI/bge-m3 向量模型,在本地搭建支持联网搜索与文档检索的 RAG 知识库,数据与向量索引全部保存在本地。
MIT 开源的 Windows AI 编程工作台 Termexo 发布 v0.10.10,将终端、任务和部分设置开放为 19 个本地 MCP 工具。新版支持在 Termexo 新启动的 Claude Code、Codex、OpenCode、Grok Build 和 Antigravity 终端中自动添加连接,Agent 可查询工作区和终端。
一篇关于 LSM-Tree 键值存储的论文提出更优的时空权衡方案。该 PDF 在 Hacker News 获得 18 分,暂无评论。
研究者基于钢琴 MIDI 预训练的 16 层 Transformer 模型 Aria,在 PiJAMA 数据集中十二位爵士钢琴家的独奏上微调,并在最后八层插入门控交叉注意力层,读取每位钢琴家的学习嵌入向量。生成片段被分类器判定为对应钢琴家的比例为 70%,无条件下仅为 37%;仅用生成音乐训练的第二个分类器识别真实录音的准确率达 95%。
ChatGPT 被发现在生成的仿《纽约客》风格漫画上添加真实漫画家的签名。该话题在 Hacker News 上获得 362 分和 265 条评论。
Hacker News 上出现一篇题为 Ephemeral Testing 的文章,获得 44 分和 13 条评论。原文未提供更多正文内容,具体讨论对象与结论暂不明确。
Samon 是一款以禅意庭院耙沙为主题的解谜游戏。该设计项目在 Hacker News 上获得 33 分、13 条评论。
一项在田纳西州 18 所中学开展的两年集群随机对照实验发现,使用 Khanmigo 辅导的学生每学期数学成绩提升约 1.3 个全国百分位,一学年约 0.06 至 0.08 个标准差,全年积极参与的隐含效应达 0.14 个标准差,与无 AI 辅助的 Khan Academy 练习效果相近。
Google 的 Gemini "Call for Me" 功能可能从商务通话扩展到亲友通话。Android Authority 在 APK 拆解中发现"Gemini Calling"引导页,示例包括"打电话给妈妈,告诉她我会晚到 15 分钟"。该功能预计仍限于类似短信的简短通话,并可能提供细粒度应用权限,让用户选择是否接收 Gemini 的自动来电。