电报体测试:让 LLM 用 1866 年电报文体压缩输出,跨模型读取准确率不降
作者发布 Telegraph Test 基准,用 50 篇文本、约 1300 道题测试 LLM 以电报体(cablese)压缩记录的效果,跨四个模型家族读取准确率恢复比为 0.99 至 1.10,即不逊于纯文本。
作者发布 Telegraph Test 基准,用 50 篇文本、约 1300 道题测试 LLM 以电报体(cablese)压缩记录的效果,跨四个模型家族读取准确率恢复比为 0.99 至 1.10,即不逊于纯文本。
阅读 Vue 3 源码时,作者从 constructor(public fn: () => T) 重新理解了 TypeScript 参数属性语法:public fn 会自动创建实例属性,相当于在构造函数中执行 this.fn = fn,该写法不能直接用于 JavaScript 类构造函数参数。源码通常不在构造函数中立即执行传入函数,而是先保存,再根据当前响应式作用域决定是否收集或停用副作用。
用三个 Python 文件即可把日常数据质量检查自动化,分别对应数据质量监控、管道编排与自动报表生成三项工作流。
Criteo 一名初级工程师提出,AI 代理普及后真正的风险不是软件工程师消失,而是资深工程师消失、所有人沦为"永远的初级"。他通过让代理用苏格拉底式提问检验自己的理解、并借助资深同事的代码评审意见训练评审能力,来培养好奇心与评审这两项 AI 无法代劳的技能。
文章介绍如何用 Neo4j 加 Text-to-Cypher 构建 GraphRAG,让 LLM 把自然语言问题翻译成 Cypher 查询,再从知识图谱取回实体关系作为上下文生成答案。
Google 开源的 ARTEMIS 定位是让 AI 助手和测试套件像人一样操作真机,作者从源码层面拆解其 Flash 与 Pro 双模式架构。Flash 是单模型反应式循环,靠 chunk 到 era 的单向历史折叠控制上下文,因此循环轮次默认不设上限;Pro 是带环的多智能体图,用 verify 与 assert 语法区分可修复的验收标准和不可修复的测试断言。
用 random_u64() 取模从 N 个对象中随机选一个,会破坏输入的均匀分布:从 [0,9] 中取数再对 3 取模,choice 1 被选中概率为 40%,而 choice 2、3 各只有 30%。
掘金课堂用 DeepAgents 的 createDeepAgent 组装了一个多 Agent 深度调研助手,配置为 1 个主 Agent 加 researcher、analyst、editor 三个子 Agent,并挂载 todoListMiddleware、AGENT.md 记忆和 /skills/ 技能目录。
本文以 pi-rust 为例,用一条“读配置文件问超时时间”的消息串起编码 Agent 的完整运行链路,从 TUI 输入框提交、Harness 构造 AgentContext,到 Agent Loop 请求模型、执行工具并回填结果。
文章围绕 Agentic RAG、LLM Wiki 与 Multi-Agent 三个架构问题讨论取舍,认为架构复杂度本身是成本,拆分必须换来单 Agent 给不了的东西。
C++ 模板代码有三种主流组织方式:包含模型把声明与实现全部放入头文件,是日常开发与库开发的首选;显式实例化用 template 指示符手动生成指定类型实例,适合类型集合固定的场景;分离模型基于 export 关键字,因编译器支持极差且 C++11 后逐步废弃,不建议生产使用。包含模型带来的编译时间压力可用预编译头文件缓解。
作者基于 OpenCode v2.0.15 标签源码拆解插件加载机制,发现本地目录不按 package.json 的 main/exports 选择入口,而是硬编码探测 server 与 index 文件,配置指向单个 .js 文件会被记录 warning 后跳过。
用仓颉 1.1.3 写成的棋盘游戏《驿路巡点》从鸿蒙迁往 iOS 和 Android 时,团队先试了交叉编译加原生壳,只跑通 1 关;9 月 27 日核查发现 Canvas 未编入 iOS/Android 引擎构建,9 月 28 日起转向 CJMP。所用 OpenSDK 0.2.2 内置 cjc 1.1.0,落后主分支 v0.7.0 五个版本,所有验证均在模拟器上完成。
掘金文章提出用“修改半径”衡量 Agent 架构成熟度:同一种问题发生时修改的 owner 应越来越少。文章以“搜索摘要被当成正文”为例,指出该问题会同时牵动 Prompt、Runtime、Tool、Evidence、Recovery 五六层,根源是同一事实被多层重复解释。
JVM 线上排查实战系列第七篇针对工具连不上进程的情况,在 CentOS 7.9 上同机部署 Oracle JDK 8、OpenJDK 8 和 Oracle JDK 17,逐一构造并复现了 jps 看不到进程、jstack 报不允许的操作、进程被 kill -STOP 挂起、-XX:+DisableAttachMechanism 禁用 attach 等场景。
基于 TechEmpower、Sharkbench 及 40 余份独立基准报告,文章对比了 Rust、Go、Java、Python、PHP 等后端框架在预热完成后的真实负载表现。
掘金发布 AI Agent 异步处理教程,用 RabbitMQ 的 topic 交换机实现任务投递与消费。
Bamboo 调度系统在从 MySQL 迁移到 OceanBase CE 4.5 时,存储过程暴露锁、临时表、子查询三类兼容性问题。
Chatbot 联网能力由 web_search 与 web_fetch 两个工具分工实现:前者按主题返回候选来源,后者读取已知 URL 并提取可读正文。
文章提出把用户连接与 AI 任务的生命周期解耦,任务状态持久化后即可精确恢复,而非重试或从头再来。作者把断线归为用户中断、网络波动、服务端滚动更新三类,并给出幂等键防重复副作用、offset 去重防流式重复、schemaVersion 迁移防检查点不兼容等做法。
推荐理由:原文把 AI 长任务的断线恢复拆成连接解耦、检查点与进度标记三件事,并给出可复用的代码与写入顺序。
作者梳理 GitHub 上六个公开仓库的 flaky 修复案例,其中四个由 Agent 完成,一个 Agent 的修复方式是删掉让测试结果变化的 fixture 变量。
推荐理由:作者用六个公开仓库案例和自建实验,量化了重试判据对 flaky 率的稀释效应,并给出可迁移的判据修正方向。
作者在 Spring AI 2.0.1 上手工构造 ChatResponse 并直接调用 DefaultToolCallingManager.executeToolCalls(),验证工具调用执行链的失败路径。
Óscar Toledo G. 将 1993 年用 Zilog Z280 自制电脑和 2400 波特 Hayes 调制解调器拨入墨西哥 La Cueva BBS 时保存的 64K 会话缓冲(CUEVA.TXT)做成 JavaScript 回放,以 2400 波特速度重现当年屏幕。
作者用 NAS 上的 Docker 部署社区维护的开源 Bitwarden 后端 Vaultwarden,并通过 Cloudflare Tunnel 打通 HTTPS 公网访问,替代订阅制密码管理服务。
iOS 27 新增「通知自动化」,任何能发送通知的 App 都可作为快捷指令触发器,并可按通知标题、副标题、正文筛选内容。使用前需开启 App 系统通知,并在锁屏或通知中心至少选择一种显示位置,单独选择横幅无法运行。少数派用十个案例演示了重要消息着重提醒、自定义图标保留角标、不同联系人铃声、英文通知翻译和自动记账等用法。
钟毓英语衡水体字帖生成器从 PyQt6 v1.1.1 重构为 Electron v2.0.x,实现 Windows、macOS、Linux 跨平台。项目采用 electron-vite、Canvas 2D、tesseract.js OCR 与 electron-builder,并处理 pickle 兼容与 Bottles 交叉打包。
2Do 于今年 8 月推出全新版本,彻底换上现代化界面并加入原生多窗口支持、自然语言识别录入和全维度跨维度 OR 过滤。同步引擎从底层重写,带来原生 iCloud 同步与 Apple 提醒事项双向同步,并预告 WebDAV 支持。定价为 iOS 9.99 美元、iPadOS 19.99 美元买断,macOS 49.99 美元终身许可证含 18 个月功能更新。
少数派 Matrix 作者分享国庆七天从山西自驾河南的攻略方法:先用小红书 AI 助手「点点」检索真实笔记并溯源校对,再把底稿、评论细节输入 ZCode、Claude Code 等本地 Agent 整理推演,最终输出单文件 HTML 行程,发到微信即可离线查看。