OpenAI 的 Decisions API 进入公开测试
OpenAI 开发者文档页面显示,Decisions API 已进入公开测试(public beta)。该条目在 Hacker News 上获得 300 分和 141 条评论,但正文未提供该 API 的具体能力说明。
OpenAI 开发者文档页面显示,Decisions API 已进入公开测试(public beta)。该条目在 Hacker News 上获得 300 分和 141 条评论,但正文未提供该 API 的具体能力说明。
EmbeddingGemma 2 采用 Apache 2.0 开源许可,Simon Willison 认为嵌入模型不应使用闭源、专有、仅托管的形式。嵌入模型应用通常需计算并存储数千乃至数百万条嵌入向量,一旦厂商停供该模型,用户仍需为重新计算这些已存向量付费。他本人不愿自行托管模型,更愿付费使用托管服务,同时保留在厂商停供时自行运行开放权重版本或另寻供应商的余地。
Simon Willison 记录了如何用 Codex 摸索出运行 Parseable 并接收 Datasette traces 的方法。Parseable 是兼容 OpenTelemetry 的新可观测性工具,提供 AGPL 协议的 Rust 开源版(单个约 180MB 二进制文件)、企业版和云托管选项。
基于开源智能体系统 OpenClaw 和 Amazon Bedrock AgentCore runtime,可构建具备持久记忆的上下文感知 AI 助手,AgentCore memory 将一次性对话转为持久知识。
初创公司 Hark 正式发布 AI 个人助手 Hark Pro,可免费使用并提供面向重度用户的订阅档。该产品基于专门为电脑操作训练的模型,能接入邮件、日历、硬盘和信用卡等数字生活数据,代为执行数字任务;界面为全屏主页,含中央对话框、操作提示流和被称为 panels 的迷你仪表盘。
基于 Amazon Bedrock AgentCore、Amazon Nova 2.5 Sonic 和 Amazon Bedrock Knowledge Bases,可搭建一套语音旅行助手,让旅客通过语音查询行程、改座位、更新餐食偏好并转接人工客服。
Amazon SageMaker Studio 新增在 UI 中直接创建和管理 HyperPod EKS 集群上 SageMaker Spaces 的能力,数据科学家无需 CLI 或 kubectl 即可启动 JupyterLab 和 Code Editor 环境。
Amazon SageMaker HyperPod 通过 SageMaker Unified Studio 连接项目后,团队可在项目工作区启动训练与微调工作负载,同时由基础设施团队继续通过 SageMaker AI 接口和 API 管理集群。文章提出组织、项目、集群、工作负载四层控制模型,并说明如何跨层设计身份、容量与可观测性策略,在共享加速器算力时保留底层治理控制。
AWS 发文解读国际标准 ISO/IEC 42005:2025,说明如何将 AI 系统影响评估整合进企业风险管理体系。该标准覆盖评估全生命周期,Annex D 用于与既有 IT 影响评估流程协同去重,Annex E 提供独立实施模板,并给出轻量级 triage 分类以判断是否需要完整评估。
ArtCraft 团队发布 PhotoCraft,一个用纯 Rust 从公开规范洁净室重写的开源图像编辑器,支持图层、蒙版、调整图层、图层样式、文字、矢量、笔刷和真实 PSD 文件。
openTPU 是一个开源 AI 加速器项目,硬件设计、指令集、模拟器、内核语言与编译器、主机软件都放在一个可通读的 monorepo 中,并在 Inspur YPCB-00338 卡(Xilinx Kintex-7 xc7k480t,两路 DDR3)上跑通十款模型,输出 token 与模拟器逐位一致。
Mistral 发布迄今最大模型 Mistral Large 4,总参数 1 万亿、激活 49 亿,已在 Mistral Studio 开放 API 预览,权重预计 10 月底发布。
Parseable 是一个开源可观测性数据湖,宣称每分钟可处理 1 亿条时间序列,采用列式设计与对象存储原生架构应对高基数问题。它在单一二进制内集成日志、指标、分布式追踪、告警、Dashboard 与 AI 分析,支持 SQL 和自然语言查询,并提供 MCP、Slack Bot、PAI、PB CLI、OTex 等工具。
Jotbus 发布一个面向编码智能体的共享加密便签,运行 npx jotbus 即可创建 60 分钟端到端加密工作区,让 Claude Code、Codex 等智能体跨机器共享笔记、交接任务和互审改动。
用 MoonBit 编写的 Linux 进程管理器 bm2 发布 0.6.0 版本,可管理 Node.js 和 Bun 应用,编译后为两个原生二进制共 5.5 MB,无运行时依赖。
DeepSeek 于 8 月 13 日随 V4-Pro 一同开源 MIT 许可证的 Agent 运行框架 DeepSeek Harness(dsh),模型、工具、沙箱乃至 Agent Loop 都可像插件一样替换,上线两天 GitHub Star 突破 9 万。
推荐理由:拆解 DeepSeek Harness 的插件化架构与首批实测数据,可对照自身 Agent 技术栈判断取舍。
Polars 2.0 发布,LazyFrame 的 collect 默认走流式引擎,out-of-core 落盘默认开启,内存约 80% 时开始溢写,默认磁盘预算 64GB。
针对 LangChain Agent、LangGraph、LlamaIndex 与 Spring AI 的选型,文章提出把 AI 助手拆成调用组织、状态与执行控制、数据处理与检索三类职责,再按实际缺口选择最小增量组件。
HarmonyOS 7.0 的 CoreVisionKit 新增 textSearchImage 端侧文搜图能力,推理在本地 NPU 运行、照片不上传、离线可用、延迟毫秒级,通过 init() 加载模型并构建索引、search(query, scope) 按业务数据域隔离检索。
OpenAI Agents SDK Python v0.22.1 把工具审批拆成入口、恢复与副作用三层契约:local MCP Server 转换出的每个工具都需经过 Server 级 Guardrail,可调用 needs_approval 策略遇到参数缺失(None)或空字符串时 fail-closed。
作者以宠物全生命周期管理 App 为例,演示如何用 Claude Code 的 Memory、Rules、Skills、Commands、MCP、SubAgents、Hooks、Headless、Agent SDK、Plugins 十项能力从零搭建项目。
Agent Skills 的工程价值来自可发现、可校验、可渐进加载的约定,而非把系统提示词拆成一个 Markdown 文件。
文章提出用 cost-per-success(总花费除以成功次数)替代榜单分数做模型选型,并给出可复现的 OpenAI 兼容接口评测脚本。
Mindcraft 把作者运行 3 个月的 AI 工作台经验提炼为可复用模式集,涵盖技能生命周期、结构完整性、验证体系、需求到落地、协调协议 5 个维度。其中结构完整性维度提供 1,600 行 Python 脚本,基于 11 天实际数据实现 6 个数据模块全部纳管、平均索引健康度 93%、154 个数据点 89% 验证通过率、0 次手动索引编辑。
从零构建 Agent 系列第 10 章讲解如何为 Agent 增加会话持久化:退出前把 agent.state.messages 中的完整消息按顺序写入 JSONL 文件,重启后读回并交给新 Agent 的 initialState.messages,使其能基于原历史继续提问。
LangChain 的 createMiddleware 中间件可挂载 beforeAgent、beforeModel、afterModel、afterAgent 四个钩子,并通过 stateSchema 声明自己的状态字段,如 modelCallCount 记录模型调用次数。
OctaFuse Gateway 2.13.0 将路由计价拆分为供应商倍率、计费倍率和成本倍率,供应商倍率支持按有效期和分时时段生效,未开始或已到期按 1 计算。新版本支持在路由编辑窗口内直接发起快速测试,无需先保存,但不会保存草稿、扣减额度或写入请求日志。用量分析拆为概览、费用与用量、性能与质量视图,并新增转移请求占比和成功流式样本指标。
开发者发布 WebGPU 封装库 moxwebgpu,用链式调用替代两百多行样板代码,如 gpu.tensor([1,2,3,4]).add(1).relu().mul(10).sum().item() 即可完成计算。
一位开发者将 AI 客服链路迁到 TypeScript 5.7 后,线上问题明显减少,核心是用类型收窄加 schema 校验、satisfies 固定工具协议、可判别联合类型建模流式事件,分别解决模型返回结构不稳定、Tool Calling 字段漂移和流式响应状态混乱三类边界问题。
面对资料冲突,可靠做法是事先定好一条七层优先级链、每条资料的版本身份和一套固定处置流程,而非"谁新信谁"。优先级链从公司定位与边界、对外标准口径、报价交付验收标准,逐层降到验证计划与实际结果,外部资料与学习笔记不能覆盖任何一层。冲突处置固定四步:先停用可疑版本,再回到对应层级确认,然后更新来源与条目,最后同步所有使用位置。
MiniMind 学习笔记第 04 篇拆解了 Transformer 块中注意力之外的六块组件:RoPE 旋转位置编码、Flash Attention、KV Cache、GQA、FFN 以及残差与 RMSNorm。
作者开源了 kshell,一个用 Go 1.23+、Wails v2、React 19 和 Bubbletea 构建的 AI 编程 CLI 统一工作台,自动扫描本机已装工具并汇总其会话、工作区、终端与远程服务器,支持 Windows、macOS、Linux,MIT 协议,当前版本 v0.1.3。
这篇教程梳理了 Qwen3.8-27B 的本地部署选型:该模型为 Apache-2.0 开源的 27B 稠密原生视觉语言模型,BF16 权重 51.75 GB,4-bit 量化后约 15.33 GB,可落在单张 16GB 显卡的承载边界内。
开发者用一部安卓手机通过 SSH 登录无桌面的 Linux 服务器,让终端里的 Agent 完成编码、构建、安装与测试,再切到 AScrcpy 查看并操作服务器模拟器上的画面完成验收。
Cohere 将企业平台升级为 North 2,用于统一管理 AI 智能体,可自主处理多步工作流并跨会话保留上下文。新版编排系统协调智能体调用共享知识库和可复用技能,并连接 Slack、SharePoint、Jira 等工具,还能从聊天提示词直接生成演示文稿、仪表盘和简单应用。
LangChain 源码系列第八篇解析流式与透传机制,源码基于 langchain-core 1.3.2。BaseChatModel 在 chat_models.py:710 覆写 stream,逐格吐出 AIMessageChunk,并在流尾补一个 content 为空、chunk_position 为 last 的空 token 作为终止信号。
一篇 LangChain 教程把检索、记忆、工具调用、流式输出和回调可观测五个零件,用 Runnable 和竖线 `|` 拼成一个可运行的电商客服助手,并用免 key 脚本完整跑通。
开发者通过 LLM 逆向工程 iChat 的 SNATMAP 协议,自建 UDP 服务器并修改 /etc/hosts,让运行 Leopard 或 Snow Leopard 的老 Mac 重新实现 iChat 音视频通话。
手写 Claude Code 复刻项目 codeAgent 在并行工具调用回喂时踩坑:按 OpenAI 习惯逐条回喂 tool 结果,切到 Anthropic 端点直接 400,因为 Anthropic 要求所有 tool_result 装在同一条 user 消息里且不允许两条 user 消息相邻。
dots 是一个 3 天斩获 2.4K Star 的 Web AI Agent 项目,核心卖点是对 Firefox 引擎做 C++ 源码补丁,使指纹在引擎层生成而非 JS 注入,从而规避反爬检测。