OpenClaw 配 QMD 降 token 消耗,模型 Base URL 填 TaoToken 📅 发布时间:2026/9/19 13:41:49 👁 浏览次数: OpenClaw 配 QMD 降 token 消耗模型 Base URL 填 TaoTokenOpenClaw 从 2026.2.2 版本开始内置了 QMD 记忆后端但很多人配好 QMD 之后发现模型通道还是老样子——要么直连官方额度紧张要么 Base URL 填错导致请求 404。这篇把两件事一起做完QMD 侧按标准流程改~/.openclaw/openclaw.json、重启 gateway、验证qmd memory startup日志模型侧把 OpenClaw 的 Base URL 指向 TaoTokenhttps://taotoken.net/?utm_sourcetaotoken_aicg_blog_end Key 用 TaoToken 创建的YOUR_API_KEY。跑通后 QMD 只回传本地检索到的 2-3 句精准片段模型请求也正常返回token 消耗和响应耗时都能降下来。一、原问题与场景MEMORY.md 整文件塞上下文token 直接爆炸OpenClaw 默认的 SQLite 记忆后端在检索时容易把整个MEMORY.md文件直接塞进上下文。聊得越久这个文件越大每次请求携带的 token 就越多响应变慢、成本上升长会话下模型还容易因为上下文过长而丢失重点。QMDQuantum Memory Database是 Shopify 联合创始人 Tobias Lütke 开发的本地语义搜索引擎思路是先用本地混合检索BM25 向量语义 LLM 重排序找到最相关的 2-3 句话再把这些精准片段传给模型而不是整文件灌进去。它完全本地运行模型、索引、数据都不上云自带 GGUF 模型不消耗 API 配额。但 QMD 只管记忆检索这一段模型请求本身还是要走一个可用的通道。如果 OpenClaw 的模型 Base URL 没配对QMD 检索再准请求也发不出去。所以本篇的场景是QMD 负责降 tokenTaoToken 负责供模型通道两边各管一段互不干扰。二、TaoToken 前置先拿 Key再填 Base URL在动 OpenClaw 配置之前先把模型通道准备好。打开 https://taotoken.net/?utm_sourcetaotoken_aicg_blog_end 注册后在控制台创建一个 API Key记下YOUR_API_KEY。这个 Key 后面要填进 OpenClaw 的模型配置里。Base URL 填https://taotoken.net/api注意两点不带/v1后缀不加任何 UTM 参数。OpenClaw 的模型配置里通常有baseUrl和apiKey两个字段分别对应这两个值。如果你还没创建 Key直接去 API Keys 页面https://taotoken.net/console/api-keys?utm_sourcetaotoken_aicg_blog_endutm_contentapi_keysutm_campaignrewrite 。接入文档在 https://taotoken.net/doc?utm_sourcetaotoken_aicg_blog_endutm_contentdocutm_campaignrewrite 里面有各客户端的 Base URL 填法说明。TaoToken 在这里只做一件事给 OpenClaw 提供一个稳定的模型请求入口。QMD 的安装、配置、重启、验证全部按 OpenClaw 官方流程走不需要因为换了模型通道而改动 QMD 侧的任何参数。三、可复制配置QMD 侧 模型侧一起改先确认 OpenClaw 版本不低于 2026.2.2openclaw -v低于这个版本先更新。然后安装 QMDnpm install -g tobilu/qmd qmd -vQMD 需要支持 vector 扩展的 SQLitesudo apt update sudo apt install sqlite3 libsqlite3-dev sqlite3 --version改配置前先备份cp ~/.openclaw/openclaw.json ~/.openclaw/openclaw.json.bak编辑~/.openclaw/openclaw.json把 memory 后端切到 qmd同时把模型通道指向 TaoToken{ memory: { backend: qmd, qmd: { limits: { timeoutMs: 8000 } } }, model: { baseUrl: https://taotoken.net/api, apiKey: YOUR_API_KEY } }timeoutMs设 8000 是因为默认 4 秒在首次索引或模型加载时可能不够8 秒留出余量。baseUrl就是 TaoToken 的 API 地址不带/v1不加 UTM。apiKey填你在 TaoToken 控制台创建的 Key。改完重启 gatewayopenclaw gateway restart重启后 OpenClaw 会自动使用 QMD 做记忆检索。如果 QMD 出问题会自动回退到内置 SQLite 记忆系统不影响正常使用。四、验证请求与成功结果日志 状态 实际对话方法 1看日志确认 QMD 已启用openclaw logs | grep qmd正常应该看到类似info gateway {subsystem:gateway} qmd memory startup initialization armed for agent main方法 2检查 QMD 状态qmd status首次运行时 QMD 会尝试 GPU 加速编译 llama.cpp with Vulkan 支持。如果系统缺 Vulkan 驱动编译失败后会自动回退到 CPU 模式falling back to no GPU。这是预期行为不是错误QMD 仍可正常工作。想更快可以装 Vulkan 驱动sudo apt install vulkan-tools libvulkan-dev方法 3实际对话测试和 OpenClaw 对话问一个关于之前聊天内容的问题。观察两点一是 QMD 是否只回传本地检索到的 2-3 句精准片段而不是整段历史二是模型请求是否正常返回响应耗时是否下降。如果模型侧配置正确TaoToken 的请求会正常返回如果 Base URL 填错比如多加了/v1请求会报错这时候回到openclaw.json检查baseUrl字段。五、本篇常见错排查qmd 命令未找到which qmd输出为空说明没装好重新npm install -g tobilu/qmd。Bun 版本报错exec: bun: not found切回 npm 版本mv ~/.bun/bin/qmd ~/.bun/bin/qmd.bun.bak ln -s ~/.nvm/versions/node/v25.8.0/bin/qmd ~/.bun/bin/qmd qmd --version缺少 C 编译器ERROR OMG C Compiler toolset is not available.装 build-essentialsudo apt install build-essential g或者忽略QMD 会自动回退 CPU 模式只是慢一些。首次启动慢第一次用 QMD 要下载模型约 2GB模型在~/.cache/qmd/models/。等它下完后续就快了。qmd update failedqmd update qmd embed -fexec: node: not foundOpenClaw 以守护进程运行没加载 nvm 环境变量。创建系统级 node 符号链接sudo ln -s /home/zilong/.nvm/versions/node/v22.22.1/bin/node /usr/local/bin/node openclaw gateway restart找不到config.jsonENOENT: no such file or directory, access ~/.openclaw/agents/main/qmd/config.json创建一个空 JSON 文件即可echo {} ~/.openclaw/agents/main/qmd/config.json模型请求报错先检查openclaw.json里的baseUrl是不是https://taotoken.net/api确认没有多写/v1、没有加 UTM 参数。Key 是否填的是 TaoToken 控制台创建的那个。如果还不行去 API Keys 页面重新生成一个 Key 试试。六、语义一致 CTAQMD 侧配好之后模型通道的稳定性直接决定 OpenClaw 能不能持续跑下去。如果你在接入过程中遇到 Base URL 或 Key 的问题先去 API Keys 页面确认 Key 状态https://taotoken.net/console/api-keys?utm_sourcetaotoken_aicg_blog_endutm_contentapi_keysutm_campaignrewrite 接入文档在 https://taotoken.net/doc?utm_sourcetaotoken_aicg_blog_endutm_contentdocutm_campaignrewrite 有各客户端的配置示例。想先验证模型通道是否通可以用模型对话页面发一条测试请求https://taotoken.net/model-chat?utm_sourcetaotoken_aicg_blog_endutm_contentmodel_chatutm_campaignrewrite 。如果你打算长期用 OpenClaw 跑编码或 Agent 任务Coding Plan 更适合持续调用https://taotoken.net/coding-plan?utm_sourcetaotoken_aicg_blog_endutm_contentcoding_planutm_campaignrewrite 。QMD 负责把 token 降下来TaoToken 负责让模型请求稳定返回两边配好OpenClaw 的长会话才能真正跑得动。