wigolo serve资源调优:并发限制、资源限额与硬件选型完整指南 📅 发布时间:2026/9/15 17:33:09 👁 浏览次数: wigolo serve资源调优并发限制、资源限额与硬件选型完整指南【免费下载链接】wigoloThe go-to web for your AI coding agent — local-first search, fetch, crawl research over MCP. No API keys, no cloud, $0/query. Public beta.项目地址: https://gitcode.com/GitHub_Trending/wi/wigolowigolo是一个本地优先的 AI 智能体网络工具包MCP 服务器提供搜索、抓取、爬虫和研究功能无需 API Key、不依赖云端每次查询成本为 $0。当你用wigolo serve把它跑成常驻 HTTP 守护进程同时服务多个 AI 智能体时资源调优就成了必答题并发上限设多少内存会飙到多少该选什么配置的小服务器这篇文章用一张限额表、三层并发旋钮和一套硬件选型建议帮你把 serve 模式调得又快又稳。什么是 wigolo serve 模式默认情况下 wigolo 以 MCP stdio 方式贴着你的编码智能体运行而wigolo serve会把它变成一个 HTTP 守护进程每个工具一个 REST 端点POST /v1/{tool}、一份 OpenAPI 3.1 契约外加远程 MCP 传输——一个进程同时服务 CLI 脚本、SDK 和多个智能体。默认监听127.0.0.1:3333可用WIGOLO_DAEMON_PORT/WIGOLO_DAEMON_HOST覆盖。/health端点永远开放、无需 token方便负载均衡器和容器健康检查。完整端点说明见 docs/rest-api.md。四道内置资源限额默认值与覆盖方式serve 模式自带一套传输层纪律请求体上限、按路由的响应截止时间、在途请求上限、慢客户端超时——全部可用环境变量调整工具层自身的默认值不受影响。源码在 src/daemon/rest/limits.ts。限额默认值环境变量请求体大小1 MiBdiff/extract为 5 MiBWIGOLO_SERVE_MAX_BODY_BYTES响应截止时间60ssearch / cache / diff / find_similar120sfetch / extract / watch300scrawl / research / agentWIGOLO_SERVE_TIMEOUT_SCALE倍数在途请求上限16WIGOLO_SERVE_MAX_CONCURRENCY整请求 / 请求头超时120s / 60sWIGOLO_SERVE_REQUEST_TIMEOUT_MS/WIGOLO_SERVE_HEADERS_TIMEOUT_MS两个容易踩坑的点超过在途上限会直接返回 429不排队。官方提示是稍后重试并发由WIGOLO_SERVE_MAX_CONCURRENCY约束。所以如果你的智能体经常并发轰请求把它从 16 调大到 32 往往比调超时更有效。参数会被服务端硬性钳制钳制表同样注入到 OpenAPI 契约契约与执行永不漂移crawl.max_pages ≤ 200、crawl.max_depth ≤ 5、agent.max_time_ms ≤ 240000、search.query数组 ≤ 10 个变体。并发限制怎么调三层旋钮调优时把并发想成三层从外到内第一层serve 入口HTTP 在途上限WIGOLO_SERVE_MAX_CONCURRENCY32 WIGOLO_SERVE_TIMEOUT_SCALE1.5 wigolo serve多智能体共享一个 daemon比如一个研究智能体 一个监控智能体时16 个在途槽位容易被 crawl/agent 这类 300s 长请求占满调大并发上限同时用WIGOLO_SERVE_TIMEOUT_SCALE给慢路由留余量。第二层搜索内部的并行度WIGOLO_MULTI_QUERY_CONCURRENCY默认5一次数组查询里并行派发的变体数。WIGOLO_MULTI_QUERY_MAX默认10一次接受的查询变体上限。第三层浏览器池与爬虫礼貌性最吃内存/带宽的地方MAX_BROWSERS默认3JS 渲染页面的浏览器引擎池大小。每个池内浏览器都是真实的内存开销官方自托管指南明确建议小 VPS 上设为MAX_BROWSERS1。CRAWL_CONCURRENCY默认2每个爬虫的并行抓取数CRAWL_DELAY_MS默认500同域请求间的礼貌延迟。WIGOLO_LLM_MAX_CALLS_PER_REQUEST默认1每个工具请求的 LLM 调用硬上限防止合成环节失控。完整变量表在 docs/configuration.md自托管场景的网络与资源注意事项在 docs/self-hosting.md。硬件选型建议CPU、内存、磁盘怎么配官方给的资源基线见 docs/self-hosting.md 的 Resource sizing 一节维度基线说明磁盘约 1.5 GB 起步排序 嵌入模型约 250 MB浏览器引擎约 0.5–1 GB缓存随使用增长可用 TTL 和wigolo config --cleanup cache控制内存空闲仅几十 MB内存尖峰来自浏览器渲染抓取——每个池内浏览器成本真实存在小 VPS 务必MAX_BROWSERS1CPU1 个共享 vCPU 即可重排与嵌入是进程内短突发交互式智能体用量单核够用据此给出三档参考配置笔记本 / 单机侧车任意现代机器。磁盘留 2 GB其余全用默认值。小 VPS1 vCPU / 1 GB可行但要MAX_BROWSERS1、并发上限保持默认 16避免 JS 渲染尖峰叠加。家庭实验室 / 多智能体共享2 vCPU / 2–4 GB 内存WIGOLO_SERVE_MAX_CONCURRENCY32MAX_BROWSERS3保持默认让浏览器池真正并行。用 Docker 时注意两个镜像目标见 Dockerfile默认 slim 镜像最省体积浏览器二进制和模型首次使用时下载到卷里所以 compose 里健康检查给了 120s 宽限期full镜像预装浏览器引擎适合频繁跑 JS 渲染的场景。serve 模式直接复用仓库自带的 packaging/compose.serve.yml——已内置健康检查、持久卷和 token 说明注意0.0.0.0绑定属于非回环绑定必须设置WIGOLO_API_TOKEN否则守护进程会拒绝启动fail-closed 设计。调优检查清单快速回顾先跑wigolo doctor确认组件健康再谈调优。多智能体并发吃紧 → 调WIGOLO_SERVE_MAX_CONCURRENCY注意 429 语义超限直接拒绝。长任务频繁超时504→ 调WIGOLO_SERVE_TIMEOUT_SCALE或缩小crawl的页面预算。内存吃紧 →MAX_BROWSERS1CPU 单核小机器不要开高CRAWL_CONCURRENCY。小 VPS 用full镜像 持久卷大内存机器用 slim 镜像按需下载即可。远程绑定记得配 token并保留/health供探活。更多端点语义、鉴权模型与兼容层说明可阅读 docs/rest-api.md环境变量全表搜索后端、缓存 TTL、遥测、日志见 docs/configuration.md。【免费下载链接】wigoloThe go-to web for your AI coding agent — local-first search, fetch, crawl research over MCP. No API keys, no cloud, $0/query. Public beta.项目地址: https://gitcode.com/GitHub_Trending/wi/wigolo创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考