简介面向需要在类Unix系统上安装Ollama的用户这份资源提供了一套完整的安装指导与配套脚本。压缩包内共有3个文件覆盖说明文档、自动化安装脚本和下载支持脚本文件类型分别为txt、sh、php总大小仅13KB轻巧易用。内容围绕Ollama安装全流程展开详细说明了安装前的系统与硬件要求、通过脚本获取安装包的操作方法、执行安装脚本前需要准备的工具和依赖以及安装完成后的配置修改、服务启动与验证步骤。同时资源对安装过程中常见的权限不足、依赖缺失、脚本报错等问题给出了具体排错思路用户可对照txt说明理解sh与php脚本的作用并根据实际环境调整参数实现自动化部署。已有437人学习下载适合刚接触Ollama的初学者按部就班完成安装也能为运维或开发人员在快速部署时提供有效参考。1. 装个 Ollama 不难难的是装完发现跑不动很多人看到 ollama 官网的安装命令只有一行 curl觉得这事三分钟搞定。真正的新手困境是安装脚本卡在 6% 半天不动装完后想把模型放到 D 盘却发现只能用默认的 C 盘路径好不容易 pull 下来一个 qwen 模型拉到 83% 突然断线重来一遍又要从头开始。这些都是“ollama 安装”这个主题下最常被搜索的问题。本文只讲一件事把 ollama 从“装好”到“用得顺手”覆盖安装选型、加速下载、路径迁移、离线部署四个真实场景。适合正在本机折腾本地部署大模型、以及要在内网环境分发 ollama 的工程师。2. 官方一键安装脚本“一行命令”背后的下载逻辑与参数2.1 脚本装和手动装怎么选先看你的系统在 Linux 上官方的 install.sh 脚本做的事情拆开看其实就三步下载预编译二进制到/usr/local/lib/ollama在/usr/local/bin下创建软链接再尝试注册成一个 systemd 服务。很多人喜欢手动做这三件事比如把二进制拷到自定义目录、用 supervisor 托管进程这在多实例部署时确实更灵活。但对单机学习和快速验证来说脚本安装已经足够可靠不建议在一开始就走源码编译的路——除非你要改动 C 底层逻辑或者定制推理后端否则编译一次耗时超过半小时收益极低。Windows 和 macOS 用户不走脚本而是用安装包Windows 是OllamaSetup.exemacOS 是Ollama-darwin.zip。这两个安装包本质是把同样的二进制放进应用目录然后交给系统的服务管理机制。后面讲到路径迁移时会说明它们与 Linux 在目录结构上的差异。2.2 最小安装命令脚本参数与首次验证最小安装命令大家都很熟curl -fsSL https://ollama.com/install.sh | sh这条命令里 curl 的四个参数值得拆开说-f让 HTTP 请求在返回 4xx/5xx 时直接报错退出避免把错误页保存下来当成脚本执行-s是静默模式不加的话会打印下载进度条实际体验上加了-s反而让你看不清进程是卡在网络上还是卡在下载-S与-s搭配使用出错时仍显示错误信息-L是跟随 GitHub Releases 的 302 跳转。装完后第一步先跑ollama --version确认二进制在 PATH 里。如果报 command not found多半是安装脚本在下载阶段中断了第 5 章会讲这种半截安装的清理。如果你在安装时就希望模型库放到别的盘可以在执行脚本前先设置环境变量让安装过程继承这个变量export OLLAMA_MODELS/data/ollama/models curl -fsSL https://ollama.com/install.sh | sh env | grep OLLAMA这里OLLAMA_MODELS是 ollama 读取模型目录的首要变量安装后所有 pull 下来的文件都会落在这个目录。env那行用于确认变量确实传进了当前 shell。这一步对后面要迁移路径的人很重要——提前规划能省掉一次软链接操作。2.3 装完后的目录二进制、模型库、日志各在哪装完先别急着 pull花两分钟列一下关键目录排错时能少走很多弯路。以下是我在 Linux 机器上最常见的路径清单内容Linux 路径Windows 路径二进制/usr/local/bin/ollama%LOCALAPPDATA%\Programs\Ollama服务配置/etc/systemd/system/ollama.service注册为 ollama.exe 系统服务模型库~/.ollama/modelsC:\Users用户名.ollama\models日志journalctl -u ollama%LOCALAPPDATA%\Ollama\server.log临时下载目录~/.ollama/models/blobs分片缓存同上这里面的 blobs 目录是最容易让新手误删的地方。ollama 的模型文件并不是简单的一个文件而是以 sha256 为文件名的多个分片暂存在 blobs 下。如果你 pull 到一半报错这个目录里会留下大量已下载的临时分片下次 pull 时它会校验并复用已有分片所以不要一看目录大就手动删——删了等于放弃所有断点。这个机制也是理解下载加速的关键。3. 把安装速度提上来安装包与模型的加速下载做法3.1 下载慢的本质瓶颈不在带宽而在分片校验我第一次在一台新服务器上跑 install.sh卡了十分钟没动静。排查后发现install.sh 下载的二进制大约 1.2GB走的是 GitHub Releases 的 CDN跨地域时丢包率高curl 的默认行为是遇到中断就直接退出不会重试。而 ollama 的模型文件又以 blobs 分片形式存在官方服务器在欧洲和美国国内直连时每个分片的 RTT 都很高带宽往往跑不满。所以“下载慢”不是玄学是 TCP 连接在长距离网络下反复建连、断连导致的。处理思路也明确缩短连接距离或者提高单次连接的并发度。3.2 常见做法一用断点续传工具代替 curl如果是安装脚本这个环节卡住我会放弃脚本方式改用下载工具先把二进制文件整包拉到本地wget -c https://github.com/ollama/ollama/releases/download/v0.5.7/ollama-linux-amd64.tgz tar -xzf ollama-linux-amd64.tgz -C /usr/local/lib/ ln -s /usr/local/lib/ollama/ollama /usr/local/bin/ollama ollama --versionwget 的-c参数表示继续之前的下载任务网络中断后重跑同一条命令会从上次断点续传。手动安装还有一个好处你可以把这个 tar 包拷到 U 盘或内网机器上分发完全绕开公网。对于内网隔离的环境这是唯一可行的安装路径。注意下载前先确认版本号存在不要凭印象写 tag去 Releases 页面对一下再填。3.3 常见做法二pull 模型时的并发和超时调参模型在大文件下载阶段表现正常但一到“pulling manifest”或“verifying sha256”就长时间停住这种事在长距离网络下非常多见。OLLAMA 提供几个环境变量可以调节下载行为OLLAMA_NUM_PARALLEL控制多个模型并行加载的会话数OLLAMA_MAX_LOADED_MODELS控制在显存里同时驻留的模型数。单模型下载没有现成的并发参数所以常用的实践是用脚本把模型库预先下载好再分发而不是在目标机器上现场 pull。这也是很多人问“ollama 模型离线下载怎么做”的标准答案在一台网络好的机器上 pull 完将模型目录整个打成 tar 包拷贝到目标机器后解压到同样的OLLAMA_MODELS路径即可。注意 tar 打包时保留 blobs 分片目录结构不要只拷 manifest。3.4 把“慢”变成确定性事件先离线包后在线校验如果团队里有内网镜像仓库更省事的做法是在构建服务器上拉取 ollama 二进制与常见模型的 GGUF 文件放进内网 HTTP 服务安装时从内网地址下载。这里的关键是OLLAMA_MODELS目录一旦指定模型文件的 blob 名以 sha256 命名从官方源拉到的分片和内网源分发的分片内容完全一致校验逻辑是通用的。也就是说你可以在任何一台能连外网的机器上拉齐模型然后离线分发不需要在目标机上重复下载。这个模式对大规模内网部署非常重要也是规避“pull 永远卡在 waiting”的最可靠方案。4. 把 Ollama 装到指定盘模型路径迁移与 D 盘安装方案4.1 为什么要迁移模型体积比你想象的大得多默认情况下 ollama 把模型放进用户主目录下的 .ollamaWindows 上就是 C 盘。一个 qwen2.5 7B 的 Q4 量化版本差不多 4.7GB一个 32B 的模型超过 20GB拉三五个模型 C 盘空间立刻告急。而且 blobs 分片缓存目录下载时会占用双倍空间——下载暂存一份合并后再保留一份完整文件实际占用按“最终模型大小 最后一个分片的大小”估算比较稳妥。很多人在 C 盘爆满后才发现“ollama 怎么安装在 d 盘”这个问题动手前机器已经濒临不可用。4.2 方案对比软链接、环境变量、目录拷贝三条路我都试过先说结论新机器用“先设环境变量再安装”最干净装了一半的机器用“改目录 软链接”最省事要彻底隔离系统盘和模型盘用“迁移整个 .ollama 目录”最彻底。方案适用场景操作难度风险安装前设 OLLAMA_MODELS全新安装低无软链接模型目录已安装C 盘还能启动低软链错路径迁移整个 .ollama 并改环境变量C 盘即将爆满中pull 中断事件重新安装到新路径以上都失败高模型要重新下载4.3 操作软链接把模型库挪到 D 盘已经装好 ollama 的机器迁移步骤大概是这样的。Windows 下先停掉 ollama 服务然后移动目录、建立软链接Stop-Service Ollama -Force Move-Item C:\Users\用户名\.ollama D:\ollama New-Item -ItemType Junction -Path C:\Users\用户名\.ollama -Target D:\ollama Start-Service Ollama这里用 Junction 而不是符号链接是因为 Windows 对目录符号链接的权限要求更高Junction 不需要管理员权限就能创建且对 ollama 这种按路径读写模型的程序完全透明。Linux 下同样思路一行ln -s就能解决systemctl stop ollama mv ~/.ollama /data/ollama ln -s /data/ollama ~/.ollama systemctl start ollama注意 mv 完成后、软链建立前不要启动 ollama否则它会按默认路径重新创建空的 .ollama 目录后续拉模型时出现“明明迁移了C 盘还在涨”的诡异现象。判断迁移是否成功执行ollama list加ollama pull一个小模型试试观察 blobs 目录是否出现在新位置。4.4 操作离线环境下的整盘拷贝对于已经拉好较多模型、目标机器无法访问外网的场景我习惯用 rsync 整目录同步rsync -av --progress ~/.ollama/ /data/ollama/rsync 会按校验码对比源和目标第二次运行时只增量同步缺失的分片。这种方式在模型库超过 60GB 时特别有用比打 tar 包再传输更可控。同步完成后同样需要检查环境变量OLLAMA_MODELS是否指向新路径或者 .ollama 是否仍是软链接。一个容易忽略的点是OLLAMA_MODELS的优先级高于软链接如果环境变量指向旧路径ollama 会忽略软链接继续往旧位置写模型。5. 避坑安装与首次 pull 的 5 个高频报错记录5.1 curl 脚本执行一半中断半截安装最讨厌现象curl -fsSL …执行到一半终端静止不动或报curl: (35) SSL connect error、curl: (56) Recv failure。原因install.sh 内部调用了 curl 下载大体积二进制长距离网络下连接被重置一部分文件已经写入/usr/local/lib/ollama。解决先清理半截残留rm -rf /usr/local/lib/ollama再按 3.2 节的手动方式下载 tgz 包。如果你不确定是否残留可以看/usr/local/bin/ollama是否存在存在但时间戳是很早之前说明是老的残留一并删除。5.2 pull 卡在 pulling manifest 或 waiting现象执行ollama pull qwen2.5后长时间停留在 pulling manifest或者显示 waiting。原因manifest 阶段需要向 ollama 官方 registry 发起请求目标机器到 registry 的网络路径不通或者有安全软件拦截了 443 端口的持续连接。解决先检查 ollama serve 日志确认 registry 请求是被 reset 还是超时。超时的话设置OLLAMA_DEBUG1再启动能看到具体请求的 URL被 reset 的话通常是防火墙规则问题。如果你的网络有安全限制可以考虑按 3.4 节离线分发的模式从一台能拉取的机器上拷贝模型目录。这里没有捷径把模型离线拷过来是最稳的。5.3 Windows 下装完却找不到 ollama 命令现象OllamaSetup.exe 安装完成后打开新的 PowerShell输入 ollama 报“无法将 ollama 识别为 cmdlet”。原因安装程序没有把%LOCALAPPDATA%\Programs\Ollama加入当前用户的 PATH。解决手动加 PATH 即可setx PATH $env:PATH;%LOCALAPPDATA%\Programs\Ollama然后重开终端。注意 setx 会截断 PATH 中超过 1024 字符的内容如果你机器上 PATH 很长改用系统设置里的环境变量编辑器追加避免把其他路径冲掉。5.4 WSL 里安装太慢先确认瓶颈在虚拟网络还是源现象WSL 里执行 install.sh 要么拉取慢要么 Ubuntu 的 apt 源更新慢。原因WSL 的网络栈是虚拟化的DNS 解析和 TCP 连接都可能被宿主机安全软件影响问题不在 ollama 本身。解决如果你的 WSL 只是用来跑 ollama优先考虑装 Windows 原生版——Ollama 原生 Windows 版对 GPU 走 CUDA 直通性能不低于 WSL如果你必须在 WSL 里跑先换掉 WSL 的 DNS 配置再重试。这个建议放在避坑里是因为很多人把“WSL 里装东西太慢”和“ollama 慢”混为一谈先确认瓶颈在哪里再动手能省很多时间。5.5 更新时提示文件被占用服务还在后台现象Windows 上更新 OllamaSetup.exe 时提示“已在运行”或“文件被占用”升级失败。原因tray 程序和服务还在后台持有文件句柄。解决先退出托盘图标再执行net stop ollama停服务然后在任务管理器确认无 ollama.exe 残留进程。升级完成后再启动服务。macOS 上类似更新 dmg 前先退出菜单栏图标。这个坑很小但容易在升级时卡住顺手写在这里给后来人提个醒。6. 从“装好”到“用得顺手”服务自启、连通性验证与第一个对话6.1 三条命令确认安装与模型都是通的装完并拉好第一个模型后验证别急着开浏览器三条命令就能确认状态ollama list # 列出本地模型确认模型 manifest 已就位 curl -s http://localhost:11434/api/tags | head -c 200 # 确认 serve 监听端口 ollama run qwen2.5:7b 你好 # 执行一次推理确认后端能加载并出 token如果第二条返回空说明服务没起来如果 curl 有响应但ollama run报 connection refused多半是环境变量里的 host 配置不一致检查有没有设过OLLAMA_HOST。6.2 把服务注册成开机自启并限制监听地址Linux 下脚本安装已经默认注册 systemd 服务我一般确认一下状态并设置开机启动systemctl status ollama systemctl enable ollama systemctl edit ollama # 追加 EnvironmentOLLAMA_HOST127.0.0.1:11434这里用systemctl edit而不是直接改/etc/systemd/system/ollama.service是因为 ollama 升级时会重写 service 文件覆盖你的所有修改。用 override 片段可以保证升级后配置仍在。局域网内如果有其他机器要访问OLLAMA_HOST改为0.0.0.0:11434但要注意这个端口无鉴权生产环境最少设一道防火墙规则或反代。6.3 给 Open WebUI 留一个可用的地址装完 ollama 之后很多人会顺手配 Open WebUI 做可视化对话它本质上就是连 localhost:11434 的 HTTP 接口。验证兼容性只需要看两处ollama serve 是否在监听以及/api/tags能否返回模型列表。如果 Open WebUI 那边报“Connection refused”别急着改它的环境变量先 curl 一下本机端口——大概率是 ollama 服务挂了或监听地址不是预期的那个。这个小习惯让我少踩很多回“明明模型装好了却连不上”的坑。最后说一句我的个人习惯凡是涉及“下载慢、路径迁移、装不上”这种问题我都会先把OLLAMA_DEBUG1开起来跑一遍看它实际在哪个阶段卡住再决定是调网络还是调路径。技术栈再复杂思路都是这一条——先确认瓶颈再动手改。希望帮到你。本文还有配套的精品资源点击获取