Papermerge 文档管理系统完整部署指南:Docker 一键搭建你的数字档案中心 📅 发布时间:2026/8/22 20:27:51 👁 浏览次数: Papermerge 文档管理系统完整部署指南Docker 一键搭建你的数字档案中心【免费下载链接】papermergeOpen Source Document Management System for Digital Archives (Scanned Documents)项目地址: https://gitcode.com/gh_mirrors/pa/papermerge一堆发票、合同、扫描件堆在硬盘里找一份文件要翻半天Papermerge 是一款开源文档管理系统专为扫描文档设计它自动对 PDF、图片做 OCR 识别、建索引然后支持全文检索。跟着本文操作你大概十分钟内就能拥有自己的数字档案中心把散落各处的扫描文档管起来。 环境与素材准备开工前对照这份采购清单检查一遍项目要求系统支持 Docker 的 LinuxmacOS / Windows 装 Docker Desktop 亦可依赖Docker 与 Docker Composedocker compose可用内存至少 2 GBOCR 高峰期建议 4 GB磁盘至少 20 GB 可用空间文档库会持续增长网络能拉取 Docker Hub 镜像不需要在系统里装 Python、PostgreSQL 这些依赖Docker 镜像全部打包好了。拉取部署所需的仓库git clone https://gitcode.com/gh_mirrors/pa/papermerge cd papermerge执行后目录下会出现docker、config等文件夹说明仓库就绪。 核心部署流程Step 1进入 docker 目录并启动全部服务docker/docker-compose.yml里定义了四个组件主应用、PostgreSQL 数据库、Redis 缓存、负责 OCR 的 worker。进入目录后一条命令拉起它们cd docker docker compose up -d首次执行会拉取eugenci/papermerge:2.0.0等镜像耐心等进度走完。Step 2确认服务全部在线拉取完成后用这条命令查看四个容器的运行状态docker compose ps你应该看到papermerge_app、postgres_db、redis、papermerge_worker四个容器状态都是Up。app 容器第一次启动会自动执行数据库迁移并初始化管理员账号稍等一两分钟即可访问。Papermerge 数字档案界面双栏浏览、标签与文件夹扫描文档全文检索一目了然⚙️ 首次运行与基础配置浏览器打开http://localhost:8000用默认账号登录用户名admin密码admin登录后先做三件事改掉 admin 密码建一两个常用文件夹如发票合同上传一份 PDF 测试 OCR 和全文搜索是否生效。日常会动到这几个配置文件都在docker/config/下papermerge.config.py改 OCR 默认语言和语言列表决定扫描文档识别成哪种文字app.production.py应用层设置数据库连接、Celery 任务队列都走这里worker.production.pyworker 节点配置OCR 排队慢时可从这里排查Papermerge 文件管理界面文件夹层级与文档预览管理扫描文档像操作本地磁盘 踩坑与排障服务起不来、页面打不开怎么办现象访问 8000 端口超时或白屏。原因通常是容器没起来或迁移卡住。先拉日志定位docker compose logs -f看到报错后重启对应容器即可docker compose restart app8000 端口被占用了现象启动后提示端口冲突。原因是别的程序先用了 8000 端口。编辑docker/docker-compose.yml把端口映射改成你想要的ports: - 8080:8000改完执行docker compose up -d生效之后用http://localhost:8080访问。文件传进去了但一直没有 OCR 文本现象文档能预览全文搜索却搜不到内容。原因是 worker 没跑起来或 OCR 语言包不支持你的文档语言。确认 worker 存活并重建docker compose up -d worker语言问题去papermerge.config.py里加对应语言码见下节进阶。上传大文件被拒现象上传超过 20 MB 的 PDF 报 413 错误。原因是启动脚本把请求体上限设成了 20 MB。改docker/app.startup.sh里--limit-request-body的数值单位字节如 50 MB 填52428800再docker compose up -d重建 app 容器。数据怎么备份现象扩容或换机器前需要迁移。所有文件都落在media_root数据卷、元数据在postgres_data7卷里。先停机再导出docker compose down docker run --rm -v papermerge_media_root:/media -v $(pwd)/backup:/backup alpine tar czf /backup/media.tar.gz -C /media .恢复时反向解压回对应卷即可。 进阶玩法给 OCR 换语言默认识别德语中文用户先把它换掉。在docker/config/papermerge.config.py里改OCR_DEFAULT_LANGUAGE eng OCR_LANGUAGES { eng: English, deu: Deutsch }改完重启 app 和 worker之后上传的文档就按新语言识别搜索结果立刻靠谱。用自动化规则给文档自动打工管理界面里可以建 Automation 规则上传的 PDF 自动匹配文档类型、打上彩色标签、扔进指定文件夹。比如建一条文件名含 rechnung 的自动归类到发票文件夹从此上传即归档零手工操作。页面级管理扫描文档支持删页、调序、抽取页面把多份单页 PDF 合并成一份或者从一本大册子里抽出第 3 页单独存全部在界面上拖拽完成。这是做数字档案时最好用的功能之一。 收尾与延伸回到开头那个场景现在你的发票、合同、扫描件都有地方放了搜一个关键词就能翻出三年前的那页纸。Papermerge 把存起来变成用得上这就是数字档案的价值。想继续深入可以从这几处入手changelog 看版本更新CONTRIBUTING.md 了解项目结构与贡献方式示例数据目录 里准备了德语、英语的页面管理用例 PDF可以直接拿来练手。现在就去登录你的 Papermerge配第一条自动化规则吧。【免费下载链接】papermergeOpen Source Document Management System for Digital Archives (Scanned Documents)项目地址: https://gitcode.com/gh_mirrors/pa/papermerge创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考