番茄小说离线下载全攻略:三分钟搭建专属阅读资料库

番茄小说离线下载全攻略:三分钟搭建专属阅读资料库

番茄小说离线下载全攻略:三分钟搭建专属阅读资料库

【免费下载链接】fanqienovel-downloader下载番茄小说项目地址: https://gitcode.com/gh_mirrors/fa/fanqienovel-downloader

开源工具 fanqienovel-downloader(番茄小说下载器)用 Python 实现整本小说的抓取与保存,支持导出 TXT、EPUB、HTML 等五种格式。它的核心价值很简单:把在线阅读变成本地资产——网断了能看、书下架了还在、换设备不重下。下面按"它能做什么 → 内部怎么跑 → 三分钟上手 → 常见卡点 → 进阶玩法"的顺序,带你一次性摸清它的全部用法。

第一层:一个链接,换回整本书

先看最朴素的使用方式:拿到小说的目录页链接,或直接复制一串书籍 ID,回车之后,下载器会自动识别章节结构,把正文逐章抓取到本地。这意味着三件事随之改变:

  • 网络不再是阅读的瓶颈。高铁、地铁、地下室,任何信号死角都能继续读。
  • 平台变动不再令人恐慌。小说下架、章节锁定,都不影响你已有的本地副本。
  • 多设备同步有了统一答案。导出一次,手机、平板、电纸书、电脑各自认领一份。

它还不只是一次性下载工具。程序内置了更新检测:只要读取record.json里记录过的书籍 ID,就能自动对比并补抓新增章节,追更连载小说时每天跑一次即可。搜索与批量下载同样内置,输入关键词找书、把多本书排进队列依次处理,都是现成功能。

第二层:五种格式,按需取用

项目目前(v1.1.14)的保存方式共有五种,对应不同阅读习惯:

序号保存方式适合谁
1整本保存(单文件 TXT)追求简单,一个文件装下全书
2分章保存(每章一个 TXT)需要按章节整理、批注的用户
3EPUB 电子书格式Kindle、微信读书等阅读器用户
4HTML 格式浏览器直接打开即读,样式友好
5LaTeX 格式排版控、需要二次编辑整理的玩家

选型建议:日常手机阅读用 EPUB 体验最好;存储空间紧张时退回 TXT,体积最小;需要后续做内容处理再考虑分章与 LaTeX。这些选项可以在设置中随时切换,无需安装额外转换工具。

第三层:三分钟快速上手

浏览器版:一行命令启动下载服务

这是对新手最友好的入口,图形界面、实时进度条、下载队列、在线预览阅读器一应俱全:

git clone https://gitcode.com/gh_mirrors/fa/fanqienovel-downloader cd fanqienovel-downloader pip install -r requirements.txt cd src python server.py

浏览器打开http://localhost:12930,就能看到简洁的管理界面:按 ID 下载、按书名搜索、更新已下载小说、把多本书加入队列批量处理,进度一目了然。由于 Web 版下载完成后直接把文件交给你,它完全可以部署在远程服务器或容器里,随时调用。

命令行版:六个数字走天下

偏好键盘操作的话,进入src目录运行python main.py,交互菜单只认六个数字:

  1. 输入 ID 或链接——立即下载单本书
  2. 输入 1——读取record.json更新已下载书籍
  3. 输入 2——关键词搜索
  4. 输入 3——批量下载多本书
  5. 输入 4——设置段首占位符、下载延时、保存路径、保存方式、线程数
  6. 输入 5——备份小说文件与下载配置
  7. 输入 6——退出程序

每层选择都有中文提示,跟着提示走即可,几乎不需要看文档。

Docker 版:服务器上长期服役

想在 NAS 或云服务器上常驻运行,用 Docker 最省心:

docker compose up -d

构建完成后访问http://localhost:12930。下载的小说和个人数据分别存放在名为fanqie_datafanqie_downloads的 Docker 卷中,容器销毁数据不丢;想改存储位置,编辑docker-compose.yml里的卷映射即可。镜像默认还带 1G 内存上限,避免长期运行挤占主机资源。

第四层:别踩这些坑

  • 旧版本直接失效:v1.1.5 及以下版本因网站 API 变动已无法使用,务必使用 v1.1.6 及以上版本。
  • 代理导致的连接失败:如果报ProxyError/MaxRetryError,多半是系统代理或加速器拦截了请求,关闭代理、检查网络后重试即可。
  • 设置会被整体覆盖:修改设置中的任意一项都会覆盖原配置文件,改前先看清楚;想恢复默认,直接删除config.json重启程序。
  • 老版本 Python 的兼容处理:Python 3.8 及以下环境,进入src目录后需删除原main.py,并把main2.py改名为main.py再运行。

第五层:进阶玩家的玩法

手机端离线配置三步走

在 Android 上装好 Termux 后,按下面顺序操作即可跑起命令行版(运行的是ref_main.py):

pip install requests ebooklib tqdm beautifulsoup4

注意先把ref_main.py里的 tkinter 导入删掉;若安装 lxml 编译报错,改用CFLAGS="-O0" pip install lxml重装。之后运行python ref_main.py就能在手机上直接下载整本书,通勤路上离线阅读完全够用。

把下载速度调到舒适区间

src/main.py中的Config定义了四个关键参数,修改后保存在config.json

参数默认值含义
delay[50, 150]章节请求间隔(毫秒),网络差可调大
xc16并发下载线程数,过高易触发限制
save_mode1保存方式,对应上文五种格式
save_path默认下载目录小说保存位置

网络状况良好时,可以适当降低延时、把线程数提到 24 左右;手机端运行则建议调低线程数,避免过热。

批处理脚本批量收藏

对整批书籍,可以写一段简单的循环脚本,逐本调用下载命令:

novel_ids=("7143038691944959011" "7123456789012345678") for id in "${novel_ids[@]}" do echo "开始下载:$id" python main.py <<< "$id" sleep 2 done

周边工具接力

项目还配套了几个实用小工具:用于检测番茄小说网页结构变化的检测程序、在已下载小说中做全文搜索的搜索工具、按文件大小切分超长小说的分割工具。下载、搜索、分卷三步串联,就能搭建一套完整的个人小说管理流水线。相关说明集中在项目根目录的README.mdphone.md中,按需查阅即可。

写在最后

说到底,这个工具的价值不在"爬取"本身,而在于把阅读的主动权交还给你:不受信号摆布、不惧内容下架、不被单一设备绑架。项目遵循 AGPL-3.0 协议开源,由 Yck、Yqy、Lingo 三位开发者维护,也欢迎你在 Issues 里反馈问题或提出建议。

动手之前记得守住边界:仅用于个人学习、研究与离线阅读,不要高频抓取、不要商用传播,尊重作者版权。现在就按上面的步骤跑通第一本书吧——三分钟之后,你的专属离线阅读资料库就正式开张了。遇到问题可到项目 Issues 交流,或加入交流群 428582738 与开发者和其他用户一起讨论。

【免费下载链接】fanqienovel-downloader下载番茄小说项目地址: https://gitcode.com/gh_mirrors/fa/fanqienovel-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考