GetQzonehistory 备份攻略:十分钟把 QQ 空间说说完整归档到本地
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
如果你还在一张张截图保存 QQ 空间里的说说,那真的会累哭。GetQzonehistory是一款专门用于抓取并导出 QQ 空间历史说说的开源小工具,登录一次、等它跑完,你的文字、配图、评论、转发就能整整齐齐地躺在本地文件夹里,随时翻看、随时迁移。这篇教程会带你在十分钟内完成人生第一次"空间全量备份",全程不碰密码、不传云端,自己动手就能做到。
在动手之前,先看看你的备份会长什么样
空口无凭,先带你看一下工具跑完之后的"战利品"。整个导出以你的 QQ 号作为文件夹名,统一存放在resource/result/下面,里面有五类 Excel 表格、一个网页版时间线和图片目录:
是不是很清爽?所有原始数据都被拆成了独立文件,说明你不仅"存下来了",还"分好类了"。后面想按年份回忆、想写年度总结、想把照片导进相册,都有现成材料可以用。
为什么说现在就是备份 QQ 空间的最好时机
很多人觉得"说说就在那里,又不会消失"。但现实是:
- 平台规则调整、老数据归档、账号异常,都可能让部分内容悄悄"消失";
- 有些历史说说在空间里已经不可见,但接口里还能捞回来,错过就真没了;
- 手动截图备份不仅慢,图片清晰度还会打折,评论也截不全。
GetQzonehistory解决的正是这些痛点:完全本地处理(数据不经过任何第三方服务器)、官方二维码扫码登录(不输入密码)、自动下载原图(图片链接永不失效)、多格式导出(Excel + 网页版双保险)。说白了,它就是给你 QQ 空间记忆上的一道本地保险。
第一步:装好 Python 环境,三分钟搞定
工具基于 Python 开发,Windows、macOS、Linux 都能跑。你只需要确认电脑上装了Python 3.6 及以上版本,然后在终端里输入python --version验证一下即可。
克隆项目到本地
打开终端,执行:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory创建并激活虚拟环境
虚拟环境能把依赖隔离起来,避免污染系统 Python,强烈建议新手用它:
python -m venv myenv激活方式按系统区分:
# Windows 系统 .\myenv\Scripts\activate # macOS / Linux 系统 source myenv/bin/activate激活成功后,你的终端提示符前面会出现(myenv)字样,说明环境已就绪。
安装依赖包
项目所需依赖都写在requirements.txt里,一条命令装完:
pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt这里用了国内镜像源,下载速度更快。如果网络环境特殊导致安装失败,也可以去掉-i参数改用官方源重试。
第二步:启动程序,用手机 QQ 扫码登录
依赖装好后,直接运行主程序:
python main.py程序会自动做三件事:
- 生成登录二维码并打印在终端里(黑底白块,用手机 QQ 扫一扫即可);
- 扫完后自动完成身份校验,全程不需要你输入账号密码;
- 登录状态会被缓存到本地,下次再运行可以直接选择已登录的账号,连扫码都省了。
小提示:如果第一次扫描没反应,多半是二维码已过期,重新运行程序生成新码就行。
第三步:坐等抓取,理解它到底在做什么
登录成功后,程序会自动开始干活。它的整体逻辑很简单,就五步:
用大白话解释这个流程:
- 采集:模拟浏览器访问 QQ 空间接口,按批次拉取历史互动消息;
- 解析:把拿到的 HTML 数据清洗成结构化字段(时间、内容、图片链接、评论);
- 筛选:按"是谁发的"把内容归类——你发的原创说说、你转发的、留言、其他互动;
- 异常补充:消息列表可能有遗漏,工具会额外走一遍"可见说说"接口,把能找回的历史说说补全;
- 整合:最终把所有数据合并、去重,再进入保存环节。
抓取过程中你会看到一个进度条,程序每读十条会主动休息三秒,这是为了避免给 QQ 服务器造成压力,属于正常现象,耐心等就行。
第四步:检查导出成果,每一份文件都有用
跑完后,程序会自动打开resource/result/你的QQ号/文件夹,并且打印每类数据的统计数量。你会得到这些文件:
| 文件 | 内容 | 适合谁用 |
|---|---|---|
QQ号_说说列表.xlsx | 你的原创说说,含时间、内容、图片链接、评论 | 写回忆录、做数据分析 |
QQ号_转发列表.xlsx | 你转发过的内容 | 整理"转发过什么" |
QQ号_留言列表.xlsx | 好友在空间留下的留言 | 收藏好友祝福 |
QQ号_其他列表.xlsx | 其他互动内容 | 完整存档 |
QQ号_好友列表.xlsx | 抓取过程中出现的互动好友 | 清理社交关系 |
QQ号_全部列表.xlsx | 上述内容的汇总 | 一次看全 |
QQ号_说说网页版.html | 还原网页版样式的动态时间线 | 离线浏览、分享给家人 |
pic/目录 | 所有说说配图,按内容关键词命名 | 永久保存照片 |
Excel 打开就能用 Excel、WPS 或 Python 的 pandas 库二次加工,比如按年份统计发布频率、分析高频词、找出深夜发说说的习惯等。HTML 文件则把时间倒序、头像评论全都还原出来,双击即可离线浏览,视觉效果和网页版 QQ 空间几乎一致。
顺带一提,如果你的说说数量特别多,程序在手动中断(Ctrl+C)时也会先把已抓到的数据保存下来,不会白跑。
常见问题:报错排查一站解决
新手第一次跑,遇到点小波折很正常。下面是出现频率最高的几个问题,照着处理就行:
| 问题现象 | 可能原因 | 解决方案 |
|---|---|---|
| 扫码后提示登录失败 | 网络波动或手机 QQ 未登录 | 确认手机 QQ 在线,重新运行程序生成新二维码 |
| 提示找不到 zbar 库 | macOS/Linux 缺少图像识别依赖 | macOS 用brew install zbar,Linux 按发行版安装 zbar 后重试 |
| 抓取到一半没有新数据 | 接口限制或网络不稳定 | 直接再次运行程序,登录态已缓存,会自动续抓 |
| 图片下载失败或较少 | 部分链接已失效 | 从 Excel 里的图片链接手动补下载,或检查pic/目录权限 |
| 依赖安装报错 | Python 版本或网络问题 | 确认 Python ≥ 3.6,用python -m pip install --upgrade pip升级 pip 后再装 |
安全使用:备份数据请像对待日记本一样
工具本身的安全设计已经足够让人放心——不存密码、不上传数据、代码全开源,任何一步都能被审查。但数据到了本地之后,保护责任就落在你身上了。建议做到这几点:
- 用完清理登录缓存:备份完成后,可删除
resource/user/里的登录凭证文件,避免账号信息长期留在电脑上; - 重要备份加密存储:把导出的文件夹压缩后加上密码,或放进加密云盘;
- 多地备份:本地一份、移动硬盘一份,双保险才安心;
- 遵守使用边界:本工具仅限学习与个人数据备份,请勿用于任何商业或侵犯他人隐私的场景。
从今天起,给你的青春上个保险
说到底,备份这件事拼的不是技术,而是"要不要开始"。GetQzonehistory已经把最麻烦的抓取、分类、下载、排版全部自动化了,你要做的只是装好环境、扫一次码、等几分钟。趁着今天有空,打开终端跑一遍,把那些说说的记忆稳稳地留在自己的硬盘里吧——以后任何时候想翻,它们都在。
进一步学习资源
- 项目源码:main.py、fetch_all_message.py
- 核心登录逻辑:util/LoginUtil.py
- 请求与解析模块:util/RequestUtil.py、util/GetAllMomentsUtil.py
- 数据清洗工具:util/ToolsUtil.py
- 路径配置说明:util/ConfigUtil.py
现在,去给你的 QQ 空间说说做一次完整的本地备份吧。十分钟后,你会感谢现在动手的自己。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考