GetQzonehistory完整教程:三步免费导出QQ空间全部历史说说
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
你有没有过这样的瞬间——深夜翻自己的QQ空间,想找十年前发过的那条说说,可手指划了十分钟,最新一条动态还停在上个月?平台只给你看最近的内容,那些记录青春的文字、照片、留言,像是被扔进了时间的碎纸机,怎么翻都翻不回来。
这不是你的记忆丢了,而是它们真的"沉底"了。但好消息是:有个免费开源的 Python 工具 GetQzonehistory,能把你账号下发布过的历史说说、转发、留言、好友互动全部捞回来,整理成 Excel、网页和图片,永久存在你自己电脑上。今天这篇教程,就带你一步步把它用起来。
它能帮你做什么?五个让你心动的理由
先别急着看代码,咱们先把话说清楚——装好这个工具,你具体能得到什么:
| 你能拿到的 | 具体是什么 |
|---|---|
| 🗂️ 完整数据档案 | 账号下所有历史消息,一键导出成 Excel 表格 |
| 📝 个人说说专集 | 你自己发过的每条说说,含发布时间、正文、配图链接 |
| 🔄 转发内容存档 | 所有转发记录,不再担心"原链接失效就没了" |
| 💬 好友留言宝库 | 好友在你空间的留言历史,一条都不漏 |
| 👥 社交关系清单 | 互动过的好友昵称、QQ号、空间主页,全部整理成表 |
| 🖼️ 图片单独保存 | 说说里的每张配图自动下载到本地 pic 文件夹,按内容命名 |
| 🌐 网页版还原 | 生成一个 HTML 页面,像翻空间一样浏览你的全部说说 |
一句话总结:你曾经发过的每一条"痕迹",都能变成躺在你硬盘里的永久文件。整个过程在你自己的电脑上完成,不需要把密码交给任何第三方。
它背后的工作逻辑:四步接力,各司其职
GetQzonehistory 的实现思路并不神秘,就像一条流水线,四个环节各管一段(项目里每个环节对应一个独立模块,想深入研究的可以直接翻源码):
第一步 扫码登录(util/LoginUtil.py):程序会生成一个二维码,你用手机 QQ 扫一下就能登录,全程不用输入密码,跟网页版空间登录体验一模一样。登录后的凭证还会被保存下来,下次运行可以免登录直接接着用。
第二步 数据抓取(util/RequestUtil.py):拿到登录凭证后,程序开始向空间的数据接口发起请求,先把"历史消息列表"完整拉下来。这里还有个贴心设计——util/GetAllMomentsUtil.py会再补抓一遍"当前仍可见的说说",两路数据合并去重,覆盖更全。
第三步 数据清洗(util/ToolsUtil.py):原始数据是乱糟糟的 HTML 和 JSON,这个模块负责解析、去重、处理表情符号和特殊字符,把每条记录整理成"时间、内容、图片链接、评论"这样规整的结构。
第四步 结果输出:最后把所有数据写成多种格式文件,放到resource/result/你的QQ号/目录下,并自动打开文件夹给你看成果。
小小提示:它读取的是空间"历史消息列表",所以消息列表里没出现过的内容(比如仅自己可见的说说)是抓不到的,这点先有个心理预期。
最快上手路径:三分钟跑起来
工具虽好,怎么快速用起来才是关键。别担心,整个流程比你想象中简单,跟着下面三步走就行。
1. 把项目拿到本地
先确认电脑上装了 Python 3.6 或更高版本,然后打开终端,克隆项目:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory.git cd GetQzonehistory建议顺手创建一个虚拟环境(隔离依赖,避免污染系统环境,这步对新手尤其友好):
python -m venv myenv # Windows 激活方式 myenv\Scripts\activate # macOS / Linux 激活方式 source myenv/bin/activate2. 安装依赖包
项目把需要的库都写在requirements.txt里了,一条命令搞定:
pip install -r requirements.txt这些依赖都是干嘛的?用大白话说:requests负责跟 QQ 空间"聊天"要数据,beautifulsoup4负责读懂网页内容,pandas负责把数据整理成表格,qrcode和pyzbar负责生成和识别登录二维码,各司其职、缺一不可。
3. 运行并扫码
python main.py程序跑起来后,终端里会显示一个二维码,掏出手机 QQ 扫一下确认登录。接下来你只需要盯着进度条,看着它一页一页地把历史数据抓回来(每读一批会自动休息几秒,这是为了不触发平台风控,属于正常现象)。跑完后程序会自动打开结果文件夹。
导出结果长什么样?一张图看懂
全部跑完后,你会在resource/result/你的QQ号/目录下看到一整套成果文件,结构清晰得像一个"数字记忆档案柜":
- 6 个 Excel 文件:全部列表、说说列表、转发列表、留言列表、好友列表、其他列表,各有各的用途;
- 1 个 HTML 网页:还原空间样式的说说浏览页,图片、评论、头像都在,翻起来很有当年内味儿;
- 1 个 pic 文件夹:所有配图已自动下载,按说说内容命名,重名图片还会自动加后缀避免覆盖。
每个 Excel 文件都遵循同样的结构逻辑:时间精确到秒、内容原样保留、图片链接单独成列、评论数据结构化存储。这意味着你拿到的不是一堆"死数据",而是可以直接扔进 Excel 或 pandas 里做分析的"活数据"。
进阶玩法:把历史数据玩出花样
工具导出完成后,好戏才刚刚开始。这里给你四个创意方向,试过就知道多有意思:
1. 做一份自己的"成长时间线":把说说列表导入表格工具,按年份统计发布数量、提取关键词,看看大学四年你的情绪曲线是怎么变化的——原来毕业那年你发了那么多条"不想说再见"。
2. 画出你的"社交关系网":用好友列表和评论数据交叉分析,找出这些年评论你最多、点赞最频繁的人。你会发现有些人已经很久没联系了,但当年他/她真的陪了你很久。
3. 制作家庭数字记忆库:把全家人的导出结果汇总到一个文件夹,按时间线排列,再配上 HTML 网页版,一部家庭编年史就诞生了,逢年过节放给长辈看,比翻相册还有杀伤力。
4. 跨平台备份的起点:Excel 数据是通用格式,可以导入 Notion、语雀等笔记工具,或者转成 Markdown 归档。关于转 Markdown,项目里的fetch_all_message.py本身就提供了一个参考实现,它会把说说、配图、评论、转发整理成一篇结构化文档,思路可以直接借鉴。
常见问题速答:新手最容易卡住的三个点
问:扫码后一直显示"二维码已失效"怎么办?二维码有有效期,失效了程序会自动刷新并重新生成,重新扫一次就好。确保手机 QQ 是最新版本,同时注意别让二维码在屏幕外停留太久。
问:跑着跑着突然中断了,之前的数据会丢吗?不会全丢。程序在手动中断(比如按 Ctrl+C)时会触发信号处理机制,先把已抓到的数据保存下来再退出,这一点在main.py的信号处理函数里写得很清楚。重新运行即可继续,已缓存的数据不会重复抓取。
问:导出的数据好像少了一部分?前面说过,它依赖空间的消息列表,仅自己可见的说说、以及从未出现在消息列表里的内容会抓不到。如果发现确实缺失,可以隔段时间再跑一次,两轮结果合并,覆盖率会更高。
问:macOS 上运行提示找不到 zbar 库?这是扫码识别库的依赖问题,用 Homebrew 装一下就好:brew install zbar。装完再重新跑程序即可,项目里也内置了相关的检测和引导逻辑。
写在最后:你的过去,值得被认真保管
说真的,QQ空间承载的不只是"社交动态",那是我们这代人的电子成长日记。当年那些现在看来有点"中二"的说说、凌晨三点发的矫情文字、老同学在留言板上的互相打趣——它们不该只活在平台服务器里,更不该随着时间悄悄消失。
GetQzonehistory 做的事情很简单:把本该属于你的记忆,还给你。整个过程免费、开源、代码透明可审计,你完全清楚它在你电脑上做了什么。花一个下午设置好它,换回的是一整个青春的完整备份。
现在就打开终端,克隆项目、装好依赖、扫码登录。等导出完成、文件夹打开的那一刻,你会明白——有些东西,值得被好好存着。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考