GetQzonehistory 使用指南:从扫码到 Excel,QQ空间历史说说一次备份
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
大学入学那年发的第一条说说,你还找得到吗?它大概率还躺在 QQ 空间的消息列表里,只是不好翻、不好归档。GetQzonehistory 是个 Python 小工具:扫码登录后,自动翻遍你的历史消息,把历史说说、转发、留言整理成 Excel 表格、还原版网页和本地图片,全部落在自己电脑上。
它到底能捞回哪些记录
这个工具不直接爬说说动态页,而是走消息列表通道:main.py分页翻完账号的历史消息列表,逐条取出时间、正文、图片链接和评论;再补抓一遍空间里当前可见的说说,两边去重后合并落盘。这意味着你自己删除过的内容找不回来,"仅自己可见"的说说也拿不到——消息列表里有什么,就能导出什么。
另外提前说一句:登录走官方二维码通道,账号密码全程不经手;所有请求从你机器发出,文件写进你的硬盘,数据不经过第三方服务器。
从零跑通:克隆、装依赖、扫码
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory建一个虚拟环境再装依赖(Windows 用myenv\Scripts\activate激活,macOS/Linux 用下面命令):
python -m venv myenv && source myenv/bin/activate pip install -r requirements.txt然后运行:
python main.py终端会打出一张二维码,用手机 QQ 扫一下、确认登录,抓取随即开始。依赖不多,各管一摊:
requests:发送网络请求beautifulsoup4:解析消息列表页的 HTMLpandas/openpyxl:整理数据、生成 Exceltqdm:终端进度条Pillow:图片下载处理qrcode:生成登录二维码
导出结果在哪个目录、分几类
📦 跑完后你会得到一套完整的历史说说备份,全部放在resource/result/你的QQ号/目录下,按类别各存一份:
| 文件 | 内容 |
|---|---|
全部列表.xlsx | 全部历史记录,按时间排序 |
说说列表.xlsx | 你发布的说说:时间、正文、图片链接、评论 |
转发列表.xlsx | 转发过的内容,保留原始信息 |
留言列表.xlsx/好友列表.xlsx | 好友留言存档、互动过的好友(昵称、QQ 号) |
说说网页版.html | 还原版网页,图片可在线预览 |
pic/ | 说说里提到的图片,全部下载到本地 |
图片以说说正文命名,重名时自动追加时间戳后缀防止覆盖,文件名最长截到 40 字符。网页版会自动换成高清图源、把 QQ 表情还原成图片,浏览器直接打开就能翻。
抓多快?中断了怎么办
抓取按批进行:每批 10 条,批间停顿 3 秒,节奏大约在 100-200 条/分钟,总时长看你的说说数量。中途出问题也有两道保险:
- Ctrl+C 不白跑:程序注册了中断信号处理,退出前会先把已抓数据存盘。
- 重跑自动去重:再次运行时已抓到的内容会被识别跳过,接着继续即可。
因为每张图片都会真实下载,建议给重度图片用户预留 500MB 左右的磁盘空间,并挑网络平稳的时段跑。
进阶玩法:把可见说说导出成 Markdown 📝
如果你更想要一份可读的文档而不是消息列表,项目里有个独立脚本fetch_all_message.py:它按每页 30 条抓完所有未删除的可见说说,把正文、转发内容和逐条评论写成 Markdown,存到resource/fetch-all/所有可见说说.md,高清图同步保存。覆盖范围包含 2014 年之前的早期内容,适合整理成自托管的回忆册,或迁移进自己的博客。
写在最后:数据归属与边界
导出的文件是你自己的个人数据,备份到自己可控的存储里才是最靠得住的做法——云端服务和第三方归档都有失效的可能。这个工具适合用来存档自己的回忆、做学习和研究,请遵守平台服务条款,别拿它去抓取或公开他人的隐私内容。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考