GetQzonehistory 完整指南:1 次扫码,3 步导出 QQ 空间十年历史说说
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
凌晨想找三年前发的那条说说,划到底只剩几十条记录——QQ 空间没有官方导出入口,平台侧的互动消息也只保留部分历史。GetQzonehistory 是一个把 QQ 空间历史说说批量导出到本地的纯 Python 工具:1 次官方扫码登录,之后全自动,十几分钟就能把说说过往、评论和配图完整搬进 Excel 和图片库。
边界说明:能导出什么,导出不了什么
数据从两条通道来,覆盖范围先说死:
- 历史消息列表:你和好友互动产生的完整流水,按每批 10 条分页抓取,批与批之间停 3 秒。
- 未删除的可见说说:30 条一页翻页抓,能翻到 2014 年之前的记录,配图一并下载,并尽量替换成高清链接。
两条通道的结果合并去重后落盘。有一小块数据谁都拿不回来:设为"仅自己可见"且没出现在消息列表里的说说,公开接口和互动流里都没有它们的影子——这是数据源的物理限制,不是工具不够强。
登录走官方扫码,全程不碰密码。凭证以 cookie 形式存在本地resource/user/目录,重复运行时输入序号即可复用,显示失效就重新扫。
和手动截图存档比:成本差在哪
| 对比项 | 手动截图 / 复制 | GetQzonehistory |
|---|---|---|
| 覆盖范围 | 翻到哪算哪,零散几条 | 消息列表 + 可见说说双通道 |
| 图片 | 截图压缩,画质打折 | 自动下载,替换高清链接 |
| 评论互动 | 基本丢失 | 随说说保留,网页版照常渲染 |
| 登录 | 手输密码或手动维护会话 | 官方扫码,不碰密码 |
| 耗时 | 几小时体力活 | 一次配置,之后全自动 |
还有一个反直觉的点:你的可恢复上限就是消息列表的长度,平台每裁一次,上限就矮一截。备份这件事,早跑一次少亏一次。
三步完成:克隆、登录、落盘
准备环境:克隆仓库并激活 Python 虚拟环境
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory && python -m venv myenv source myenv/bin/activate✅ 完成标志:终端提示符前出现(myenv)前缀。
💡 激活报错多半是myenv不在当前目录;Windows 用户把第三步换成myenv\Scripts\activate。
运行项目:安装依赖并扫码登录 QQ 空间
pip install -r requirements.txt python main.py✅ 完成标志:手机 QQ 扫码确认后,终端打印用户<QQ号>,<昵称>登录成功。
⚠️ Linux / macOS 若报pyzbar相关错误,是系统缺 zbar 图像识别库,按程序提示安装(RPM 系用sudo dnf install -y zbar)再重跑;提示"二维码已失效"就重新运行python main.py再生成一次。
核对结果:等进度条走完,打开导出目录
ls resource/result/✅ 完成标志:终端依次打印消息条数、最早一条说说时间、好友数、图片数,文件管理器自动弹出结果文件夹。
💡 中途想停按 Ctrl+C 即可:程序注册了信号处理,会先保存已有数据再退出,重跑时新数据按内容去重合并,不会丢。
结果核对:8 个文件的导出清单
全部成果落在resource/result/你的QQ号/下,保存位置可在 配置文件 调整:
| 文件名 | 内容说明 |
|---|---|
| QQ号_全部列表.xlsx | 全部互动消息的完整时间线 |
| QQ号_说说列表.xlsx | 本人发布的原创说说 |
| QQ号_转发列表.xlsx | 转发过的内容 |
| QQ号_留言列表.xlsx | 收到的留言记录 |
| QQ号_好友列表.xlsx | 互动好友的昵称、QQ、主页 |
| QQ号_其他列表.xlsx | 未归入以上分类的其余内容 |
| QQ号_说说网页版.html | 还原空间样式的可视化页面 |
| pic/ 目录 | 说说配图,按内容自动命名归档 |
目录结构长这样:
resource/result/ └── 你的QQ号/ ├── QQ号_全部列表.xlsx ├── QQ号_说说列表.xlsx ├── QQ号_转发列表.xlsx ├── QQ号_留言列表.xlsx ├── QQ号_好友列表.xlsx ├── QQ号_其他列表.xlsx ├── QQ号_说说网页版.html └── pic/表格列结构固定为「时间、内容、图片链接、评论」四列,方便后续用代码直接读取。
常见问题:登录与导出自查
Q:二维码扫了没反应?先确认终端没打印"二维码已失效"——失效就重跑python main.py重新生成;手机和电脑之间挂了代理的,先放行登录请求再扫。
Q:进度条走了几批就停住?每批 10 条之间固定停 3 秒,终端会提示Pause for 3 seconds...,这是防风控节奏,不是卡死,别急着关。
Q:重跑会不会数据翻倍?不会。抓取结果先按内容去重再合并,重跑只会补新数据,已保存的 Excel 不受影响。
Q:为什么少了个别图片?偶发下载失败属正常,再跑一次自动补齐;个别链接失效的图属上游问题,不影响文字部分。
Q:Excel 双击打不开?先关掉正占用文件的 WPS / Office 窗口;仍不行就用 pandas 直接读 .xlsx,数据本身没问题。
Q:想单独抓"未删除的可见说说"?单独运行 fetch_all_message.py,它只走可见说说通道,输出 Markdown 和高清图,覆盖 2014 年之前的记录。
进阶用法:导出的数据还能这么用
重建一条离线时间线。网页版 HTML 自带头像、评论和 QQ 表情渲染,双击就能离线翻看,转发给朋友也只需一个文件;想要纸质版,用浏览器直接打印成 PDF。
用代码算自己的"发帖画像"。表格是固定四列结构,几行 pandas 就能按月统计发帖频率、数出深夜时段的说说占比,哪一年最活跃、哪段时间情绪最密集,一目了然。
给数据留双介质。把resource/result/整个目录复制到移动硬盘和网盘各一份,网页版 HTML 再转一份 PDF 存进去;电子文件怕硬盘罢工,多介质才算真正存住了。
想深挖实现细节,可以翻 登录逻辑、消息抓取模块 和 可见说说模块,都放在项目里,不用猜。
QQ 空间的数据出口就这一条路,GetQzonehistory 把能拿的都拿回来了,拿不回的在平台手里。所有数据只存在你本地硬盘,程序不做任何云端中转——但"只在你手里"也意味着责任全在你手里。
- 跑之前留足磁盘:每 1000 条说说,配图大约占 100MB
- 每季度全量重跑一次,年度报告等节点前临时补跑一轮
- 留意仓库版本更新,QQ 接口一变,老脚本就抓不到数据了
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考