news 2026/8/28 9:46:23

GetQzonehistory 使用指南:从扫码到 Excel,QQ空间历史说说一次备份

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
GetQzonehistory 使用指南:从扫码到 Excel,QQ空间历史说说一次备份

GetQzonehistory 使用指南:从扫码到 Excel,QQ空间历史说说一次备份

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

大学入学那年发的第一条说说,你还找得到吗?它大概率还躺在 QQ 空间的消息列表里,只是不好翻、不好归档。GetQzonehistory 是个 Python 小工具:扫码登录后,自动翻遍你的历史消息,把历史说说、转发、留言整理成 Excel 表格、还原版网页和本地图片,全部落在自己电脑上。

它到底能捞回哪些记录

这个工具不直接爬说说动态页,而是走消息列表通道:main.py分页翻完账号的历史消息列表,逐条取出时间、正文、图片链接和评论;再补抓一遍空间里当前可见的说说,两边去重后合并落盘。这意味着你自己删除过的内容找不回来,"仅自己可见"的说说也拿不到——消息列表里有什么,就能导出什么。

另外提前说一句:登录走官方二维码通道,账号密码全程不经手;所有请求从你机器发出,文件写进你的硬盘,数据不经过第三方服务器。

从零跑通:克隆、装依赖、扫码

git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory

建一个虚拟环境再装依赖(Windows 用myenv\Scripts\activate激活,macOS/Linux 用下面命令):

python -m venv myenv && source myenv/bin/activate pip install -r requirements.txt

然后运行:

python main.py

终端会打出一张二维码,用手机 QQ 扫一下、确认登录,抓取随即开始。依赖不多,各管一摊:

  • requests:发送网络请求
  • beautifulsoup4:解析消息列表页的 HTML
  • pandas/openpyxl:整理数据、生成 Excel
  • tqdm:终端进度条
  • Pillow:图片下载处理
  • qrcode:生成登录二维码

导出结果在哪个目录、分几类

📦 跑完后你会得到一套完整的历史说说备份,全部放在resource/result/你的QQ号/目录下,按类别各存一份:

文件内容
全部列表.xlsx全部历史记录,按时间排序
说说列表.xlsx你发布的说说:时间、正文、图片链接、评论
转发列表.xlsx转发过的内容,保留原始信息
留言列表.xlsx/好友列表.xlsx好友留言存档、互动过的好友(昵称、QQ 号)
说说网页版.html还原版网页,图片可在线预览
pic/说说里提到的图片,全部下载到本地

图片以说说正文命名,重名时自动追加时间戳后缀防止覆盖,文件名最长截到 40 字符。网页版会自动换成高清图源、把 QQ 表情还原成图片,浏览器直接打开就能翻。

抓多快?中断了怎么办

抓取按批进行:每批 10 条,批间停顿 3 秒,节奏大约在 100-200 条/分钟,总时长看你的说说数量。中途出问题也有两道保险:

  • Ctrl+C 不白跑:程序注册了中断信号处理,退出前会先把已抓数据存盘。
  • 重跑自动去重:再次运行时已抓到的内容会被识别跳过,接着继续即可。

因为每张图片都会真实下载,建议给重度图片用户预留 500MB 左右的磁盘空间,并挑网络平稳的时段跑。

进阶玩法:把可见说说导出成 Markdown 📝

如果你更想要一份可读的文档而不是消息列表,项目里有个独立脚本fetch_all_message.py:它按每页 30 条抓完所有未删除的可见说说,把正文、转发内容和逐条评论写成 Markdown,存到resource/fetch-all/所有可见说说.md,高清图同步保存。覆盖范围包含 2014 年之前的早期内容,适合整理成自托管的回忆册,或迁移进自己的博客。

写在最后:数据归属与边界

导出的文件是你自己的个人数据,备份到自己可控的存储里才是最靠得住的做法——云端服务和第三方归档都有失效的可能。这个工具适合用来存档自己的回忆、做学习和研究,请遵守平台服务条款,别拿它去抓取或公开他人的隐私内容。

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/28 9:43:55

AI Agent 模型瘦身实战:量化与剪枝的完整部署指南

AI Agent 模型瘦身实战:量化与剪枝的完整部署指南 【免费下载链接】hermes-agent The agent that grows with you 项目地址: https://gitcode.com/GitHub_Trending/he/hermes-agent 上周把 Hermes Agent 的 8B 模型直接以 FP16 拉上生产,显存 13G…

作者头像 李华
网站建设 2026/8/28 9:40:37

深度学习入门:从核心原理到实战避坑指南

1. 从“炼丹”到“炼金”:我理解的深度学习入门心法最近几年,深度学习这个词火得不行,感觉身边搞技术的、不搞技术的都在聊。从能写诗的ChatGPT到能画画的Stable Diffusion,再到自动驾驶、人脸识别,背后都离不开它。很…

作者头像 李华
网站建设 2026/8/28 9:39:48

无人机多类别目标检测数据集实战指南

简介:无人机视觉是低空智能的核心基础,其本质是解决非结构化三维空间下的小目标、多尺度、强畸变目标检测问题。原理上需融合透视投影建模、旋转框回归与边缘设备轻量化约束;技术价值在于 bridging 算法理论与真实飞行场景间的鸿沟&#xff0…

作者头像 李华
网站建设 2026/8/28 9:35:24

PCA主成分分析:从协方差矩阵到特征值分解的降维原理与实践

1. 从“维数灾难”到降维:为什么我们需要PCA?如果你处理过包含几十上百个特征的数据集,比如用户画像、基因表达谱或者高分辨率图像,你肯定体会过那种“维数灾难”带来的无力感。特征太多,数据点在高维空间里稀疏得像宇…

作者头像 李华