告别永远翻不到头的老页面:GetQzonehistory免费导出QQ空间历史说说完整指南
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
某个深夜忽然想起一条七八年前的QQ空间说说,兴冲冲打开页面,手指翻了几十屏,看到的仍是最近几天的内容——这种"捞不回记忆"的时刻,你应该也经历过。GetQzonehistory正是为解决它而生的开源工具:通过官方扫码登录,把账号下全部QQ空间历史说说、留言、转发和好友记录自动导出到本地,免费、开源、全程本地运行。下面这份指南带你一次跑通完整流程。
先听一个真实故事:QQ空间历史说说差点消失的十年
朋友小夏的父亲前年离世。整理遗物时,她想起父亲早年爱在QQ空间发说说——钓鱼的照片、给她的生日祝福、每年春节的家宴。可当她登录父亲的账号,发现自己只能翻到最近几个月的动态,更早的内容被时间流彻底淹没。她手动截图两天,也只抢救出几十条。
后来她把账号交给GetQzonehistory,扫码、等待、导出,十几分钟就拿到一份完整的记忆档案:几百条说说按时间排好序,配图全部下载到本地,连当年朋友们的留言和评论都原样保留。她说,那是她第一次觉得,技术是可以拿来储存感情的。
这不是个例。QQ空间承载了太多人的青春,而平台只展示最近的内容。GetQzonehistory解决的,恰恰是"找回被时间藏起来的那部分"。
一次导出,你能拿回一座数字档案柜
跑完程序后,所有成果落在resource/result/你的QQ号/目录下,打开就是一座井井有条的数字档案柜:
| 文件 | 里面装了什么 |
|---|---|
QQ号_全部列表.xlsx | 历史消息列表中的全部记录,一网打尽 |
QQ号_说说列表.xlsx | 你发布的所有说说:时间、正文、图片链接、评论 |
QQ号_转发列表.xlsx | 你转发过的每一条内容,独立存档 |
QQ号_留言列表.xlsx | 好友在你空间留下的全部留言 |
QQ号_好友列表.xlsx | 互动过的好友:昵称、QQ号、空间主页 |
QQ号_其他列表.xlsx | 上述之外的杂项消息,一条不落 |
QQ号_说说网页版.html | 还原QQ空间样式的网页版,可离线浏览 |
pic/子目录 | 说说里的所有图片,按内容自动命名保存 |
每条说说的评论互动数据也被结构化保留。你不仅能看回文字,还能重读每条动态下方的每一次互动,相当于把"能看不能碰"的页面,变成一份可搜索、可分析、可永久保存的个人数据资产。
三句话讲透:它凭什么把旧数据捞回来
原理并不神秘,整个流程可以压缩成三道工序(对应下面这张流程图):
第一道:扫码换门票。登录模块模拟网页版QQ空间的官方扫码登录——手机QQ扫一下二维码,验证通过后拿到有效Cookie,全程不输入密码。已登录过的账号会被缓存,下次运行直接选序号复用,不用重复扫码。
第二道:双通道抓取。这是它比手动翻页强的地方。程序走两条路:一是请求模块抓取QQ空间的历史消息列表,把留言、转发、好友互动等散落消息全部收进来;二是说说获取模块直接调用可见说说接口,把2014年之前的老说说也一并捞回。两条数据流合并后自动去重,互相补缺。
第三道:清洗落盘。工具模块负责清理重复内容、处理特殊字符、把图片链接替换为高清版本,最后按类型拆分Excel并生成网页版。
需要提前知道的边界:数据源头是"历史消息列表"和"可见说说",因此仅自己可见、从未出现在列表中的说说无法获取。这是平台接口决定的,不是工具缺陷。
五步实操:从命令行到扫码出成果
第一步:获取项目代码
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory第二步:准备独立的Python环境(推荐)
python -m venv myenv # Windows 激活 myenv\Scripts\activate # macOS / Linux 激活 source myenv/bin/activate第三步:安装依赖
pip install -r requirements.txt依赖包括 beautifulsoup4(页面解析)、pandas(表格处理)、requests(网络请求)、openpyxl(写Excel)、qrcode 与 pyzbar(二维码相关)等,一条命令全部装齐。如果不想折腾环境,项目还提供了打包好的单文件可执行版本。
第四步:启动主程序
python main.py程序启动后会打印登录二维码,用手机QQ扫一扫确认登录。成功后自动开始抓取,屏幕上出现进度条,按批次推进(每10条会短暂停3秒,属正常节奏)。
第五步:查看导出成果
跑完后,程序会自动打开resource/result/你的QQ号/文件夹,并打印"共多少条消息、最早一条发布于何时、多少张图片"等统计。
中断也不怕:按
Ctrl+C时程序会先保存已抓数据再退出;再次运行时登录Cookie和已缓存数据都会复用,不做重复劳动。
档案柜里的每一格,分别怎么用
每个Excel都是规整的表格结构。以说说列表为例,一行就是一条说说的完整档案:
- 时间:精确到秒的发布时间,按时间线回溯一目了然;
- 内容:正文原样保留,包括表情与特殊格式;
- 图片链接:原始链接单独列出,同时图片已下载到
pic/目录,按说说内容自动命名,重名文件自动加时间戳避免覆盖; - 评论:结构化的昵称、QQ号、内容和时间,还原完整互动场景。
好友列表记录昵称、QQ号和空间主页地址,等于一张社交关系索引表。网页版HTML把说说和转发合并、按时间倒序渲染,头像和评论样式还原QQ空间原貌,离线也能慢慢翻。
数据到手之后:六个值得一试的真实场景
- 毕业生做成长时间线:把说说Excel丢进分析工具,统计每年发多少条、关键词怎么变化,纪念册里多一张"十年心路曲线"。
- 找回失联老友:好友列表里存着昵称和QQ号,多年不联系的老同学可能就藏在这张表里。
- 做家庭数字纪念册:把全家人账号导出的数据合并,按时间线串起重要事件,照片和留言天然成文。
- 抢救早期照片:很多老配图早已压成模糊缩略图,工具会自动换成高清地址并下载到本地,等于一次图片抢救。
- 内容创作者挖素材:把历年说说当语料库,当年的情绪、事件和段子,直接变成文章或视频的灵感来源。
- 跨平台搬家前的备份:先把全部数据导出成Excel,再决定迁往哪里,主动权始终在自己手里。
四个容易翻车的地方,附避坑解法
- macOS 报 zbar 相关错误:二维码解码依赖系统库,用
brew install zbar装好后重跑即可。 - 终端乱码或编码报错:把系统编码设为UTF-8,或设置环境变量
PYTHONIOENCODING=utf-8。 - 个别图片下载失败:部分老链接失效属正常现象,程序会跳过无效链接继续处理,不影响整体结果。
- 总觉得数据少了:先看统计输出确认总数;多次运行能提高覆盖面,但"仅自己可见"的说说确实超出能力范围。
关于安全与隐私:三个事实足够让你放心
第一,不碰密码。登录走官方扫码通道,验证在手机QQ上完成,工具从不接触你的密码。第二,不联网传数据。抓取、清洗、落盘全在本地完成,导出文件只存在于你自己的电脑里。第三,代码完全透明。项目开源,每一步做了什么都可以逐行查看,不存在暗箱操作。
别让青春只活在滚动条里
回到开头那个深夜翻说说的场景。小夏用十几分钟换回了父亲几百条被时间藏起来的动态,而你也可以。青春不会重来,但记录可以永生——那些文字、照片和留言,值得一份不会被平台折叠的存档。
现在就动手,按下面五步把记忆拿回自己手里:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory获取项目;- 创建虚拟环境并
pip install -r requirements.txt; - 运行
python main.py,手机QQ扫码登录; - 等待进度条跑完,打开
resource/result/你的QQ号/; - 把Excel归档、网页版收藏、图片另存一份到云盘或硬盘。
你的过去值得被认真对待,而它现在只差一次扫码的距离。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考