QQ空间数据导出实战:GetQzonehistory 三步把历史说说完整存到本地
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
GetQzonehistory 是一个 QQ 空间数据导出工具:你用 QQ 扫码登录后,它把账号消息列表里的历史说说、好友留言和互动记录逐批抓下来,分类保存成本地 Excel、网页和图片文件。数据全部留在你自己电脑上,不需要输入密码,适合想给 QQ 空间历史说说备份一次的用户。
老说说翻不到,为什么先存一份到本地
QQ 空间里能直接翻到的动态只是最近的一段,很多老说说已经不在列表里;平台也没有"一键导出全部历史"的官方入口,想留档只能手动截图。GetQzonehistory 解决的就是这件事:把你在可见范围内的历史说说、留言和好友互动一次性落到本地磁盘,作为 QQ 空间历史说说备份的完整底稿。
工作原理:数据从哪来,中断了怎么保存
整个过程你只需要做一次扫码,剩下的抓取、去重、落盘都是自动的。程序启动后先调出二维码(登录流程在 util/LoginUtil.py 里),手机 QQ 扫一下即可,登录态以 Cookie 形式存在本地,全程不碰密码。接下来它做两件事。第一件是主抓取:向 QQ 空间的消息接口按每批 10 条的顺序拉取历史消息,用 BeautifulSoup(一个 HTML 解析库)拆出每条记录的时间、文本、图片链接和互动好友信息。第二件是补充去重:再取一次"当前可见的说说"列表,把消息列表里拿不到的最新内容补进来,并与已有数据比对,避免重复。
项目结构本身很扁平:main.py 是主入口,fetch_all_message.py 负责可见说说的抓取,util/ 下是登录、请求、配置等五个小工具模块。关于中断,main.py 注册了信号处理:你手动按 Ctrl+C 退出时,已抓到的数据会先写盘再退出,不会白跑。
三步跑起来:从 clone 到扫码登录
把代码拉下来、装依赖、运行,就这三步。建议先用python -m venv myenv建一个虚拟环境并激活,避免依赖污染本机 Python。
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistorypip install -r requirements.txtrequirements.txt 里一共 10 个依赖,包括 requests、pandas、openpyxl、Pillow 等,pip 会自动处理版本。装完运行主程序:
python main.py看到二维码后用 QQ 扫一下,然后等进度条走完就行,中途不用额外操作。
结果文件在哪看:6 个表格、1 个网页和图片目录
导出完成后,所有文件放在resource/result/你的QQ号/目录里,打开就能用:
- 全部列表.xlsx:抓到的所有消息,含时间、内容、图片链接、评论四列
- 说说列表.xlsx:只挑出你自己发布的说说
- 转发列表.xlsx:你转发过的内容,保留原始转发信息
- 留言列表.xlsx:好友留下的评论和留言
- 好友列表.xlsx:互动好友的昵称、QQ 号、空间主页链接
- 说说网页版.html:按时间线还原空间样式的单文件网页,双击就能看,图片可直接预览
另外还有一个 pic/ 子目录:说说里的图片会按内容命名下载进去,重名时自动加时间戳后缀,一张不落。拿这些文件能做的事不少——用 Excel 按年份统计哪几年说得最多、算出互动最多的几位好友;或者把 HTML 改改样式,做成电子纪念册,甚至导出打印成实体册子。
使用注意:速度、中断和用途边界
- 耗时有预期:程序每抓 10 条就停 3 秒,说说多的账号跑完全程可能要半小时以上,挑个网络稳定的时段,别关终端。
- 留足空间:图片和表格加起来建议预留至少 500MB 磁盘。
- 中断不丢数据:Ctrl+C 退出前会保存已有数据,进度没走完也不白费,之后重新运行即可。
- ⚠️ 用途边界:工具只用于备份自己账号的数据和个人学习,不要用来抓取别人的记录,也不用于商业用途,以平台使用条款为准。
一份 Excel 加一个 HTML 网页,翻不到的老说说就都回到桌面上了。今晚挑个空闲时间把上面三步走完,先给自己存一份完整备份。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考