news 2026/9/20 8:25:19

GetQzonehistory:3步把QQ空间历史说说一键备份到本地

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
GetQzonehistory:3步把QQ空间历史说说一键备份到本地

GetQzonehistory:3步把QQ空间历史说说一键备份到本地

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

你上一次翻到 2016 年的说说,是什么时候?QQ空间的历史消息列表藏在后台,一次改版、一条误删,回忆就可能少一块。GetQzonehistory 是开源的QQ空间备份工具:扫码登录后,把历史说说、转发、留言和配图全部抓下来,存成 Excel、网页版页面和高清图片,QQ空间数据迁移从此只落本地。

它到底能帮你做什么

QQ空间的云端数据不姓你,接口调整、链接失效都是常态,能备份的今天别拖到明天。划重点,它只做一件事:把空间里能取出的历史内容,完整搬进本地文件夹。

  • 全量抓取历史说说、转发与留言
  • 评论结构化,时间精确到秒
  • 缩略图自动换成高清原图
  • 中途停止也能保住已抓数据

第一次运行:最短路径跑通备份

克隆与装环境

项目基于 Python,Windows、macOS、Linux 通用。克隆后先建虚拟环境再装依赖,干净不污染本机;依赖下载慢时,给 pip 加个国内镜像源参数即可。若启动时报"找不到 zbar 共享库",Linux 上装上 zbar 再运行就行,macOS 端util/LoginUtil.py内置了引导,按提示用 Homebrew 装好。

git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv && source myenv/bin/activate pip install -r requirements.txt python main.py

扫码登录

终端会打印一个二维码,手机 QQ 扫一下即可,密码全程不出现。登录成功后 Cookie 缓存在resource/user/目录,下次运行先列出已登录用户供你选择,输入 0 则重新扫码换号。二维码若提示失效,一般是网络波动或系统时间不准,重跑生成新码就行。

等它跑完

抓取按每批 10 条推进,批间固定停 3 秒,压低请求频率、稳住账号。想中途停,直接按 Ctrl+C,main.py里的signal_handler会先把已抓数据完整落盘再退出,跑一半也不白干。结束后程序会打开导出文件夹,并汇报总条数、最早一条说说的发布时间、各列表数量与图片总数。

跑完之后,文件夹里到底有什么 📂

结果落在resource/result/你的QQ号/目录,打开就能看到三类产出。

六张表格:全部列表、说说列表、转发列表、留言列表、其他列表、好友列表,各表负责一类消息。除好友列表(昵称、QQ、空间主页)外,列名都是 时间、内容、图片链接、评论,时间精确到秒,评论做了结构化拆分。

网页版页面你的QQ号_说说网页版.html把说说与转发按时间倒序渲染,头像、昵称、正文、配图、评论一应俱全,QQ 表情还原成图片,双击即开,不依赖网络。

图片目录pic/下的配图按说说内容命名下载,抓取时把缩略图链接替换成高清版本,原链接将来失效也不影响这张本地原图。

不止于存档:让数据"升值"的三种玩法 📊

用 Pandas 回看"说说年报"

Excel 的列名就是 时间、内容、图片链接、评论,几行代码就能统计每年发了多少条:

import pandas as pd df = pd.read_excel('你的QQ号_说说列表.xlsx') print(pd.to_datetime(df['时间']).dt.year.value_counts().sort_index())

哪年话痨、哪年沉默,一眼看清;再往下还能做高频词统计、配图数量变化分析。

网页版当档案,定时任务保鲜

说说网页版.html当长期档案。想保持新鲜,用 crontab(Linux/macOS)或任务计划程序(Windows)每月跑一次python main.py,新动态就会持续追加进同一份档案。

补抓早期数据

main.py之外还有fetch_all_message.py这个补充入口:专门抓所有可见且未删除的说说,含 2014 年之前的数据,同步下载高清图,并输出所有可见说说.md。请求缓存放在resource/fetch-all/目录,重复运行直接复用,不会反复请求。

动手前,先看这三条红线 🔒

抓不到的内容:它依赖空间的历史消息列表,列表之外的内容——比如仅自己可见的说说——天然不在范围内;网络不稳时可能漏掉个别批次,保持网络通畅、分多次运行即可。

安全设计:抓到的数据只写本地硬盘,不上传任何第三方服务器;密码不收集不保存,Cookie 放在resource/user/,不放心删掉重登即可。登录、请求、解析逻辑分别在util/LoginUtil.pyutil/RequestUtil.pyutil/GetAllMomentsUtil.py,全程开源可审查。

使用边界:项目自带免责声明,仅供学习与技术研究,不得用于商业或非法用途;备份的是你自己的空间内容,别拿去采集他人数据。完整说明见 README.MD。

云端的格子间是租来的,本地硬盘才是写着你名字的那份。跑一次 GetQzonehistory,让十年前的那条说说带着原文和高清配图留在文件夹里,记忆从此握在自己手里。🏠

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/20 8:24:43

共享打印机连接全解:从网络原理到IP直连与报错排查

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/20 8:24:18

Python协同过滤算法在图书馆推荐系统的实践

1. 项目背景与核心价值上周刚帮学校图书馆做完这个图书推荐系统,上线后借阅量提升了37%。这个基于Python协同过滤和Vue前端的多功能推荐系统,核心解决了传统图书馆"好书无人知"的痛点。不同于电商推荐,图书馆数据更稀疏、用户行为更…

作者头像 李华
网站建设 2026/9/20 8:24:16

Elasticsearch聚合查询实战:Terms、Max/Min应用与优化

1. Elasticsearch聚合查询的核心价值在数据爆炸式增长的时代,如何从海量数据中快速提取有价值的信息成为每个开发者必须面对的挑战。Elasticsearch作为当前最流行的分布式搜索和分析引擎,其聚合查询功能就像一把瑞士军刀,能够帮助我们从杂乱无…

作者头像 李华
网站建设 2026/9/20 8:23:14

SpringBoot+Vue共享单车系统架构设计与优化实践

1. 项目概述:共享单车数据存储系统的技术实现共享单车作为城市短途出行的重要解决方案,其背后需要一套高效稳定的数据存储系统来支撑海量骑行记录、车辆状态和用户信息的处理。这个基于SpringBootVueMyBatisMySQL的技术栈实现,完美契合了共享…

作者头像 李华