GetQzonehistory:3步完成QQ空间数据导出,把空间说说和照片备份到本地
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
你的空间记忆,可能正在悄悄失效
打开 QQ 空间,翻到几年前那条带着旅行照片的说说,图片却只剩一排"加载失败"——这种失落感,很多空间老用户都经历过。说说会删除、链接会失效、平台会改版,而那些记录恰恰是你自己的数字资产。GetQzonehistory 就是一个空间说说备份工具,帮你在本地一键完成 QQ 空间数据导出:历史说说、评论、转发、好友留言和照片,全部存成 Excel 表格和可离线浏览的网页,从此不再依赖平台的服务器。
3 步把空间说说存到本地
不需要懂爬虫,不需要会写代码,跟着下面三步走就行。
第 1 步:准备环境
只要装了 Python 3.7 及以上版本,再有一条稳定的网络连接即可。把项目代码拿到本地:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory不想折腾 Python 环境的话,项目 release 页面提供了打包好的单文件,下载后直接执行也可以。
第 2 步:安装依赖
推荐用虚拟环境隔离依赖,避免污染本机 Python:
python -m venv myenv # Windows 激活 myenv\Scripts\activate # macOS / Linux 激活 source myenv/bin/activate pip install -r requirements.txt依赖不多,主要是 requests、pandas、beautifulsoup4 这类常见库,见 requirements.txt。
第 3 步:启动并扫码
python main.py程序会生成一个登录二维码,手机 QQ 扫码确认即可(不经过密码,账号更安全)。登录后无需再管它——分批抓取、解析、写文件、下载图片会自动完成,结束时终端会打印一条"导出成功"的汇总,结果在resource/result/你的QQ号/目录里。
你最终能拿到哪些数据
这是最实际的一节:跑完之后,你的resource/result/QQ号/目录里会长成这样一份"空间档案"。
6 张 Excel 表,覆盖所有互动类型
| 文件 | 内容 |
|---|---|
QQ号_全部列表.xlsx | 抓到的全部消息:时间(精确到秒)、内容、图片链接、评论 |
QQ号_说说列表.xlsx | 仅你的原创说说,按时间可排序 |
QQ号_转发列表.xlsx | 转发记录及原文信息 |
QQ号_留言列表.xlsx | 自己发出的留言 |
QQ号_好友列表.xlsx | 互动过的好友昵称、QQ 号、空间主页链接 |
QQ号_其他列表.xlsx | 好友动态等其余消息 |
1 个离线网页:QQ号_说说网页版.html模拟空间原生界面,说说、图片、QQ 表情、评论区完整还原,断网也能翻。
1 个照片目录:pic/文件夹里是按内容命名的本地图片文件,完成 QQ 空间照片备份——以后就算原链接失效,照片还在你硬盘上。
所有文件都是标准 Excel/HTML/JPG 格式,用 WPS 或 Excel 打开就能筛选、透视、做数据整理。
它是怎么工作的
原理不复杂,三个关键点就够用:
- 扫码登录:LoginUtil.py 生成 QQ 官方二维码,扫码后拿到登录凭证,整个登录过程不碰你的密码。凭证缓存在
resource/user/下,下次运行可以直接选账号跳过扫码。 - 分批抓取:RequestUtil.py 每次只请求 10 条消息、间隔 3 秒,模拟正常浏览节奏,大幅降低被限流的概率;GetAllMomentsUtil.py 则按 30 条/页补齐可见的未删除说说,连 2014 年之前的内容也能覆盖。
- 本地处理:抓回的 HTML/JSON 全部在本机解析,ToolsUtil.py 负责清洗时间格式、还原 QQ 表情、拼 HTML 页面,pandas 写 Excel。数据不出你的电脑,没有任何上传环节。
进阶技巧:让备份更省心
- 断点不丢数据:程序注册了中断处理,导出途中按
Ctrl+C会先把已抓到的内容保存成 Excel,而不是白跑一场。 - 缓存即增量:
resource/fetch-all/目录会缓存已拉取的原始数据(JSON 文件)。重跑程序时命中缓存直接跳过网络请求,相当于只补新内容,老数据不重复抓。 - 挑好时机:数据量大时(几千条以上),建议在网络稳定的非高峰时段跑,避免请求超时打断批次。
- Linux/macOS 注意:扫码功能依赖 zbar 库,Linux 可执行
sudo dnf install -y zbar安装,macOS 按终端提示用 Homebrew 装,否则启动时无法识别二维码。 - 想要更轻量的格式:fetch_all_message.py 是另一个入口,把所有可见说说(含图片)导出成 Markdown 文件,适合纯文本爱好者。
常见问题与避坑
Q:启动就提示"无法找到 zbar 共享库"?不是你的代码问题,是系统缺依赖。Linux 装 zbar(如sudo dnf install -y zbar),macOS 按提示用brew install zbar,重启程序即可。
Q:二维码等一会儿就失效了?正常现象,扫码动作要快。失效后重新运行python main.py会生成新码。
Q:导出的数据为什么比我印象里少?两个原因:一是"仅自己可见"的说说不在公开消息列表里,抓不到;二是删除后且不在可见列表中的内容同样无法恢复。工具能拿到的是"账号可见"的最大集合。
Q:Excel 里的图片链接会过期吗?会,所以不要只留链接。程序已把图片下载到pic/目录,HTML 页面里的图片走的是高清链接,本地照片才是真正的长期保险。
Q:跑到一半网络断了怎么办?直接重跑。已完成的批次命中本地缓存,不会从零开始。
边界与合规:用在对的地方
- 只备份自己的空间。这个工具的定位是个人数据归档与学习研究,别用它批量抓取他人空间,更不要用于商业用途。
- 遵守平台规则。抓取频率已经做了几秒间隔的保守控制,请保持默认参数,不要改小间隔去"提速"。
- 保管好导出文件。Excel 里包含 QQ 号、昵称、照片等个人信息,建议存在私人设备或加密位置,别往公共网盘里一放了之。
- 项目 README 中附有免责声明:本工具仅供学习和技术研究,使用后果自负。
适合谁用
- 个人归档:想把十年空间当成一本能长期翻的日记本,按季度跑一次备份。
- 研究与分析:拿自己的真实社交数据做情感分析、时间线研究、数字人文课题。
- 数据整理爱好者:QQ 号、好友关系、互动频率,都是现成的结构化表格,导入 Python 或 R 就能玩。
工具的价值在于把"回忆"变成"文件"。今晚就装好环境、扫个码,半小时后你的 QQ 空间历史记录导出就已经躺在本地硬盘里了。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考