GetQzonehistory 完整指南:把 QQ 空间历史说说备份到本地
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
QQ 空间页面上看不到的说说未必不存在,只是官方没有提供批量导出。GetQzonehistory 是一款 QQ 空间说说备份工具:通过模拟扫码登录批量拉取历史说说、评论与图片,并整理成本地 Excel 表格和网页存档。
📦 一次运行能得到什么
跑完python main.py后,程序会把结果按你的 QQ 号整理进resource/result/目录并自动打开:
resource/result/你的QQ号/ ├── 你的QQ号_全部列表.xlsx # 全部消息记录 ├── 你的QQ号_说说列表.xlsx # 自己发布的说说 ├── 你的QQ号_转发列表.xlsx # 转发内容 ├── 你的QQ号_留言列表.xlsx # 留言记录 ├── 你的QQ号_其他列表.xlsx # 好友发布的说说 ├── 你的QQ号_好友列表.xlsx # 昵称、QQ 号、空间主页 ├── 你的QQ号_说说网页版.html # 还原空间样式的离线网页 └── pic/ # 自动下载的说说图片也就是说,一次运行你会得到六张 Excel 表、一个可离线打开的网页和一整张图片目录,无需手工整理。
💡 它替你省掉什么
手工翻页是最耗时间的部分。多年前的说说埋在很深的位置,没有导出功能就只能一页页翻,互动少的更难定位。GetQzonehistory 在后台按批次自动拉取,你只需要等进度条走完。
单靠一条数据通道不够完整。消息列表里不一定涵盖所有内容,而部分早期说说仍保留在可见说说里。程序会把两条通道的数据自动合并去重,让结果尽量接近"页面上能找到的全部"。
图片、评论、好友信息本来散落在各处。手工归档要逐条复制图片链接、粘贴评论、记录昵称;程序则把时间、内容、图片链接、评论写进同一行表格,顺手把图片下载下来,不丢字段。
⚙️ 工作原理:像给旧档案编目再批量搬家
整个过程类似整理一间旧档案室:先登记进门,再逐件编目取回,最后装箱贴标签。
扫码登录,拿到 Cookie
首次运行,程序直接在终端生成登录二维码,用手机 QQ 扫码确认后即可拿到 Cookie——也就是平台记住你登录状态的凭证。程序会把它保存在本地resource/user/目录,下次运行选择已登录账号即可,不用重复扫码。
两条通道分批拉取
程序分两路取数:一路走 QQ 空间历史消息列表,每批 10 条、批间休息 3 秒;另一路走可见未删除说说接口,每页 30 条,包含 2014 年之前的内容。批间间隔是为了避免触发风控(平台对高频请求的限流机制)。每批拉完立即做内容去重,防止同一条说说重复入库。
分类落盘,渲染网页版
数据先做清洗(编码、时间格式、特殊字符),再按类型分成六张表写入 Excel;每条说说的图片被下载下来,按内容命名后统一放进pic/;最后渲染出一个还原空间风格的网页。完成后程序会自动打开结果目录,并打印最早一条说说时间、各表条数等统计信息。
🛠️ 从零到第一次完整备份
前提:电脑已安装 Python 3.6 及以上版本,网络稳定。
获取项目
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory创建虚拟环境:虚拟环境是装在项目目录里、与系统 Python 隔离的独立环境,避免依赖冲突。
python -m venv myenv source myenv/bin/activateWindows 上的激活命令为myenv\Scripts\activate。
安装依赖
pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt镜像源是提供更快下载速度的国内站点,如果安装失败可以换一个镜像重试。
运行主程序
python main.py扫码等待。终端出现二维码后用 QQ 扫码确认,随后程序开始分批抓取,结束后输出结果到resource/result/你的QQ号/并自动打开文件夹。
三条注意事项:
- 程序从
resource/config/config.ini读取保存路径配置,若该文件缺失,请按 README.MD 中的目录结构补建; - 抓取过程中尽量别断网;确实要停就按 Ctrl+C,程序会先保存已抓到的数据再退出;
- Linux 与 macOS 需要 zbar 共享库来解码二维码,具体处理见下方常见问题。
🗂️ 让备份持续产生价值
年度归档:每年底完整跑一次,把resource/result/整个目录拷进云盘或移动硬盘,每次都是增量补充,旧数据不会丢。
二次分析:Excel 里现成有时间、内容、图片链接、评论字段,用表格工具按年份或好友分组统计,就能看出自己哪一年最活跃、和谁的互动最多。
网页版美化:你的QQ号_说说网页版.html保留了头像、时间、图片和评论的结构,熟悉 CSS 的话可以直接改配色和字体,做成私人的纪念册。
如果只需要"所有可见说说(含 2014 年前)+ 高清图"的 Markdown 版存档,也可以单独运行python fetch_all_message.py,它会在resource/fetch-all/下生成所有可见说说.md并同步下载图片。
🩺 常见问题:高频问题怎么处理
备份的数据从哪里来
两条通道:QQ 空间历史消息列表 + 可见未删除说说接口(含 2014 年之前的内容),合并后自动去重。仅自己可见且不在消息列表里的内容拿不到,属于工具的已知边界。
导出格式有哪些
六张 Excel 表(全部列表、说说列表、转发列表、留言列表、其他列表、好友列表)+ 一份 HTML 网页版 + 一个pic/图片目录,全部位于resource/result/你的QQ号/。
扫码登录安全吗
全程不涉及密码输入,Cookie 只保存在本地resource/user/目录;抓取和导出都在你自己的机器上完成,不向第三方上传内容。
二维码一直"认证中"怎么办
通常是网络波动或二维码过期导致的。重新运行程序生成新二维码,同时确认本机系统时间准确。
提示找不到 zbar 或 pyzbar
pyzbar 依赖系统的 zbar 共享库。Linux(RPM 系发行版)执行sudo dnf install -y zbar;macOS 下程序会检测 Homebrew 并引导你完成安装与符号链接创建。
请求超时或抓取中途失败怎么办
程序内置了请求间隔,出现超时后稍等片刻再重跑,避免高频连续运行。手动中断时会先保存已抓取的数据,之后重新运行补全剩余部分即可。
最后给几条务实建议:首次运行选在稳定的网络环境下,避免同时跑其他高负载网络任务;完成后抽查几条早期说说,核对图片和评论是否齐全;结果目录建议再备份一份到移动硬盘或云盘。本工具仅限个人回忆保存与学习研究使用,请遵守平台条款,不要把抓取结果用于传播或商业用途。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考