10分钟备份QQ空间历史说说:四步把旧说说、配图和评论导出到本地
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
QQ空间没有官方导出入口,旧说说想搬出来只能逐条复制或者截图。GetQzonehistory 是一个纯本地运行的开源 Python 工具,专门用来备份QQ空间历史说说。扫码登录后自动翻页,翻完历史消息列表和当前可见的说说,整理成本地 Excel 表格加一个仿空间样式的网页。从克隆代码到拿到第一批表格大约 10 分钟,适合只想把数据落到自己电脑上的普通用户。所有数据只写入本地磁盘,不经过任何中转。
整体流程一览
整个流程四步:建环境、装依赖、扫码登录、等它跑完。登录成功后,程序自己探测总条数、分批翻页、合并主页说说、下载配图、生成网页,你只需开头扫一次码,中间不用干预。
克隆代码并建好隔离环境
先把代码弄到本地,用虚拟环境把这套依赖和你的其他项目隔开,互不干扰。
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv # Windows 激活 .\myenv\Scripts\activate # macOS / Linux 激活 source myenv/bin/activate激活后命令行前面会出现 (myenv) 前缀,看到它说明环境对了。完全不想折腾的话,README 提到 release 页面有打包好的单文件版本,可以直接执行。
安装依赖并补齐系统库
把程序要用的 Python 包装齐,再补上系统层面容易缺的库。
pip install -r requirements.txt核心依赖各有分工:requests 发请求,BeautifulSoup 解析页面,pandas 生成表格,qrcode 和 pyzbar 负责登录二维码,tqdm 画进度条。
💡 有个系统级依赖容易漏:pyzbar 识别二维码依赖系统的 zbar 库。Windows 装完 pip 包一般就能用;RPM 系 Linux 执行sudo dnf install -y zbar,macOS 执行brew install zbar(程序检测到 Homebrew 时选 y 也能自动装)。装完再跑程序,启动就不会报 zbar 相关错误。
扫码登录并复用账号
登录走官方扫码,全程不碰密码。
python main.py运行后终端会直接打印一个字符二维码,用手机 QQ 扫一下并确认,看到"登录成功"就对了。凭证以 cookie 形式存在 resource/user/ 目录,下次再运行会先列出已登录的账号让你选,输入 0 才重新扫码,不用每次都扫一遍。
放手让它翻完落盘
登录成功后,程序先探测历史消息的总条数,然后每 10 条一批往下翻,每批之间停顿 3 秒。这是防风控的节奏,进度条走得慢是正常现象,说说上千条的话等几分钟到几十分钟。
消息列表翻完后,它会自动把主页上未删除、当前可见的说说(含较早年份的)也抓下来,和消息列表去重合并,再分类、下载配图、生成网页版页面,并直接打开结果文件夹。Windows、macOS、Linux 都能正确唤起文件管理器。
中途断了或你按了 Ctrl+C,也不用补数据:程序收到中断会先把已抓到的数据保存再退出,重复执行该命令重新跑一次就行。
导出结果落在哪
跑完后打开resource/result/你的QQ号/目录,你会看到这些:
| 文件 | 内容 |
|---|---|
| QQ号_全部列表.xlsx | 全部内容时间线,时间 / 内容 / 图片链接 / 评论四列 |
| QQ号_说说列表.xlsx | 你自己发布的原创说说 |
| QQ号_转发列表.xlsx | 你转发过的内容 |
| QQ号_留言列表.xlsx | 你收到的留言记录 |
| QQ号_好友列表.xlsx | 互动过的好友,含昵称、QQ号、空间主页 |
| QQ号_其他列表.xlsx | 未归入上面几类的其余内容 |
| QQ号_说说网页版.html | 仿空间样式的可视化页面,含配图、评论和头像 |
| pic/ 目录 | 下载好的说说配图 |
pic/ 里的图片按说说内容命名,超长自动截断到 40 字符,重名时追加时间戳防止互相覆盖;网页版里的配图链接会自动替换成高清版本。想改文件保存位置就调resource/config/config.ini,默认不用动。
卡点速查
卡住别慌,按现象对号入座:
| 现象 | 大概率原因 | 对应操作 |
|---|---|---|
| 二维码扫了没反应,或提示"二维码已失效" | 终端里的码有有效期,放久就作废 | 重新运行python main.py生成新码再扫,确认没被代理拦截 |
| 一启动提示"无法找到 zbar 共享库" | 系统缺少二维码识别库 | RPM 系 Linux 执行sudo dnf install -y zbar,macOS 执行brew install zbar,装完重跑 |
| 导出到一半断了,或按了 Ctrl+C | 网络波动或手动中止 | 不用补数据,中断时已自动保存,重新运行一次即可 |
| 提示登录失败 | 登录状态失效或请求没走通 | 重跑python main.py,有已登录账号选对应序号,输入 0 重新扫码 |
| Excel 双击打不开 | 文件正被其他程序占用 | 先关掉开着的 WPS 或 Office 窗口再打开 |
数据能拿多少
- 拿得到:历史消息列表里还存在的记录(说说、留言、转发等互动),加上主页上未删除、当前可见的全部说说,两条通道合并去重。
- 拿不到:没进过消息列表的说说(比如设置了仅自己可见的)、已彻底删除的,以及平台侧已经丢失的记录。
- 结论:能拿多少拿多少,早备份比晚备份多。
让导出数据多发挥两种用处
做一份按年份翻的回忆册。打开 全部列表.xlsx 按年份筛选,哪一年去了哪座城、和谁互动最多、什么时候开始爱发深夜感慨,一条时间线全在表里。
给备份上双保险。把 说说网页版.html 转成 PDF 存网盘,或打印成实体纪念册;整个结果目录再复制一份到移动硬盘,多介质存放才算落袋为安。
说说是你在 QQ 空间留下的痕迹,把它收进自己说了算的硬盘里,这份数据主动权才算真正拿回自己手里。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考