QQ空间历史说说怎么批量导出?GetQzonehistory 完整使用教程
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
QQ空间里的老说说翻不回去,手动截图一条条保存又太慢。GetQzonehistory 是一个开源 Python 工具:扫码登录后,它自动拉取你账号的空间消息列表和说说记录,批量导出成多份 Excel、图片和一个还原版网页,数据全程留在你自己电脑上。
先说结果:这套流程跑完你能拿到什么
跑完后,所有产物统一放在resource/result/你的QQ号/文件夹里:
| 文件 | 内容 | 用途 |
|---|---|---|
| 你的QQ号_全部列表.xlsx | 消息列表中出现过的全部互动记录 | 按时间线完整回顾 |
| 你的QQ号_说说列表.xlsx | 自己发布的原创说说 | 个人成长轨迹存档 |
| 你的QQ号_转发列表.xlsx | 转发别人内容的记录 | 社交传播记录 |
| 你的QQ号_留言列表.xlsx | 别人在你空间留的言 | 好友互动存档 |
| 你的QQ号_其他列表.xlsx | 好友发布的动态等其他消息 | 补充时间线 |
| 你的QQ号_好友列表.xlsx | 昵称、QQ 号、空间主页链接 | 关系网络梳理 |
| 你的QQ号_说说网页版.html | 按空间样式渲染的网页版时间线 | 浏览器里逐条翻阅 |
| pic/ 目录 | 自动下载的说说图片 | 图片本地备份 |
Excel 里每行四个字段:时间、内容、图片链接、评论,拿到表格软件里可以直接筛选、排序、做统计。
环境要求与安装
先确认你装了 Python 3.6 及以上版本。Linux 用户注意:扫码登录依赖 zbar 库,没有的话要先装(如sudo dnf install -y zbar),否则程序启动时会直接提示缺库。
下面每步都写了目的,按顺序执行即可:
# 把项目代码下载到本地 git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory # 进入项目目录 cd GetQzonehistory # 创建独立虚拟环境,避免依赖装到本机 Python 里 python -m venv myenv # 激活虚拟环境(Windows 请改用 myenv\Scripts\activate) source myenv/bin/activate # 安装依赖,走国内镜像源更快 pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt操作走查:从扫码到导出一次跑通
在激活的虚拟环境里启动主程序:
python main.py接下来按时间顺序会发生四件事:
- 终端弹出二维码。程序把登录二维码打印在终端里,同时存了一份到
resource/temp/QR.png。用手机 QQ 扫终端里的码,看到"登录成功"字样即可。扫码与状态轮询逻辑在 util/LoginUtil.py,认证中、已失效等状态都会实时打印,不用猜。 - 自动翻页拉取消息。程序以每批 10 条的步长从新到旧读取空间消息列表,批与批之间固定停几秒防止请求过快,终端上的进度条会显示还剩多少批。
- 补取可见说说。消息列表抓完后,程序再调用 util/GetAllMomentsUtil.py 把你空间当前可见的说说合并进来并去重。
- 生成文件并统计。数据写入各份 Excel,图片下载到
pic/,生成网页版 HTML,最后终端逐行打印条数统计,并自动打开结果文件夹。
中途想停,直接按 Ctrl+C 也可以:程序注册了信号处理,会先把已经抓到的数据存盘再退出,不会白跑。
消息量大的账号这一轮会持续一段时间,进度条在动就让它走完,别中途关终端。
导出结果怎么读
成功跑完后,目录结构长这样:
resource/result/ └── 12345678/ # 你的QQ号 ├── 12345678_全部列表.xlsx ├── 12345678_说说列表.xlsx ├── 12345678_转发列表.xlsx ├── 12345678_留言列表.xlsx ├── 12345678_其他列表.xlsx ├── 12345678_好友列表.xlsx ├── 12345678_说说网页版.html └── pic/ # 下载的图片判断这次是否跑成功,看四点:
- 终端末尾会逐条打印"共有 N 条消息""最早的一条说说发布在……""图片列表共有 N 张图片",数字都大于 0 基本就对了。
- 打开"说说列表.xlsx",看"时间"列最早一行,是否接近你记忆中发空间的最早年份。
- 双击 HTML 文件,确认排版、图片、评论能正常显示。
- 个别行内容重复,是消息列表和可见说说两处都抓到了同一条,以"全部列表"为准即可。
"内容"列格式是"昵称:正文";"评论"列存的是 JSON 数组(评论人、时间、内容),需要细看时在 Excel 里展开或复制到文本编辑器查看。
遇到问题先查这里
| 现象 | 原因 | 操作 |
|---|---|---|
| 启动就提示"无法找到 zbar 共享库" | Linux 缺少 zbar 依赖 | 按发行版安装 zbar(如sudo dnf install -y zbar)后重跑 |
| 扫码后打印"二维码已失效" | 二维码停留时间过长 | 重新运行python main.py生成新码 |
| 提示"登录失败:请重新登录" | 登录态异常或网络波动 | 重跑一次重新扫码;仍不行先确认能否正常打开空间网页版 |
| 导出的说说比预期少 | 工具基于消息列表抓取,没出现在列表里的记录(如仅自己可见的早期说说)拿不到 | 再跑一次 fetch_all_message.py,它会翻页抓取所有未删除的可见说说(含 2014 年之前的内容),并生成《所有可见说说.md》 |
| 程序"卡住"很久 | 每批之间有固定等待,属于正常节奏 | 看进度条确认在推进;急停按 Ctrl+C,已有数据会自动保存 |
| 部分图片打开失败 | 老图链接已被平台清理 | 链接仍保留在 Excel"图片链接"列里,属正常现象,可跳过 |
边界与提醒
- 取不到的数据:只有出现在空间消息列表里、或当前仍可见的说说才能被抓到。设为仅自己可见的历史内容、已被平台清掉的记录,工具无法还原,这是数据源决定的,不是程序故障。
- 本地处理:登录得到的 cookie 缓存在
resource/user/,抓取结果全部存本机,不经过第三方服务器。这个文件夹含你的登录态,不要打包发给别人。 - 合规使用:项目声明仅供学习和技术研究,只备份自己账号的数据,遵守 QQ 平台相关规则,不用于商业用途,也尊重他人隐私。
- 各目录路径由
resource/config/config.ini配置,默认按上面结构走,一般不用改。
最后:三步跑通
- 装:克隆仓库 → 建虚拟环境 → 装依赖(见"环境要求与安装"一节)。
- 跑:
python main.py,扫码,等进度条走完。 - 看结果:打开
resource/result/你的QQ号/,核对 Excel 条数和 HTML 页面,再把整个文件夹拷贝一份归档。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考