QQ空间历史说说如何完整找回?GetQzonehistory 一次导出 6 份 Excel 加网页版
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
GetQzonehistory 是一个 Python 工具,扫码登录你的 QQ 空间后,把历史消息列表里的旧说说、留言、转发全部抓下来,本地整理成 6 份 Excel 表格加 1 个还原版网页文件,全部存进你自己电脑的文件夹。把空间翻到最底层,网页端往往只展示得动最近的内容,而账号的历史消息列表其实还留着大量旧动态——这个工具做的就是把这些"被藏起来"的记录一条条搬回本地。
跑一次导出,你会得到哪些文件
程序跑完后,会在resource/result/你的QQ号/下生成一个以 QQ 号命名的文件夹,里面是这样的结构:
| 文件 | 里面装什么 |
|---|---|
QQ号_全部列表.xlsx | 历史消息列表抓到的全部记录,按时间排序 |
QQ号_说说列表.xlsx | 你自己发布的说说:时间、内容、图片链接、评论 |
QQ号_转发列表.xlsx | 你转发过的内容,保留原始转发信息 |
QQ号_留言列表.xlsx | 好友留在你空间的留言 |
QQ号_其他列表.xlsx | 好友动态里与留言、转发之外的其他互动记录 |
QQ号_好友列表.xlsx | 互动好友的昵称、QQ 号、空间主页链接 |
QQ号_说说网页版.html | 时间线样式的网页版,浏览器直接打开就是"老版空间"的样子 |
pic/目录 | 说说里的图片自动下载,按内容命名,重名自动加后缀 |
所有图片、表格都留在本地,不经过任何第三方服务器中转。
QQ空间历史说说从哪来:扫码登录与双数据通道
整个流程可以概括为五步:扫码登录 → 拉消息列表 → 补充可见说说 → 本地清洗 → 多格式导出。
扫码登录,不碰账号密码
登录由 登录模块源码 完成:程序生成二维码,用 QQ 扫一下即可,和手机 QQ 登录网页版是同一套流程。Cookie 只保存在本地(配置读取模块 负责),不需要输入密码,账号凭据不经过任何脚本。
两条数据通道交叉取数
主流程在 main.py 中:先从历史消息列表逐批拉取(每批 10 条,请求模块 处理网络层),再调 可见说说抓取模块 把当前还能在网页端看到的说说补进来,两边去重合并。消息列表管"历史存量",可见说说管"近期增量",两条通道交叉,减少漏抓。
本地清洗与断点保存
抓下来的页面数据在 工具模块源码 中统一处理:自动检测编码、去重、格式化时间、解析图片地址。另外程序注册了中断信号处理,哪怕你手动 Ctrl+C,已经抓到的数据也会先落盘再退出,不会白跑。
三步跑通:装依赖、启动、扫码
第一步:克隆仓库并装好依赖
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv # Windows: myenv\Scripts\activate macOS/Linux: source myenv/bin/activate pip install -r requirements.txt第二步:启动程序并扫码
python main.py终端里会出现二维码,用手机 QQ 扫一下,看到"登录成功"提示即可。
第三步:等进度条走完
进度条按"10 条"为单位推进,每批之间有 3 秒的故意停顿,用来降低触发风控的概率,属正常现象。说说数量多的账号整体可能需要较长时间,建议保持网络稳定、别锁屏断网。结束后程序会自动打开结果文件夹,并打印每条清单的统计条数。
说说列表字段速查:时间、内容、图片链接、评论
Excel 里的四列含义固定,拿来说说是例:
| 字段 | 含义 | 示例 |
|---|---|---|
| 时间 | 发布时刻 | 2015年3月20日 14:30:22 |
| 内容 | 正文,格式为"昵称:正文",方便区分是谁的动态 | 某某:今天天气真好 |
| 图片链接 | 原图地址,多张用逗号分隔 | https://... |
| 评论 | 该条动态下的评论(时间、内容、评论人) | [(时间, 内容, 昵称, QQ号), ...] |
好友列表则是三列:昵称、QQ、空间主页。字段固定意味着你可以直接用 Excel 筛选、透视:按年份分组看每年的发布频率,按评论内容统计高频词,或者按好友 QQ 统计谁陪你互动最多。
导出之后还能做什么
- 改保存位置:结果目录、缓存位置都在
resource/config/config.ini中配置,想换盘或换文件夹改这里就行。 - 做年度回忆:用 Excel 按"时间"列筛出某一年的说说,配合
pic/里的图片,就能拼一份年度回忆录。 - 翻新网页版:
说说网页版.html是标准 HTML,改改 CSS 换个配色,就是一个带评论的私人纪念页,也可以打印成册。 - 定期备份:把
python main.py写进系统定时任务(如每月 1 号执行一次),让备份跟着数据一起增长。
避坑清单:数据不全、图片失效、环境报错
- 部分老说说抓不到:数据源是历史消息列表,从未出现在列表里的动态(例如早期仅自己可见的说说)不在覆盖范围内,这是机制决定的,不是 bug。
- 图片下载失败:老链接可能已失效,程序会跳过坏链接继续跑,其余导出不受影响。
- 报 zbar 相关错误:
pyzbar依赖系统的 zbar 库,macOS 可执行brew install zbar,Linux 用系统包管理器安装对应依赖。 - Windows 终端中文乱码:先在命令行执行
chcp 65001切到 UTF-8 再运行。 - 中途断了怎么办:已抓数据会保存,重新运行再抓一轮即可,程序自带去重,不会把重复内容写进表格。
三步走起来:克隆仓库装依赖、扫码启动、等导出完成。最后提醒一句:本工具请仅用于个人回忆存档与学习研究,导出数据涉及自己与他人的隐私,分享前请脱敏,并遵守平台使用条款。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考