GetQzonehistory 使用指南:5 分钟完成 QQ 空间数据备份
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
跑完一次 GetQzonehistory,一次 QQ空间数据备份就完成了:说说的文本、配图、评论,好友和留言记录,分类存进 Excel 和一个网页。它是纯本地工具,全部 Python,在你自己的机器上运行,数据不经任何第三方中转。
能拿回什么、拿不回什么
QQ空间说说恢复 能做到哪一步,先把上限看清。工具覆盖的是"可见且在列表里"的数据,超出范围的部分不保证:
| 数据项 | 覆盖情况 |
|---|---|
| 原创说说的文本、时间、配图、评论 | 全部保存,配图单独下载到 pic/ |
| 转发、留言、其他互动 | 分类进独立列表 |
| 好友信息 | 昵称、QQ、主页地址一并导出 |
| 仅自己可见、未进消息列表的说说 | 拿不到 |
| 已删除的说说 | 拿不到 |
⚠️ 边界声明:消息列表里没有、又对你不可见的说说,工具取不回来。恢复范围止步于"可见且在列表中",超出部分无法保证。一次运行,QQ空间说说恢复 与 QQ空间消息列表备份 同时完成,上限就是表中最后一列。
首次备份怎么跑
克隆与依赖
克隆代码仓库,进入项目目录:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory看到 main.py 和 requirements.txt,说明代码就位。
创建虚拟环境隔离依赖,避免和机器上其他项目冲突;激活命令按系统二选一:
python -m venv myenv myenv\Scripts\activate # Windows source myenv/bin/activate # macOS / Linux激活成功后,终端提示符前会带上 (myenv)。
安装依赖,一条命令装齐:
pip install -r requirements.txt五个核心包分工明确:requests 发请求、beautifulsoup4 解析页面、pandas 写 Excel、qrcode 生成二维码、tqdm 画进度条。
扫码登录
跑主程序,终端会打印一个由字符拼成的二维码:
python main.py拿手机 QQ 扫码并确认即可完成授权,全程无需输入密码。
登录后等进度条走完即可:程序自动归类、下载图片、生成网页版,并打开结果目录。
数据是怎么抓回来的
作为 QQ空间导出工具,它把抓取分两路并行,最后合并:
- 消息列表:对空间的消息列表分页抓取。先读消息总数,再每批取 10 条,批与批之间停 3 秒。节奏压得很低,目的是把触发风控的概率压到最低;总耗时也因此与说说数量成正比。
- 可见说说:拉空间里未删除且当前可见的说说清单,补齐消息列表没覆盖到的条目。
两路内容存在重叠,合并前用文本比对剔除重复,导出表里就不会有重复行。
登录态同样复用:首次扫码成功后,凭证存为 cookie 写入resource/user/;再次启动时检测到已有凭证,直接跳过扫码环节。相关实现:扫码与凭证逻辑在util/LoginUtil.py,分页抓取主逻辑在main.py。
备份文件都在哪
结果全部落在resource/result/你的QQ号/下:
| 导出项 | 说明 |
|---|---|
| QQ号_全部列表.xlsx | 账号下所有互动消息,按时间排列 |
| QQ号_说说列表.xlsx | 本人发布的原创内容 |
| QQ号_转发列表.xlsx | 本人转发过的条目 |
| QQ号_留言列表.xlsx | 收到的留言 |
| QQ号_好友列表.xlsx | 好友昵称、QQ、主页地址 |
| QQ号_其他列表.xlsx | 未归入前几类的记录 |
| QQ号_说说网页版.html | 按时间线重排、可直接浏览的页面 |
| pic/ | 下载下来的配图,独立存放 |
命名有两处细节。配图文件名取自说说文本:先清理非法字符,超过 40 字符截断;重名时自动加时间戳,避免互相覆盖。生成网页版时,程序会尝试为图片找到高清版本的链接,保住画质。
常见问题与处理
二维码过期扫不动。终端会实时输出二维码状态;提示已失效就重跑python main.py重新生成,同时排查本机代理是否拦了登录请求。
进程中断,数据不全。Ctrl+C 或进程被杀时,已抓取内容会先落盘再退出;这不算严格意义的断点续传,重跑一次即可补齐缺口。
Excel 打不开。通常是 WPS 或 Office 占用了文件,关掉相关窗口再试;仍失败就用 pandas 的read_excel读一遍,确认文件本身没损坏。
图片下载慢。批间 3 秒停顿属于防风控设计,不是故障;个别图片失败很正常,重跑会再次尝试。
长期维护建议
- 选在晚上网络空闲时段执行,10Mbps 及以上带宽下,图片下载失败率更低。
- 先估算磁盘:每 1000 条说说约需 100MB,图片是主要占用。
- 按季度安排一次全量导出,重要时间点再临时补跑。
resource/result放进常规备份,落到至少两种不同介质。- 留意项目版本更新,QQ 接口调整可能让旧版本失效。
还没备份过空间的话,今天花 5 分钟把流程跑一遍。之后把resource/result纳入定期备份、每季度跑一次,发布过的说说就不会丢失。✅
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考