如何把QQ空间历史说说全部导出成Excel?GetQzonehistory备份完整教程
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
GetQzonehistory 是一个免费开源的 QQ空间历史说说导出工具。扫码登录后,它会自动分页抓取你这些年发布的说说、评论和图片,存成本地 Excel 表格、图片文件夹和一个能直接打开的网页,全程在你自己电脑上运行。
为什么值得导一份:看得见≠拿得走
QQ空间官方没有"全部导出"的入口,真想留档只能逐条截图、逐条复制。
更现实的问题是:图片链接会随平台调整而变化,多年前说说里的老照片过几年可能就打不开了;而数据量一大,手动翻记录根本没法持续。对用了十年以上的账号来说,手动抄录不现实。
这个工具的定位很窄:只负责把你账号的说说和互动记录抓下来、落到本地文件。不存云端、不需要输入密码,只扫码。
⚙️ 它是怎么做的:扫码登录,分页抓取,数据不出本机
流程分三步:
- 扫码登录:程序运行后在终端打印一张登录二维码,用手机版 QQ 扫码即可。登录状态会写到项目里
resource/user/目录,下次运行直接选账号,不用重扫,输入 0 可以重新登录。 - 分页抓取:历史消息列表按每页 10 条拉取,页与页之间停 3 秒控制频率;同时会调用返回"全部未删除可见说说"的接口(每页 30 条,能追溯到 2014 年之前)。两路数据拉完做合并去重,可见说说优先。
- 本地落盘:程序逐条解析内容、时间、图片链接和评论,把图片下载下来,再写出 Excel 和网页。
🚀 三步跑通第一次导出
先克隆仓库:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory进入目录后,建议用虚拟环境,装依赖并运行:
python -m venv myenv # 创建虚拟环境(激活后) pip install -r requirements.txt && python main.py- 运行后终端出现二维码,手机 QQ 扫码,程序开始逐页抓取并打印进度。
- Linux/macOS 上可能需要先装 zbar 依赖,程序报错时屏幕会提示对应的安装命令。
- 不想碰 Python 的话,项目 release 页有打包好的单文件,可以直接执行。
📦 跑完后,导出文件夹里有什么
文件按 QQ 号建了一个目录,结构固定:
| 文件 | 内容 |
|---|---|
{QQ}_全部列表.xlsx | 全部互动记录:你的说说、别人的评论和留言 |
{QQ}_说说列表.xlsx、{QQ}_转发列表.xlsx、{QQ}_留言列表.xlsx | 你发布的内容,按说说/转发/留言拆开 |
{QQ}_好友列表.xlsx | 好友列表和空间主页地址 |
pic/目录 | 说说里的图片,逐张下载,按内容命名 |
{QQ}_说说网页版.html | 还原空间布局的网页,浏览器打开就能翻 |
每张 Excel 的行都是时间、内容、图片链接、评论四列,想要结构化数据就看表,想直接翻着看就看 HTML。
如果只要自己可见的说说正文,不想管互动消息,可以另跑fetch_all_message.py这个入口,它会生成一份"所有可见说说.md"的 Markdown 文档,转发原文和评论都在里面,图片保存在同目录。
⚠️ 抓不到哪些说说,跑之前要知道
- 仅自己可见的说说不包含在内:工具读的是历史消息列表,列表里没有的内容拿不到,项目 README 对此有明确说明。
- 耗时取决于数据量:因为每页之间要等 3 秒,说说越多花的时间越长;中途 Ctrl+C 停掉也没关系,程序会把已抓到的部分保存下来。
- 图片靠链接实时下载:个别链接若已失效,对应那张图就保存不了。
👀 这套工具适合谁
适合:用了很多年说说、想把文字和图片一次留档的人;想给自己或年长的亲戚做一份回忆档案的人;需要把内容整理成表格做统计归档的人。
不适合:期望"包含仅自己可见说说"的 100% 完整抓取;以及完全不想碰命令行的人(release 里的打包版能稍微降低一点门槛)。
一个实用建议:先在账号数据少的老号上跑一遍,确认 Excel 的四列和pic/目录都符合预期,再跑正式账号;导出后把图片和表格放在一起备份,别只留一份。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考