你的QQ空间历史说说还能看多久用免费开源工具把回忆完整备份到本地【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory你的QQ空间历史说说现在还完整吗说实话我以前从没想过这个问题直到某天翻到早年一条说说配图已经打不开只剩一个孤零零的链接。与其等平台某天收走这些数据不如趁现在用开源工具GetQzonehistory把QQ空间历史说说完整备份到本地——它免费开源、免输密码手机QQ扫个码就能开始全量导出。先别急着划走说说这类数据比想象中脆弱很多人默认发出去的东西就永远在但现实是账号长期不登录可能被限制、平台改版可能调整接口、早年图片链接可能失效甚至有些内容仅自己可见之后连自己都只能看到部分。我身边就有朋友想导出的时才发现手动复制几百条说说根本不现实——一条条选中、复制、粘贴图片还得另存评论和转发更是无从下手。而第三方代导出服务要交出账号密码谁敢这时候才意识到备份QQ空间说说这件事需要的是一个本地跑、不交密码、能批量处理的开源工具。为什么是 GetQzonehistory而不是其他方案我对比过几条路方案成本风险手动逐条复制时间成本极高几百条不现实图片、评论、转发大量遗漏在线网页快照服务需注册、可能收费数据经过第三方服务器隐私堪忧自己写爬虫要懂接口、反爬、分页学习曲线陡容易卡壳GetQzonehistory 备份免费半小时跑通全程本地处理代码开源可审查选它的理由很朴素模拟浏览器行为 二维码扫码登录不需要提供密码抓取和解析都封装好了普通用户照着命令敲就能用。它是怎么做到的一次扫码分页抓完所有历史说说原理其实不复杂一句话概括程序模拟一个正在浏览QQ空间的浏览器通过官方接口把历史消息列表一页页拉下来再解析出时间、正文、图片、评论最后整理成文件。上图是 GetQzonehistory 的工作流程登录 → 分页抓取 → 数据解析 → 多格式导出中间还有异常处理分支具体拆开看有几步很关键扫码拿凭证运行后终端会打印出二维码手机QQ扫一下即可登录凭证保存在本地下次不用重复扫码自动分页抓取程序每批取 10 条批次之间自动停 3 秒既拿全数据又避免请求过快被限新旧数据合并不仅抓历史消息列表还会补抓所有可见的未删除说说2014 年之前的也在内去重后合并中断不丢数据哪怕中途按了 CtrlC已抓到的内容也会先落盘保存第一次上手从建虚拟环境到导出成功全程实录我按官方 README 完整走了一遍一共就四步全程不到十分钟git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate # Windows 用户用.\myenv\Scripts\activate pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt python main.py几行命令挨个说人话克隆仓库把项目代码下载到本地建虚拟环境相当于给这个项目单独开一个小房间装的依赖不会污染系统全局这点新手尤其推荐装依赖核心是 requests发请求、beautifulsoup4解析网页、pandas整理表格还有二维码相关的 pyzbar、qrcode运行终端出现二维码掏出手机QQ扫一下等进度条走完就行依赖装完会初始化resource/下的 config、temp、user、result 四个目录登录过的凭证会存进resource/user/下次运行还会贴心地让你选择继续用上次的账号还是重新登录。备份完成resource/result 里到底生成了哪些文件抓取结束后程序会自动打开结果目录resource/result/[你的QQ号]/里面不是一个大杂烩而是按用途分好的多份文件上图展示了备份输出结构以 QQ 号为目录生成多张 Excel 表格、一个还原网页版说说的 HTML 文件以及图片文件夹 pic/说说列表.xlsx / 转发列表.xlsx你本人发布的和转发的动态含精确到秒的时间、全文内容、图片链接、结构化评论留言列表.xlsx / 其他列表.xlsx空间留言板和好友互动产生的其他内容好友列表.xlsx抓取过程中识别出的好友昵称、QQ 和空间主页附带收获全部列表.xlsx上面所有内容的汇总版说说网页版.html用浏览器打开直接还原成 QQ 空间网页版的样子头像、表情、评论一应俱全还能离线翻看pic/ 文件夹说说里的所有图片按正文内容命名批量下载即使原链接失效本地也有备份如果你更想要文档化的结果仓库里还有另一个入口 fetch_all_message.py它走的是另一个接口能把所有可见未删除的说说含高清图整理成一份所有可见说说.md文档评论、转发原文都带很适合迁移到博客或笔记软件。三个被很多用户忽略的省心细节用顺了之后我发现了几个藏在代码里的小设计登录态缓存cookie 存在本地文件里下次直接复用不用每次扫码。相关逻辑在 util/LoginUtil.py中断保护main.py里注册了信号处理抓取途中随时按 CtrlC已抓到的数据照样保存不会白跑文件名智能处理图片会按说说正文命名还会自动过滤掉表情代码和非法字符重名时自动加时间戳不会互相覆盖备份不是终点导出的数据还能这样玩Excel 拿到手玩法就多了。比如用 pandas 统计每年的发布频率看看自己的话痨峰值在哪一年import pandas as pd df pd.read_excel(你的QQ号_说说列表.xlsx) df[时间] pd.to_datetime(df[时间]) df[年份] df[时间].dt.year print(df[年份].value_counts().sort_index())想实现每月自动备份加一行定时任务就行0 3 1 * * cd /path/to/GetQzonehistory python main.py如果只想备份某段时间的说说在抓取循环里对解析出的时间做个判断、过滤掉目标范围之外的记录即可代码都在 main.py 里结构很直白改起来不费劲。新手最容易卡住的几个问题一次说清Q扫码后一直显示二维码已失效A二维码有时效失效了重新运行python main.py生成新的即可手机 QQ 要保持登录状态系统时间也要准确。Q为什么只备份到一部分说说A程序基于历史消息列表 可见说说抓取某些仅自己可见或消息列表里不存在的说说拿不到这是接口本身的限制跟工具无关。网络不稳定时也可能漏多跑一次对比一下统计数字就好。Q图片下载失败怎么办A多数是网络或链接失效导致。Excel 里保留着图片链接可以手动补下也可以直接检查pic/目录权限是否可写。Q提示找不到 zbar / pyzbar 报错A这是二维码解码依赖。Linux 上先装系统库如sudo dnf install zbarmacOS 上可用 Homebrew 安装脚本里都给了提示。Q把账号数据交给它安全吗A数据全部在本地处理不经过任何中间服务器代码完全开源登录走的是官方扫码流程全程不接触密码。不放心的话备份完删掉resource/user/里的登录缓存即可。收个尾现在就动手半小时把回忆留在自己手里数据这东西平台替你保管永远是借用放在自己硬盘里才是拥有。GetQzonehistory 把门槛压得很低——不需要懂爬虫不需要注册任何服务照着上面的命令敲一遍半小时后你就能拥有一个完整的、可搜索、可迁移的QQ空间历史说说备份。趁现在还能完整导出别等哪天想备份时只能对着打不开的旧链接叹气。把那条最早发布的说说找回来就当送给自己的一份存档礼物吧。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考