
GetQzonehistoryQQ空间历史说说全量备份与Excel导出完整指南【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory十年前的说说为什么需要一份档案副本你翻手机相册突然意识到2015 年发的那条说说、底下朋友留的评论、那年夏天拍的照片全都还悬在云端。平台一改版、账号一有状况你手里只剩几张对不上号的截图。GetQzonehistory 就是干这件事的开源工具——把 QQ 空间历史说说完整备份下来手机扫一次码可见的说说、评论、图片全部落到本地硬盘直接产出能搜索的 Excel 和双击就能翻的网页版。它替你把几件烦心事一次性解决了手动翻页是对耐心的考验网页版一次只露几条翻回 2014 年要点几千次上一页。这个工具直接走接口批量取数先把总量算出来再一口气取完。图片链接是会过期的网页上的图隔段时间就失效说说一被删连字带图全没。工具取文字的同时把图片下载进本地pic/目录服务端删了原始文件你的硬盘里还有一份。截图堆是一堆查不了的东西上百张截图想找去年夏天那条只能一张张看。导出的 Excel 拆成时间、内容、图片链接、评论四列敲个关键词就能定位。中途断掉不用从头再来断网或者你手动掐掉进程它都会先把已经取回的数据写盘再退出。不用反复扫码第一次登录成功后 cookie 缓存到本地下次启动列出账号列表输个序号直接接着用。原理拆解登录、算量、抓取三连招整个项目就是一条流水线扫码登录 → 估算总量 → 两路取数 → 分类落盘具体模块见 README.MD目录不长GetQzonehistory/ ├── main.py # 主入口登录→抓取→落盘 ├── fetch_all_message.py # 第二入口说说导出 Markdown ├── requirements.txt # 依赖清单 └── util/ ├── LoginUtil.py # 扫码登录、cookie 缓存 ├── RequestUtil.py # 消息列表请求、二分估算总量 ├── GetAllMomentsUtil.py # 说说分页每页30条 └── ToolsUtil.py # HTML 解析、表情还原、网页模板第一招扫码登录相当于领一张档案室的借阅证。向登录接口要一张一次性二维码用黑白字符块画在终端里屏幕就是取件窗口程序每 3 秒问一次状态直到读到登录成功。这张证有有效期过期了删掉缓存文件重扫没过期下次输序号直接进门。cookie 明文放在resource/user/约等于把借阅证搁在接待台上别把这个目录扔进网盘同步。第二招消息总量是翻到中间看看估出来的像估一本书有多少页。服务端不直接报消息列表的总条数程序就从 0 到一千万的中间位置发一次请求有数据说明量比这大没有说明比这小区间一轮轮收窄二十几轮锁定总量total (lower_bound upper_bound) // 2 if li in response.text: lower_bound total 1 # 有内容总量往大了找 else: upper_bound total - 1 # 没内容总量往小了找第三招两路数据像档案员抽卷宗一样慢慢取。第一路是消息列表一次取 10 条、间隔 3 秒整体节奏和一个人慢慢刷页面差不多不容易触发风控第二路是说说分页接口一页 30 条把你没删的可见说说全取回来含 2014 年之前的老内容。两路取完后按作者归属去重合并你发的进说说你转的进转发你评论别人说说的进留言其余的归其他。图片顺手也复制一份存进pic/。安装与首次运行三步跑通① 取代码、建虚拟环境、装依赖一个命令块全搞定虚拟环境不污染系统 Pythongit clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python3 -m venv myenv source myenv/bin/activate # Windows 用 myenv\Scripts\activate pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt⚠️ 上面命令带了阿里云镜像源国内网络快能直连官方源可以去掉 -i 参数。② 装系统级 zbar 库解码二维码要用缺了它第一步就报错sudo dnf install -y zbar # Ubuntu/Debian 用 sudo apt install -y zbarmacOS 用 brew install zbar③ 跑起来终端先打出二维码字符块手机 QQ 扫码确认之后自动开始抓取python main.py跑之前可以用一条自检命令确认环境和依赖都齐了python -c import requests, pandas, qrcode, pyzbar, bs4, openpyxl; print(依赖OK)导出产物长什么样所有产物都落在resource/result/{QQ号}/程序自动建目录temp、user、result 三个路径统一由配置文件控制逻辑见 ConfigUtil.py文件内容{QQ号}_全部列表.xlsx消息列表全量时间/内容/图片链接/评论{QQ号}_说说列表.xlsx只留你自己发的说说已去重{QQ号}_转发列表.xlsx你转发的内容{QQ号}_留言列表.xlsx你留给别人说说的评论{QQ号}_其他列表.xlsx其他好友涉及你的动态{QQ号}_好友列表.xlsx列表里出现过的好友昵称、QQ号、空间主页pic/全部图片的本地副本{QQ号}_说说网页版.html仿空间样式的本地网页双击翻阅点图自动换高清因为是消息列表 可见说说两路数据合并导出里既有你自己发的也有别人关于你的记录。收尾时终端还会打印一句统计共几条、最早一条发于哪天、好友几个、图片几张。踩坑速查表最常见的五种报错现象大概率原因一条命令解决启动报无法找到 zbar 共享库系统库没装sudo dnf install -y zbar按系统换 apt/brew终端只有乱码看不到二维码字体不支持 ASCII 字符块直接打开resource/temp/QR.png扫图片登录失败:请重新登录缓存 cookie 过期删掉resource/user/里对应账号文件再跑python main.py长时间停在获取消息列表数量二分每轮都要发请求耐心等太久就 CtrlC 退出数据已保存再跑python main.pypic/里少了几张图个别图片请求失败重跑python main.pycookie 还在不用重扫⚠️ 本工具仅供学习和技术研究别拿数据做商业用途也尊重平台规则与别人的隐私。跑通之后两个进阶玩法把档案变成纯文本塞进 Obsidian。跑第二个入口python fetch_all_message.py会在resource/fetch-all/下生成所有可见说说.md图片同步下载并用本地路径引用评论和转发保留为引用块直接当博客素材用。多账号轮换备份。resource/user/会攒下多个账号的 cookie启动时列出已登录用户列表输序号复用输0就重新扫码切到另一个号。结果按 QQ 号分目录存放互不覆盖。再往后就是自由发挥了用 pandas 读一下_说说列表.xlsx按年份统计自己哪年话最多、哪个季节拍的照片最密集——这份备份才算真正用起来。一次 QQ 空间说说备份的成本就是一次扫码加一次等待。文字、图片、评论分列存放可检索、可筛选、可二次加工Excel 负责分析网页版负责翻阅机器和人各取所需数据从头到尾只躺在自己的硬盘上。接口会换地方页面会改版但硬盘里那份副本不会过期。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考