
GetQzonehistory 完整教程如何一次性导出你的 QQ 空间历史说说【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistoryGetQzonehistory 是一款 QQ 空间历史说说导出工具。它通过扫码登录你的 QQ 空间把历史说说、转发、留言和配图完整抓取下来转成本地的 Excel 表格和离线网页。如果你只想把自己的空间数据备份归档它就是目前比较直接的选择。它解决什么问题你有没有遇到过这些情况想翻几年前的说说在空间消息列表里一页页往回滚翻了半天还漏而且平台一改版界面就可能对不上。担心换个手机号、换个登录设备后这些年发过的动态会慢慢找不回来而 QQ 空间并没有提供一键导出入口。想对自己发过的内容做个回顾或统计哪一年发得最多、和哪些好友互动最多但数据散落在网页里没法直接分析。如果你只是想给自己做一份离线备份而不是研究平台机制那么它正好覆盖了这条路扫码登录、自动翻页、分类落盘全程命令行完成不用自己写爬虫。GetQzonehistory 快速上手从克隆到跑起来只需 4 步环境要求Python 3 及以上、可正常访问 QQ 空间的网络。另外注意登录环节用到了pyzbar库解析二维码Linux 系统需要额外安装系统级依赖zbar例如sudo dnf install zbarmacOS 可用 Homebrew 安装util/LoginUtil.py 里会有对应提示。第 1 步获取项目代码git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory第 2 步创建并激活虚拟环境推荐避免污染本机依赖python -m venv myenv source myenv/bin/activate # Windows 用 .\myenv\Scripts\activate第 3 步安装依赖pip install -r requirements.txt第 4 步启动程序并扫码登录python main.py程序会在终端打印一个二维码用手机 QQ 扫一下看到登录成功提示后就会自动开始抓取。中途每抓一批会暂停 3 秒耐心等进度条走完即可。GetQzonehistory 输出文件说明跑完后你手里有什么全部结果保存在resource/result/你的QQ号/目录下程序结束会自动打开这个文件夹。你主要会拿到这些[QQ号]_全部列表.xlsx— 抓取到的所有消息记录含时间、内容、图片链接、评论四列适合做整体分析。[QQ号]_说说列表.xlsx— 只保留你自己发的原创说说。[QQ号]_转发列表.xlsx— 你转发过的内容。[QQ号]_留言列表.xlsx— 你在别人动态下留言的记录。[QQ号]_其他列表.xlsx— 消息列表里其余涉及他人的内容。[QQ号]_好友列表.xlsx— 互动记录中出现过的昵称、QQ 号、空间主页链接。[QQ号]_说说网页版.html— 模拟空间时间线的离线网页按时间倒序展示说说、图片和评论双击就能看。pic/目录— 说说的图片下载到本地的副本文件名按内容生成。Excel 方便筛选和统计HTML 方便直接翻阅pic/保证图片链接失效后内容还在。QQ 空间说说导出原理它是如何工作的整个流程大致分五步对应 util/ 目录下的几个模块扫码登录util/LoginUtil.py调用 QQ 登录接口生成二维码扫码成功后拿到会话凭据并缓存到resource/user/下次不用再扫。拉取空间消息列表util/RequestUtil.py模拟空间网页版的请求接口每次取 10 条、间隔 3 秒循环翻完全部历史消息。拉取未删除说说util/GetAllMomentsUtil.py走说说的分页接口补齐消息列表里没有的未删除动态两个来源合并去重。解析与分类用 BeautifulSoup 解析返回的 HTML按原创 / 转发 / 留言 / 其他分类同时提取时间和图片链接。生成产物main.py 中的save_data/render_html写 Excel、渲染 HTML 页面、逐张下载图片到pic/。即使中途手动中断程序也注册了信号处理会把已抓取的数据先落盘再退出不至于白跑。进阶用法两个值得知道的能力用fetch_all_message.py导出更完整的说说时间线主程序基于消息列表 未删除说说两条来源。如果你希望拿一份覆盖到 2014 年之前、且带高清原图的可见说说数据可以单独运行 fetch_all_message.py它分页拉取全部可见的未删除说说把内容、转发原文、评论整理成一个 Markdown 文件所有可见说说.md并把图片以{tid}{序号}.jpeg命名下载到resource/fetch-all/。想要时间线式的完整档案时用它。多账号切换不用重复扫码每次登录成功的会话凭据都存在resource/user/下以 QQ 号命名。再次运行时程序会列出已登录账号让你选序号输入0则重新扫码逻辑见 util/ConfigUtil.py。如果你要备份自己名下的多个 QQ 空间这能省不少事。适合谁以及它的边界适合想给自己做一份 QQ 空间数据备份、怕数据随平台变动丢失的人想按时间线回顾、或对历年说说做简单统计分析的人需要一个离线可翻阅的说说网页存档的人不适合 / 做不到它只能导出你自己登录账号的空间数据不适合抓取他人空间仅自己可见等消息列表和未删除列表里都没有的动态拿不到它不是商业化的数据采集工具项目作者也明确声明代码仅供学习研究使用常见问题 FAQQ启动就报错无法找到 zbar 共享库怎么办A这是登录环节解码二维码需要的系统依赖。先安装系统的zbarLinux 如sudo dnf install zbarmacOS 可用brew install zbar再重新运行。Q每次运行都要重新扫码吗A不用。登录状态缓存在resource/user/下次运行直接选已登录账号即可输入0才会重新扫码。Q导出的条数比记忆中的少正常吗A正常。数据来自空间消息列表和未删除说说列表删除后已不在列表中的动态无法恢复这是平台侧的限制。Q抓取过程很慢可以中断吗A可以。程序按每 10 条一批、间隔 3 秒的节奏抓取量大会比较耗时按CtrlC中断时已抓到的数据会先保存不会丢失。Q二维码扫了之后终端一直不动A终端会依次打印认证中 / 失效 / 登录成功等状态。如果显示失效重新运行程序即可获取新二维码。使用注意仅建议用于备份自己的数据遵守 QQ 平台用户协议不用于商业用途。resource/user/里存的是你的登录凭据等同账号钥匙不要随项目一起提交或上传到公共仓库。导出文件包含好友的昵称、QQ 号和评论等隐私信息对外分享前请注意脱敏。图片下载依赖网络个别图片失败不影响主流程重要数据建议保留多份副本。写在最后GetQzonehistory 把扫码登录—分页抓取—分类落盘这条链路封装成了几条命令是个人空间数据备份里上手成本很低的一个选择。建议你第一次先跑通python main.py确认输出完整之后每季度固定备份一次重要副本存放两份这份数字记忆就稳了。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考