用 GetQzonehistory 免费导出 QQ 空间全部历史说说的完整教程

📅 2026/8/19 19:15:24
用 GetQzonehistory 免费导出 QQ 空间全部历史说说的完整教程
用 GetQzonehistory 免费导出 QQ 空间全部历史说说的完整教程【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory你有没有过这样的瞬间想翻翻自己十年前发过的一条说说结果在 QQ 空间里往后滑了很久看到的却是仅展示最近内容的提示那些老动态早已沉没在时间深处这不是你的记忆出了问题而是平台默认只让你看到一部分。GetQzonehistory 正是为了解决这件事而生的开源工具——它能模拟登录你的 QQ 空间把历史消息列表里所有发布过的说说、留言、转发连同好友信息一起抓取下来导出成 Excel、HTML 和图片全部保存在你本地。整个过程免费、开源、不需要输入密码接下来我会以一个新手的视角带你一步步把它跑起来。为什么你的 QQ 空间丢了老内容先说一个很多人不知道的事实QQ 空间并不会把你的历史动态删掉但在网页端和手机端你通常只能直接浏览到最近的一小部分内容。越早的说说越需要靠消息列表这条渠道才能被程序取回来而手动一条条翻是不现实的——上千条消息翻到天亮也翻不完。这就是 GetQzonehistory 存在的意义。它相当于一个时光检索器通过模拟登录后的接口自动把历史消息列表中的数据分批拉取下来。更重要的是它并不仅仅是抓取你发布的说说还会顺带整理出与你有过互动的评论、收到的留言、转发记录以及好友名单形成一份相对完整的数字账本。如果你符合下面任何一种情况它都值得一试发过很多说说想统计自己这些年写了什么担心平台某天调整功能老数据再也找不回想把某个账号的内容做归档备份留存到本地想基于历史说说做个人回顾、纪念册或数据分析。先看懂它的工作方式三个数据来源 很多人一听到爬虫模拟登录就觉得复杂其实 GetQzonehistory 的运作逻辑相当直观可以概括为三个步骤登录 → 抓取 → 落盘。① 扫码登录免密进入登录模块由 util/LoginUtil.py 负责。程序启动后会生成一个二维码你在终端里就能看到它的 ASCII 预览用手机 QQ 扫码确认即可完成登录全程不需要输入账号密码。登录后得到的 cookie 会被缓存到resource/user/目录下次运行时会先让你选择已登录的账号省去重复扫码的麻烦。② 两个数据源互补抓取历史消息列表由 util/RequestUtil.py 负责请求它会以每次 10 条的方式分批拉取消息列表里的记录这也是恢复老说说最关键的数据源。当前可见说说由 util/GetAllMomentsUtil.py 负责专门获取账号下未删除的可见说说作为对消息列表的补充两者合并后再做去重覆盖面更全。③ 清洗、去重、格式化抓回来的原始数据是 HTML 和 JSON 混杂的util/ToolsUtil.py 负责解析页面片段、清理多余空格、识别重复内容并把时间统一转换成X年X月X日 时:分:秒这种便于阅读的格式最终交给主程序main.py统一保存。下面这张流程图可以帮你把整个数据处理链路看得更清楚上手第一步搭建运行环境5 分钟搞定 ⚙️动手之前先确认你的电脑装了 Python 3建议版本尽量新一些因为依赖里包含了 pandas 等较新的库。接着按下面四步走获取项目代码打开终端执行git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory.git cd GetQzonehistory创建虚拟环境推荐避免污染全局环境Windowspython -m venv myenv后运行.\myenv\Scripts\activatemacOS / Linuxpython -m venv myenv后运行source myenv/bin/activate安装依赖pip install -r requirements.txt依赖清单里主要是requests网络请求、pandas与openpyxlExcel 处理、beautifulsoup4页面解析、qrcode与pyzbar二维码生成与识别、Pillow图片处理等。确认配置resource/config/config.ini里定义了临时目录、用户目录和结果目录的路径默认分别是./resource/temp/、./resource/user/、./resource/result/一般不用改动。到这里环境就绪了。如果你在 macOS 上安装pyzbar时提示找不到 zbar 共享库用brew install zbar补装一下即可。运行主程序扫码、等待、收获 环境搭好后在项目目录里运行python main.py程序会依次做这几件事显示登录二维码终端里会出现由字符拼成的二维码用手机 QQ 扫码确认登录统计消息总量程序会用二分法估算消息列表的总条数并显示进度条分批抓取每 10 条为一组拉取数据组与组之间会主动停 3 秒属于正常的限速保护耐心等它跑完即可保存结果全部抓取结束后自动把数据写入resource/result/你的QQ号/目录并打印各类数据的统计信息比如共有多少条消息、多少条说说、多少位好友。值得一提的是如果你中途按CtrlC结束程序工具会先把手头已抓到的数据保存下来再退出不会让你白等。导出结果里到底有什么一张表看懂 抓取完成后你会得到一个以 QQ 号命名的文件夹里面是几份结构清晰的文件。为了让你心里有数我把它们整理成了下面这张对照表文件类型文件名格式里面装的是什么全量消息档案QQ号_全部列表.xlsx所有历史消息的原始汇总说说专集QQ号_说说列表.xlsx你本人发布的说说的时间、内容、图片链接与评论转发存档QQ号_转发列表.xlsx所有转发记录的完整清单留言宝库QQ号_留言列表.xlsx好友在消息中留下的留言好友名册QQ号_好友列表.xlsx互动好友的昵称、QQ 号与空间主页网页版还原QQ号_说说网页版.html模拟 QQ 空间样式、按时间倒序排列的动态页面图片素材pic/子目录说说中附带图片的本地副本按内容命名每个 Excel 文件的字段设计也很直观时间精确到秒内容完整保留文字和 QQ 表情图片链接单独成列评论则以结构化方式记录评论者昵称、QQ 号、评论内容与时间。也就是说导出的不只是文字而是一份可以二次利用的结构化数据。进阶玩法用第二个入口补齐可见说说 如果你发现有些说说没出现在结果里或者特别想要 2014 年之前的高清原图可以试试项目的第二个入口fetch_all_message.pypython fetch_all_message.py它走的是另一套接口直接按页拉取当前账号所有未删除的可见说说并会把图片以原图质量下载到本地最终生成一份 Markdown 文档所有可见说说.md转发内容、评论回复都会以引用块和列表的形式清晰呈现。对喜欢用 Markdown 做笔记、写回顾的人来说这份输出反而更顺手。它还有一个很贴心的设计抓取过程中的原始数据会以 JSON 缓存到resource/fetch-all/目录如果中途断了下次运行会优先读取缓存、只补抓缺失的部分相当于自带断点续传不用从头再来。使用前要清楚的几个边界 ⚠️工具虽好但有些客观限制需要提前了解免得期望落空消息列表之外的内容拿不到项目作者在 README 中明确说过它获取的是消息列表中出现的说说像某些仅自己可见、从未进入消息列表的早期内容是无法被恢复的图片可能失效年代久远的图片链接偶尔会失效工具会跳过无效链接继续处理日志里能看到具体哪些失败了合规使用本项目仅供学习与技术研究请只对自己的账号进行操作遵守相关法律法规与平台规则不要用于任何商业或非法用途适度限速程序内置了请求间隔这是为了避免给平台造成压力属正常现象不建议私自调快。结语备份只是起点整理才是乐趣 总的来说GetQzonehistory 把找回历史说说这件事的门槛降到了很低不需要写任何代码装好依赖扫码登录就能跑最后拿到手的是一套规整的 Excel、网页和图片档案。对于想保存数字记忆、做个人时间线分析或者给换平台留一手数据底牌的用户来说它都是一个低成本高回报的选择。跑通之后我还有两个小建议一是把导出的 Excel 丢进 pandas 或 Excel 透视表按年份统计说说数量、分析高频关键词你的青春大数据会很有意思二是如果你动手能力强项目作者也在 README 里欢迎社区完善代码你可以根据自己的需求去扩展功能比如增加定时备份、定制 HTML 样式让这份档案真正为你所用。青春不常在数据可长存——趁内容还在赶紧给自己留一份备份吧。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考