还在QQ空间翻十年旧说说?一个脚本帮你把历史回忆全搬回本地

📅 2026/8/13 13:35:11
还在QQ空间翻十年旧说说?一个脚本帮你把历史回忆全搬回本地
还在QQ空间翻十年旧说说一个脚本帮你把历史回忆全搬回本地【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory凌晨两点你想找大学时发的那条旅行说说截图给老同学看。打开QQ空间从2026年一路往前翻翻到手指发酸才找到 2016 年的那条图片却因为链接过期裂了半边。更糟的是你压根不知道那些设置成仅自己可见的说说、曾经删掉又后悔的内容到底还有没有机会找回来。GetQzonehistory这个开源项目要解决的正是QQ空间历史说说怎么完整备份到本地这件事——能不能只扫一次码就把这些年发布的所有说说、配图、评论一次性搬回家你可以把它理解为QQ空间专属的时光保险柜QQ空间没有官方导出功能你发布过的每一条说说都只存在腾讯的服务器上。GetQzonehistory就是一把专门为这个场景配好的钥匙它模拟你平时用手机QQ扫一扫登录的行为拿到授权后通过分页请求把历史消息列表里的说说一条条抓下来再在本地整理成 Excel、网页和图片文件夹。整个过程不需要你输入密码数据也不经过任何第三方服务器。打个比方这就像你把相册里散落各处的老照片请人按年份一本本装订成册还顺手刻了一份光盘留底——只不过装订和刻盘都是自动完成的。为什么你需要一个QQ空间备份工具先说痛点。QQ空间上线近二十年无数人的青春都堆在里面但平台自己从不提供一键打包下载。手动翻页截图几千条说说根本翻不完图片还会失效。第三方空间下载器多半要你交出密码隐私风险自担而且说停服就停服。至于导出数据功能QQ空间至今没有开放。再说GetQzonehistory比手动方案强在哪对比维度手动截图/复制第三方在线工具GetQzonehistory是否需要密码不需要通常需要不需要扫码授权覆盖范围只能翻到可见内容取决于对方服务历史消息列表未删除可见说说导出格式图片/散文本单一格式Excel、HTML、图片目录、Markdown数据去向本地可能经服务器全程本地处理成本时间成本极高可能收费免费开源最后说设计。这个项目选了两条互补的抓取路径main.py走互动消息列表接口能捞到留言、转发、好友互动等记录GetAllMomentsUtil.py则直连说说列表接口专门抓未删除的可见说说含2014年之前的老数据两条路径做去重合并。技术上它把chardet编码探测、BeautifulSoup解析、pandas落表这些常规手段用得很扎实还会用二分法先估算消息总量再分页拉取——这些小细节决定了它能把大几万条的历史数据稳定抓完。从零到备份成功四步走完第一步把项目克隆到本地并创建虚拟环境git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate # Windows 用 .\myenv\Scripts\activate pip install -r requirements.txt依赖只有 requests、pandas、beautifulsoup4 等十余个常用库装完你会看到myenv目录生成。第二步运行主程序python main.py终端里会出现一个 ASCII 码二维码用手机 QQ 扫一扫确认登录。成功后程序会打印用户登录成功并自动在resource/下创建config、result、user、temp等目录。第三步等待抓取。终端会用进度条显示抓取进度每读 10 条会暂停 3 秒——这是刻意为之的限速避免触发风控。全部抓完后程序会自动打开结果文件夹。第四步验收。进入resource/result/[你的QQ号]/你会看到下面这段完整的产出结构。你的回忆变成了这些看得见摸得着的文件这张图是程序运行结束后的完整输出组织方式所有结果按 QQ 号归到一个目录下包含多张 Excel 表格、一份网页版说说页面和一个图片目录。具体来说resource/result/[QQ号]/下会生成[QQ号]_全部列表.xlsx原始全量数据包含时间、内容、图片链接、评论四列[QQ号]_说说列表.xlsx/_转发列表.xlsx/_留言列表.xlsx/_其他列表.xlsx按内容类型分好的明细表[QQ号]_好友列表.xlsx抓取过程中识别出的互动好友及主页链接[QQ号]_说说网页版.html按时间倒序渲染的网页带头像、评论、图片点击放大还原QQ空间浏览体验pic/目录说说里的所有配图以说说内容前40个字命名重复时自动加时间戳后缀如果你更想要纯文本的存档项目还提供了第二个入口python fetch_all_message.py。它会走说说列表接口把未删除的可见说说含2014年之前的旧内容连同高清图片一起导出为 Markdown 文档保存在resource/fetch-all/下。运行完成后终端会直接告诉你结果总消息数、最早一条说说的发布时间、说说/转发/留言/图片各自的条数。那句最早的一条说说发布在 XXXX年XX月XX日往往是用户最有感触的一行输出。三个值得动手玩的进阶方向1. 把 Excel 变成个人成长报告。用 pandas 读入_全部列表.xlsx按年份统计发布条数画出十年的情绪曲线再对内容列做分词统计看看当年的高频词汇是考试加班还是旅行。2. 给网页版说说加全文搜索。render_html生成的是静态 HTML你可以引入一个轻量搜索脚本或把数据导入 SQLite做一个本地可检索的回忆档案馆。3. 定时自动备份。登录态会以 cookie 形式缓存在resource/user/下下次运行可直接选择已登录用户。配一个 crontab 每月执行一次python main.py就能形成持续备份习惯。路上可能遇到的坑和对应的解法如果你发现扫码后一直停在二维码认证中通常是二维码已失效或网络延迟。等十几秒重新运行程序生成新二维码即可别急着反复扫码。如果你在 Linux/macOS 上运行时报 pyzbar 相关错误那是二维码解码依赖 zbar 系统库缺失导致的。macOS 上按提示用 Homebrew 装一下 zbar 就能解决Linux 发行版安装对应系统包即可。如果你只抓到了一部分说说大概率是QQ空间的接口限制或网络中断。程序本身有信号处理机制CtrlC 手动中断时会先把已抓数据保存下来分多次运行、每次跑完再把结果合并是更稳妥的做法。如果你担心抓取频率太高被封代码里每 10 条就 sleep 3 秒这个间隔已经比较保守实在不放心可以把main.py里的time.sleep(3)调大。如果发现有的说说在结果里缺失请记住一个前提消息列表里不存在的内容比如部分仅自己可见的说说是无法获取的这不是程序 bug而是接口数据源本身的边界。它适合谁不适合谁GetQzonehistory 的价值说到底是把散落在腾讯服务器上的个人内容物归原主免费的、开源的、全程本地处理、不需要交出密码还能同时产出 Excel、HTML、Markdown 三种形态的存档。它尤其适合那些想系统整理十年空间回忆、或者计划把说说迁到博客/个人网站的普通用户。但也要坦率说明边界它只能抓到接口可见的数据删掉的、完全私密的说说找不回来代码是作者在学习过程中的产物个别分支没有做完整异常兜底动手能力弱的用户遇到报错需要一定排查耐心另外工具仅限个人学习使用别拿它做任何商业或骚扰性质的操作。它的启动成本低到几乎可以忽略装好依赖、扫一次码然后看着进度条走完。如果你也有一个很久没打开的QQ空间不如今天就跑一次把那些差点被遗忘的说说变成永远属于你的本地文件。如果你想先了解完整的数据流转可以看看项目里的工作流程图——它展示了从扫码登录到数据抓取、处理、生成结果的全过程以及异常中断时如何保住已有进度的设计。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考