GetQzonehistory:把QQ空间历史说说整包导出,Excel、HTML、原图都有

📅 2026/8/22 17:23:34
GetQzonehistory:把QQ空间历史说说整包导出,Excel、HTML、原图都有
GetQzonehistory把QQ空间历史说说整包导出Excel、HTML、原图都有【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory打开QQ空间翻到2016年发现当年那些认真敲的说说只剩一片空白。GetQzonehistory 是一个导出账号历史说说的QQ空间备份工具。它靠扫码登录全程不用输密码结果按 Excel、HTML 和图片三类输出。三步跑起来拿到项目代码克隆到本地目录git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory安装依赖需要的库都列在 requirements.txt 里pip install -r requirements.txt启动主程序按提示扫码登录成功后开始自动抓取python main.py技术提示需要 Python 3.8 以上版本用python --version确认如果本机已装过别的 Python 环境建议先用python -m venv myenv建一个虚拟环境再装依赖。GetQzonehistory 的完整流程扫码登录、抓取历史消息、补齐未删除说说最后整理并导出结果它是怎么干活的扫码登录不用输密码util/LoginUtil.py里的QR()函数向 QQ 登录接口请求二维码图片解码后直接在终端画出来你用 QQ 扫一下就行cookie()函数负责轮询登录状态成功后把 cookie 存到resource/user/目录。下次再跑它会列出已登录用户让你选序号不用重新扫码。分批抓数据工具先用二分查找估算消息总数再按每批 10 条调用get_message(start, count)分批拉取每批之间 sleep 3 秒。分批加间隔的理由很实际接口本身只支持分页请求小批量、有节奏地请求也不容易触发平台风控。随后util/GetAllMomentsUtil.py的get_visible_moments_list()会把未删除的说说含 2014 年之前的逐页补齐再和消息列表去重合并。三种结果各管各的用途Excel 表格main.py的save_data()把全部、说说、转发、留言、其他、好友拆成六个 xlsx适合要筛选、统计、分析数据的人HTML 网页版render_html()配合util/ToolsUtil.py的get_html_template()渲染还会把缩略图链接自动升级成高清图适合归档后随时翻看图片与 JSON 缓存原图存进pic/文件夹JSON 中间结果放在resource/fetch-all/适合想拿原始数据二次加工的人所有导出结果落在resource/result/QQ号/目录下多张 xlsx 表格、一个网页版 HTML加上 pic 图片文件夹按你的节奏来时间范围工具默认抓全量想要某几年的话导出后按时间列过滤即可import pandas as pd df pd.read_excel(resource/result/123456789/123456789_说说列表.xlsx) print(df[df[时间] 2015-09-01])增量备份结果目录以 QQ 号命名且位置固定隔段时间重跑覆盖旧目录再拿新表内容列和旧表比对就能看出新增图片质量图片按原图 jpg 下载嫌占空间就只保留 HTML 和 Excel网页里的图片链接本身已是高清多副本存储本地硬盘放一份、加密云盘放一份别只留一处隐私脱敏resource/user/里存着登录 cookie借别人电脑用完就删HTML 里带好友昵称分享前先打码别踩这几个坑别每天跑一次❌ 错误做法挂个定时任务每天自动抓一遍 ✅ 正确做法一个月跑一次或者大变动后马上跑工具自带间隔限速高频请求只会增加被风控的风险别随手删 result 目录❌ 错误做法导出完就删文件腾空间下次重新抓 ✅ 正确做法把 result 目录当母本留着重新抓一次要花几个小时硬盘空间便宜得多备份别全放一个盘❌ 错误做法所有副本都堆在同一块硬盘的同一个目录 ✅ 正确做法按 3-2-1 原则存一共留 3 份副本用 2 种介质比如本地硬盘加云盘其中 1 份放异地移动硬盘或别的设备都行打开引擎盖模块怎么分util/LoginUtil.py二维码生成、登录状态轮询、cookie 存取util/RequestUtil.py历史消息请求、消息总数的二分估算util/GetAllMomentsUtil.py逐页拉取未删除说说含 2014 年之前的内容util/ToolsUtil.pyHTML 模板、JSON 缓存读写、时间和表情处理util/ConfigUtil.py读取resource/config/config.ini管理 temp/user/result 三个目录挂了怎么办main.py注册了信号处理CtrlC 或进程被终止时都会调save_data()把已经抓到的说说先写成 Excel不白跑。单批请求超时也只跳过那一批继续往下走。open_file()用platform.system()判断系统Windows、macOS、Linux 都能自动打开导出目录。核心依赖pandas所有 Excel 结果的写入与处理requests负责全部网络请求qrcode 与 pyzbar生成和解析登录二维码BeautifulSoup4解析说说接口返回的 HTMLPillow处理二维码图片tqdm终端里显示抓取进度条后面还会加什么基于 AI 给说说自动分类打标签情感趋势分析看出几年的情绪曲线社交网络分析看哪些好友评论最活跃生成个人成长时间线图表接入主流云存储导出后自动同步想要某个功能就去仓库提 issue会写代码的话直接提 PR 也行。有空来看看。2016 年那些说说现在整整齐齐躺在 Excel 里页面翻成空白也没关系故事还在。备份这件事今天做总比明天做的好。项目 README 里写了目录结构和免责声明遇到 bug 就在仓库提 issue。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考