GetQzonehistory:3步完整导出QQ空间历史说说

发布时间:2026/8/23 0:24:31
GetQzonehistory:3步完整导出QQ空间历史说说 GetQzonehistory3步完整导出QQ空间历史说说【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory翻QQ空间找去年的旧说说消息列表翻两页就断了很多动态无法通过常规方式找回。手动截图慢且不完整GetQzonehistory 换一条路从消息列表逐批抓取记录做历史数据导出整理成Excel和HTML存到本地。说白了这是个本地运行的QQ空间说说备份工具。它能帮你解决什么记录找不全QQ空间的消息列表只保留较近的动态早期的翻不到。工具先抓消息列表再通过可见未删除说说接口补一轮两个来源合并能找回的动态尽量找回。手动保存太累逐条截图既慢又容易漏。工具自动翻页抓取每10条一批、批间休息3秒全程不需要人工干预几分钟跑完。数据散乱没法用导出结果是分类好的Excel加一个网页时间、内容、图片链接、评论各占一列可以直接筛选和搜索而不是面对一堆截图。中断也不丢抓取过程中按 CtrlC 停止程序会先把已拿到的数据写盘再次运行时会跳过已缓存的部分不用从头再来。这些问题对应同一条流水线下面按数据流向拆开看。核心能力拆解从消息列表到Excel的数据导出流水线整体是一条抓取→清洗→落盘的线性流水线分5个阶段扫码登录、请求数据、处理数据、保存数据、展示结果。图数据导出流程图展示从扫码登录到结果展示的5个阶段输入免密扫码登录与数据抓取登录环节生成一个二维码用QQ扫码后拿到会话凭证cookie——后续请求出示它就能以你的身份访问全程不碰账号密码。数据抓取按10条一批、每批停3秒的节奏翻页像一个人在耐心翻相册终端里的进度条实时显示当前批次和总数。处理清洗、去重与分类解析靠 BeautifulSoup一个把HTML当表格逐格读取的库从每条消息里提取时间、内容、图片和评论。内容高度相似的两条记录只留一条避免重复再按发布者把记录分成说说、转发、留言、其他四类。可见未删除说说来源的数据在这一步并入2014年以前的旧动态也能进来。输出多格式落盘与网页还原结果统一写入resource/result/你的QQ号/目录6个Excel、1个还原QQ空间样式的网页、一个图片文件夹。网页版会把QQ表情还原成图片、把缩略图链接换成高清版本打开就像回到了当年的空间。从零到跑通本地化数据导出4步走克隆仓库拿到全部源码创建并激活虚拟环境安装依赖运行主程序扫码登录git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate # Windows 用 myenv\Scripts\activate pip install -r requirements.txt python main.py跑起来之后你会看到终端先弹出登录二维码扫码成功后打印登录成功接着进度条一批批往下走。结束时提示导出成功请查看 resource/result/你的QQ号 文件夹内容并列出总消息数、说说数、好友数、图片数等统计结果文件夹会被自动打开。踩坑提醒Linux 和 macOS 需要先装 zbar 系统库pyzbar 解码二维码依赖它否则启动会提示无法找到 zbar 共享库Linux 可执行sudo dnf install zbarmacOS 走 Homebrew。抓取节奏刻意放慢批间3秒数据多时导出会持续一段时间耐心等别强杀终端。从未出现在消息列表里的动态比如很早的仅自己可见说说抓不到这是消息列表机制决定的。谁适合用使用者类型典型诉求对应功能点普通用户把成长说说存档留念说说列表Excel 网页版HTML内容创作者翻找过往文字素材按时间/内容/图片链接筛选搜索数据分析爱好者时间线或情感分析结构化字段评论为JSON格式Python初学者学习爬虫实战代码util/ 下5个模块职责清晰不太适合追求全量恢复的人仅自己可见且从未进入消息列表的动态这个工具同样拿不到。技术实现速览3个值得看的设计免密扫码登录程序现场生成二维码、解码扫码响应、保存会话凭证全程不存密码。这么做是因为登录态是数据导出链路里最大的泄密风险点绕开它最稳妥。双源合并去重消息列表和可见未删除说说两个来源按内容相似度互相去重后合并。消息列表有互动记录但缺早期动态说说接口有早期动态但量少合起来才最接近完整。中断即落盘程序注册了 SIGINT/SIGTERM 信号处理手动停止时先把已有数据存成Excel和图片。几分钟的长任务里网络抖动很常见中断就全丢是最不可接受的结果。模块划分也很直白util/LoginUtil.py—— 扫码登录与会话管理util/RequestUtil.py—— 网络请求util/GetAllMomentsUtil.py—— 可见未删除说说抓取含本地缓存util/ConfigUtil.py—— 配置读取util/ToolsUtil.py—— 通用工具HTML模板、表情替换、去重判断导出产物长什么样文件内容全部列表.xlsx全部互动记录列时间、内容、图片链接、评论说说/转发/留言/其他.xlsx本人说说、转发、留言及其他互动分4个文件好友列表.xlsx互动过的好友昵称、QQ号、空间主页说说网页版.html还原QQ空间样式的浏览网页含图片和评论预览pic/ 目录说说的本地图片副本所有文件都在resource/result/你的QQ号/下文件名以QQ号为前缀导出完成后程序自动打开该文件夹。Excel列结构统一想按年份筛选或按关键词搜索直接就能做要做二次分析用 pandas 或 Excel 公式读入即可。HTML 负责日常翻阅pic/ 负责离线存档。图数据导出结果的文件结构按QQ号建目录包含6个Excel、1个网页和pic图片目录常见卡点Q登录失败或登录后一条数据都拿不到先确认网络能打开QQ空间网页版再检查 zbar 是否装好解码依赖它还不行就重新运行python main.py扫码让会话刷新。Q导出结果比我记忆里的少抓取基于消息列表没进过列表的动态拿不到。工具会额外合并可见未删除说说重跑一次通常能补齐可见部分仅自己可见的早期动态仍无法找回。Q有图片下载失败或链接打不开属于正常现象程序会跳过失效链接继续处理。到 pic/ 里对一下数量缺的图可以拿链接手动试一次确认是否已过期。安全与合规数据全程在本机完成不上传任何服务器登录走官方扫码密码不出现在任何环节。请只用自己的账号做备份尊重他人隐私和QQ平台的使用条款不用于商业用途或批量抓取他人数据。后续规划与社区参与项目是开源的作者在README里明确邀请大家继续完善抓取逻辑和导出功能。遇到bug或想加功能直接提issue或发PR哪怕只是修一个报错也欢迎。克隆仓库、运行python main.py、扫码3步走完。等结果文件夹弹出来时你找了一下午的那条旧说说可能就在里面。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考