资讯详情

资讯详情

建站行业动态 · 设计趋势 · 数字化升级干货

GetQzonehistory完整教程:如何把QQ空间所有历史说说一键备份到本地?

GetQzonehistory完整教程:如何把QQ空间所有历史说说一键备份到本地? GetQzonehistory完整教程如何把QQ空间所有历史说说一键备份到本地【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory深夜翻到一条十年前发的QQ空间说说配图还在评论区却只剩一串乱码。想把它们存下来翻遍设置却发现官方根本没有批量导出入口。开源项目GetQzonehistory就是来补这个缺口的扫码登录一次它会把账号下的历史说说、转发、留言、互动好友连同配图一起抓回本地生成Excel表格和网页版存档。下面这篇文章不打算按说明书平铺而是顺着你上手时最想弄明白的五个问题往下走中间穿插一段踩坑清单帮你少走弯路。问题一官方不给导出它凭什么能拿到全部说说QQ空间虽然没有导出按钮但它的消息中心其实悄悄存着你全部的历史互动记录只是没给你访问入口。GetQzonehistory做的事本质上是替你翻到了那本后台账本。它走的是两条互补的抓取通道历史消息列表util/RequestUtil.py封装了消息中心接口按批次拉取你的全部互动记录再交给 BeautifulSoup 解析 HTML 结构可见说说补全util/GetAllMomentsUtil.py调说说列表接口逐页抓取当前空间里所有未删除的说说连2014年之前的老内容和高清原图都在射程之内。两条通道的数据在main.py里汇合并做了智能去重防止同一条说说被算两次。打个比方前者像翻通讯记录找回所有往来后者像把相册里的原片再扫一遍高清版两者互补才拼出完整档案。⚠️ 需要提前知道的一条边界仅自己可见的说说不在消息列表里这类内容救不回来。README 里也写得很坦白——消息列表里没有的工具无能为力。问题二GetQzonehistory安装步骤与运行环境要准备什么开工前先对照这张清单确认环境别等到报错才回头查。环境项要求说明Python3.8 及以上建议 3.9依赖库版本较新太老的解释器装不上网络稳定、能访问 qzone.qq.com全程需要联网抓取磁盘预留几百 MB说说越多、图片越多占用越大手机 QQ可扫码即可登录只走二维码不碰密码zbar 库仅 Linux / macOS 需要pyzbar 识别二维码依赖它Windows 一般免装核心依赖就几样装完requirements.txt全都有requests发请求、beautifulsoup4解析页面、pandasopenpyxl生成 Excel、qrcodePillowpyzbar处理登录二维码、tqdm显示进度条、fake-useragent随机伪装浏览器特征、chardet兜底识别乱码编码。安装操作如下拉取项目代码git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory进入目录后创建虚拟环境python -m venv myenv激活环境Linux/macOS 用source myenv/bin/activateWindows 用myenv\Scripts\activate安装依赖pip install -r requirements.txt国内网络不畅时可换用清华或阿里云的 PyPI 镜像提速跑起来python main.py问题三第一次运行你会经历哪几步第一次运行比想象中顺滑核心流程就五步终端弹出二维码util/LoginUtil.py生成并显示登录二维码用手机QQ扫一下登录态自动保存cookie 写进resource/user/目录下次启动程序会列出已登录账号让你选不用重复扫码估算消息总量程序用类似猜数字的二分法快速定位历史消息条数终端出现进度条分批抓取每批取 10 条每批之间内置 3~5 秒休眠相当于给接口踩点刹车降低被限制的风险收尾导出全部跑完后自动生成各类文件并调用系统文件管理器打开结果目录。其中值得特别说一句的是中断保护就算你中途按了 CtrlC程序也会先把已经抓到的那部分数据保存下来再退出不会白跑。数据量大的账号这条设计很救命。问题四导出来的一堆文件分别是什么、怎么看跑完一次后resource/result/[你的QQ号]/目录下会出现一套完整的备份文件一眼能看明白文件内容[QQ号]_全部列表.xlsx所有历史消息的总账[QQ号]_说说列表.xlsx你本人发布的说说含时间、正文、图片链接、评论[QQ号]_转发列表.xlsx所有转发记录保留原始转发信息[QQ号]_留言列表.xlsx好友在你空间的留言存档[QQ号]_好友列表.xlsx互动过的好友昵称、QQ、空间主页[QQ号]_其他列表.xlsx兜底的其他内容[QQ号]_说说网页版.html还原QQ空间样式的离线浏览页pic/子目录说说的配图自动下载并按内容命名Excel 每个字段都对应你熟悉的东西时间精确到秒、正文保留表情标记、评论带昵称和头像链接。网页版更讲究一点——程序会把[em]表情替换成对应图片、把缩略图链接自动换成高清版、按时间倒序排版连评论区的头像都给你还原出来。打个比方Excel 是档案柜按类型分格放好HTML 是相册书翻起来最接近原来的样子。最容易翻车的4个坑先看再跑这部分放在中间讲是因为我见过太多人在这些地方卡住Linux/macOS 报无法找到 zbar 共享库这是 pyzbar 的系统级依赖用你的包管理器装一下如apt install zbar、brew install zbar即可macOS 分支甚至内置了自动安装的引导逻辑跟着提示走就行。二维码扫了没反应一直认证中多半是系统时间不准或网络抖动重新运行程序生成新二维码即可。跑到一半开始频繁失败大概率是请求太密触发了限制。工具默认的休眠节奏已经比较保守别为了提速去改time.sleep账号安全比速度重要。导出的 Excel 打开是乱码脚本本身用chardet做了编码探测更多是终端显示层的问题Windows 下建议用 UTF-8 终端跑导出文件本身通常没问题。问题五把十年说说交给本地数据安全吗这一块可以放心大半不碰密码全程扫码登录登录凭证只在本地保存数据不出门所有抓取和整理都在本机完成不向任何第三方服务器回传可随时清理cookie 明文存在resource/user/用完删掉即可下次重新扫码用途有边界项目 README 开头就挂了一份免责声明工具只用于个人备份和学习研究别拿别人的空间数据做文章。类比一下这相当于把自家相册复印一份放进自己抽屉而不是交给陌生人保管。备份到手之后还能怎么玩拿到原始数据只是开始仓库里还藏着一个进阶入口fetch_all_message.py。它会把你所有可见说说整理成 Markdown 文件所有可见说说.md图片也按条数编号下载到resource/fetch-all/评论、转发来源都保留原样。这份 Markdown 可以直接喂给博客、笔记软件做成长篇回忆录或数据复盘。如果你想做年度盘点拿到 Excel 后直接用 pandas 打开统计哪一年发得最勤谁是你互动最多的好友都是几行代码的事。多账号用户也方便——resource/user/里存几份 cookie启动时按序号切换即可。下一步今晚就能完成的第一次备份行动路线已经很清楚拉代码 → 建虚拟环境 → 装依赖 → 运行python main.py→ 扫码 → 去resource/result/[你的QQ号]/检查文件。全程预计十几分钟之后这份档案就永远属于你本地了。最后说一句备份不是囤积而是给未来的自己留一把回得去的钥匙。趁数据还在今晚就动手吧。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关资讯