2小时完整备份QQ空间历史说说:GetQzonehistory 实测指南

发布时间:2026/9/20 20:21:14
2小时完整备份QQ空间历史说说:GetQzonehistory 实测指南 2小时完整备份QQ空间历史说说GetQzonehistory 实测指南【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory用它跑完一次我最终在resource/result/QQ号/目录下拿到 6 张 Excel、1 个网页版 HTML 和一个图片文件夹覆盖消息列表里的全部 QQ空间历史说说。它适合的场景很单一给用了多年的老 QQ 号做一次性的历史数据备份。 成果先行先判断值不值得跑先看最终产出。我实测后结果目录结构如下文件名前缀即登录的 QQ 号resource/result/12345678/ ├── 12345678_全部列表.xlsx ├── 12345678_说说列表.xlsx ├── 12345678_转发列表.xlsx ├── 12345678_留言列表.xlsx ├── 12345678_其他列表.xlsx ├── 12345678_好友列表.xlsx ├── 12345678_说说网页版.html └── pic/跑完时终端会汇总总消息数、最早一条说说的时间、好友数、说说/转发/留言条数和图片数。我拿一个老号实测最早一条说说停在十多年前这正是手动翻网页基本翻不到的部分。 实操步骤从克隆到验证产出环境准备需要 Python 3.9 以上requirements 里 pandas 2.2.3 的硬性要求。克隆后建虚拟环境git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv激活环境# Windows myenv\Scripts\activate # macOS / Linux source myenv/bin/activate依赖安装一条命令装齐共 11 个依赖pip install -r requirements.txtrequests登录和抓取的 HTTP 请求beautifulsoup4解析消息列表返回的 HTMLpandas openpyxl生成 6 张 Exceltqdm终端进度条Pillow qrcode pyzbar登录二维码的生成与识别chardet识别接口返回内容的编码fake-useragent随机化 User-Agentpyzbar 依赖系统的 zbar 库macOS 上装不上时程序会主动引导安装后文有记录。运行与扫码登录python main.py终端以 ASCII 字符打印登录二维码手机 QQ 扫码授权即可。登录 cookie 会写入resource/user/第二次运行时不再出码而是列出已登录账号输入序号直接复用输入 0 才重新扫码。验证产出完成后终端会自动打开结果目录Windows 走资源管理器macOS 走 open 命令。我核对了三处Excel 行数与终端统计是否一致pic/里的图片能否正常打开用浏览器打开说说网页版.htmlQQ 表情、图片、评论是否都渲染出来。 产出解读7 个文件分别是什么文件用途字段全部列表.xlsx消息列表抓到的全部内容时间、内容、图片链接、评论说说列表.xlsx只筛出本人发布的说说同上转发列表.xlsx本人发布的转发同上留言列表.xlsx本人在好友空间留下的留言时间、内容、图片链接其他列表.xlsx好友动态等非本人内容时间、内容、图片链接好友列表.xlsx互动中出现过的 QQ 号汇总昵称、QQ、空间主页说说网页版.html说说与转发合并的可视化页面按时间倒序含头像、QQ 表情、评论pic/说说图片的本地副本按内容命名重名自动追加时间戳—HTML 版会把图片链接替换成 QQ 的高清规格参数所以在浏览器里看大图比直接点 Excel 里的链接清晰。⚙️ 原理简述数据到底从哪来程序先模拟 QQ 空间扫码登录逻辑在 util/LoginUtil.pycookie 存本地后续所有请求靠它鉴权。主数据源是空间的历史消息列表接口util/RequestUtil.py 每次请求 10 条批与批之间固定等待逐批翻到没有数据为止再用 BeautifulSoup 逐条解析出时间、文字、图片、评论。第二路数据来自 util/GetAllMomentsUtil.py拉取全部未删除的可见说说一页 30 条能补到 2014 年之前的老内容两路数据按内容去重后合并。程序还注册了 CtrlC 信号处理中途手动退出也会把已抓到的部分先落成 Excel中断重跑不用从零开始。 进阶玩法导出之后能做什么年度发文统计一行 pandas 看出每年的输出量pd.read_excel(说说列表.xlsx)后按时间列的前 4 位 groupby 计数高频互动对象对好友列表和评论字段做词频能看出不同年份和谁互动最多纸质纪念册浏览器打开 HTML 版打印为 PDF按页装订即可 踩坑与排查我实测遇到的问题macOS 报缺 zbar 库首次运行提示无法找到 zbar 共享库程序检测到 Homebrew 后会询问是否执行brew install zbar输入 y 后它自己建好软链重启程序即可Linux 用sudo dnf install -y zbar慢是设计不是卡死每 10 条固定等待约 8 秒请求内 5 秒加批间 3 秒5000 条消息大约需要 1 到 2 小时进度条动得慢别急着关拿不到的内容是边界不是 bug数据源只有消息列表和当前可见说说早期仅自己可见且从未进过消息列表的说说恢复不了这是原理决定的图片数量对不上属正常个别老图片链接已失效程序遇到非 200 响应会跳过pic/里比链接总数少几张符合预期第二次运行先选账号resource/user/下存了 cookie 后启动会先列已登录用户直接输入序号复用输入 0 才重新出码这个工具的覆盖范围等于 QQ 消息列表的覆盖范围列表里没有的历史内容拿不到。把它当成每年跑一次的数据备份手段比较合适不适合做实时同步。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询