news 2026/9/8 9:07:34

十分钟跑完 QQ 空间历史说说导出:GetQzonehistory 开源工具使用教程

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
十分钟跑完 QQ 空间历史说说导出:GetQzonehistory 开源工具使用教程

十分钟跑完 QQ 空间历史说说导出:GetQzonehistory 开源工具使用教程

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

上个月帮朋友找一条几年前的说说,发现空间网页版根本翻不到那么久,最近的内容之后就没了。后来我跑通了一个叫 GetQzonehistory 的开源项目,专门做 QQ 空间历史说说导出,扫码登录就能把老消息一条条拉回本地。这篇文章记录完整过程:怎么跑通的、拿到什么、有哪些坑。


一句话讲清它能干什么

你给它一个扫码登录,它顺着"历史消息列表"把互动消息一条条捞回来,再走一遍"可见说说"接口补齐未删除的说说(包括 2014 年以前的),最后输出到本地:

  • 扫码登录,不用输密码
  • 历史消息 + 可见说说双数据源
  • 输出 Excel、HTML、图片包
  • 本地运行,数据不出你的机器

项目免费、开源,全流程在你自己电脑上完成,登录和抓取都不经过任何第三方服务器。


从零跑通 GetQzonehistory:三步搞定

第一步:把项目拿下来。克隆到本地,进入目录:

git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory

第二步:建虚拟环境装依赖。项目依赖十几个 Python 包(pandas、beautifulsoup4、requests 等),用虚拟环境隔离,别把系统环境搞乱:

python -m venv myenv source myenv/bin/activate # Windows 改为:myenv\Scripts\activate pip install -r requirements.txt

第三步:运行主程序。就一行命令:

python main.py

终端直接吐出一个二维码,手机 QQ 扫一下,"登录成功"就弹出来了——全程没碰密码。接着进度条开始滚动,每抓 10 条休息几秒,节奏很稳;中途按 Ctrl+C 也会把已抓的数据存下来再退出(别问我怎么知道的,问就是踩过)。我朋友的账号量不算小,进度条从"最近"走到最早一条,前后大概七分多钟。

整个流程其实就四个环节:登录 → 抓取 → 清洗 → 输出,彼此独立,哪一步出问题都很好排查。


导出文件结构说明:resource/result/ 里多了什么

跑完之后,程序会在resource/result/下按你的 QQ 号建一个文件夹,自动打开,里面是这样一套:

文件里面装的是什么
QQ号_全部列表.xlsx所有抓回消息的原始大合集
QQ号_说说列表.xlsx自己发过的说说,含时间、内容、图片链接、评论
QQ号_转发列表.xlsx转发过的内容
QQ号_留言列表.xlsx别人在你空间的留言
QQ号_好友列表.xlsx互动过的好友昵称、QQ 号、空间主页
QQ号_说说网页版.html按时间倒序还原的网页版说说墙
pic/说说配图,按内容命名自动下载

另有QQ号_其他列表.xlsx兜底归档零散互动,Excel 里按年份、关键词筛选都方便。打开那个 HTML 文件的时候我愣了一下——头像、昵称、时间、正文、配图、评论区都还原成了空间原来的样子,QQ 表情也变成了小图标。对着列表一条条往下翻,当年哪条评论底下吵得最凶,一目了然。建议先看 HTML 再进 Excel,一个看氛围,一个查数据。


跑完第一遍之后还能玩什么:进阶玩法

导出 Markdown,接进笔记软件。项目里除了main.py,还有fetch_all_message.py,它把所有可见说说按 Markdown 格式输出,图片一张张存好,评论按列表排好。整份内容可以导入 Obsidian、Notion,和你其他笔记放一起,检索起来比翻表格快。

cookie 缓存,第二次免扫码。登录成功后,登录信息会缓存到resource/user/目录。下次再运行,它会列出现有的登录账号,选一个直接进入,不用再掏手机。做定期备份的时候,这个特性很省事。

拿 Excel 做二次分析。说说的时间字段精确到秒,用 pandas 读进来,按年份统计发帖条数、搜一搜当年出现的高频词、看看谁评论得最多,一条属于你的"活跃曲线"就出来了。哪个年份话最多、哪个朋友陪你最久,数据会自己说话。


这些限制和坑,先知道再动手

  1. 部分说说天然拿不到。数据源是"历史消息列表"和"可见说说"两个接口,设为仅自己可见、或者从未出现在消息列表里的内容,确实捞不回来。建议趁账号还能登录,尽早多跑几遍,把能拿的先拿回来。
  2. 过期图片链接会跳过。时间太久远的图片链接可能在平台侧失效,工具遇到坏链接会直接跳过继续跑,不是它罢工。
  3. macOS 用户注意 zbar 依赖。pyzbar需要系统级的 zbar 库,如果报"找不到 zbar 共享库",执行brew install zbar即可。
  4. Windows 终端乱码。先执行chcp 65001切到 UTF-8 代码页,或者设置环境变量PYTHONIOENCODING=utf-8,基本就解决了。

另外按项目的免责声明说一句:这工具仅供学习和技术研究使用。导出的都是你自己账号的内容,留作个人备份没问题,别用于任何商业或侵权场景。


回到开头那件事:朋友想找的那条说说,最后确实在他的硬盘里被翻出来了,连当年的配图都在。周末泡杯茶,十分钟的事,克隆、扫码、等进度条走完。趁账号还能登、接口还在,现在就去跑一遍。

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/1 7:45:59

SpringCloud基础 入门级 学习SpringCloud 超详细(简单通俗易懂)

Spring Cloud 基础入门级学习 超详细(简单通俗易懂)* 一、SpringCloud核心组件* * 第一代:SpringCloud Netflix组件 * 第二代:SpringCloud Alibaba组件 * SpringCloud原生组件* 二、SpringCloud体系架构图* 三、理解分布式与集群*…

作者头像 李华
网站建设 2026/9/2 10:12:24

Claude Code接入GPT被风控?API Key合规重置与避坑指南

如果只是看标题,很多人会以为这是一篇“教你在 Claude Code 里接 GPT 然后被风控封号”的吐槽帖。但真正经历过的人都知道,这不是玩笑:当你把 API Key 配置进 Claude Code,准备把多个模型统一到一个终端工作流里时,一个…

作者头像 李华
网站建设 2026/9/1 4:10:27

ComfyUI 工作流迁移指南:三步完成备份、恢复与分享

ComfyUI 工作流迁移指南:三步完成备份、恢复与分享 【免费下载链接】ComfyUI The most powerful and modular diffusion model GUI, api and backend with a graph/nodes interface. 项目地址: https://gitcode.com/GitHub_Trending/co/ComfyUI ComfyUI 是一…

作者头像 李华
网站建设 2026/8/30 23:55:35

MATLAB实现层次分析法:从理论到实战的量化决策指南

1. 项目概述:从决策困境到量化工具做项目、评职称、选方案,甚至挑手机、定旅游目的地,我们每天都在做各种决策。当面对的因素多起来,比如要选一款软件,既要考虑功能是否强大,又要看价格是否合适&#xff0c…

作者头像 李华