十分钟跑完 QQ 空间历史说说导出:GetQzonehistory 开源工具使用教程
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
上个月帮朋友找一条几年前的说说,发现空间网页版根本翻不到那么久,最近的内容之后就没了。后来我跑通了一个叫 GetQzonehistory 的开源项目,专门做 QQ 空间历史说说导出,扫码登录就能把老消息一条条拉回本地。这篇文章记录完整过程:怎么跑通的、拿到什么、有哪些坑。
一句话讲清它能干什么
你给它一个扫码登录,它顺着"历史消息列表"把互动消息一条条捞回来,再走一遍"可见说说"接口补齐未删除的说说(包括 2014 年以前的),最后输出到本地:
- 扫码登录,不用输密码
- 历史消息 + 可见说说双数据源
- 输出 Excel、HTML、图片包
- 本地运行,数据不出你的机器
项目免费、开源,全流程在你自己电脑上完成,登录和抓取都不经过任何第三方服务器。
从零跑通 GetQzonehistory:三步搞定
第一步:把项目拿下来。克隆到本地,进入目录:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory第二步:建虚拟环境装依赖。项目依赖十几个 Python 包(pandas、beautifulsoup4、requests 等),用虚拟环境隔离,别把系统环境搞乱:
python -m venv myenv source myenv/bin/activate # Windows 改为:myenv\Scripts\activate pip install -r requirements.txt第三步:运行主程序。就一行命令:
python main.py终端直接吐出一个二维码,手机 QQ 扫一下,"登录成功"就弹出来了——全程没碰密码。接着进度条开始滚动,每抓 10 条休息几秒,节奏很稳;中途按 Ctrl+C 也会把已抓的数据存下来再退出(别问我怎么知道的,问就是踩过)。我朋友的账号量不算小,进度条从"最近"走到最早一条,前后大概七分多钟。
整个流程其实就四个环节:登录 → 抓取 → 清洗 → 输出,彼此独立,哪一步出问题都很好排查。
导出文件结构说明:resource/result/ 里多了什么
跑完之后,程序会在resource/result/下按你的 QQ 号建一个文件夹,自动打开,里面是这样一套:
| 文件 | 里面装的是什么 |
|---|---|
QQ号_全部列表.xlsx | 所有抓回消息的原始大合集 |
QQ号_说说列表.xlsx | 自己发过的说说,含时间、内容、图片链接、评论 |
QQ号_转发列表.xlsx | 转发过的内容 |
QQ号_留言列表.xlsx | 别人在你空间的留言 |
QQ号_好友列表.xlsx | 互动过的好友昵称、QQ 号、空间主页 |
QQ号_说说网页版.html | 按时间倒序还原的网页版说说墙 |
pic/ | 说说配图,按内容命名自动下载 |
另有QQ号_其他列表.xlsx兜底归档零散互动,Excel 里按年份、关键词筛选都方便。打开那个 HTML 文件的时候我愣了一下——头像、昵称、时间、正文、配图、评论区都还原成了空间原来的样子,QQ 表情也变成了小图标。对着列表一条条往下翻,当年哪条评论底下吵得最凶,一目了然。建议先看 HTML 再进 Excel,一个看氛围,一个查数据。
跑完第一遍之后还能玩什么:进阶玩法
导出 Markdown,接进笔记软件。项目里除了main.py,还有fetch_all_message.py,它把所有可见说说按 Markdown 格式输出,图片一张张存好,评论按列表排好。整份内容可以导入 Obsidian、Notion,和你其他笔记放一起,检索起来比翻表格快。
cookie 缓存,第二次免扫码。登录成功后,登录信息会缓存到resource/user/目录。下次再运行,它会列出现有的登录账号,选一个直接进入,不用再掏手机。做定期备份的时候,这个特性很省事。
拿 Excel 做二次分析。说说的时间字段精确到秒,用 pandas 读进来,按年份统计发帖条数、搜一搜当年出现的高频词、看看谁评论得最多,一条属于你的"活跃曲线"就出来了。哪个年份话最多、哪个朋友陪你最久,数据会自己说话。
这些限制和坑,先知道再动手
- 部分说说天然拿不到。数据源是"历史消息列表"和"可见说说"两个接口,设为仅自己可见、或者从未出现在消息列表里的内容,确实捞不回来。建议趁账号还能登录,尽早多跑几遍,把能拿的先拿回来。
- 过期图片链接会跳过。时间太久远的图片链接可能在平台侧失效,工具遇到坏链接会直接跳过继续跑,不是它罢工。
- macOS 用户注意 zbar 依赖。
pyzbar需要系统级的 zbar 库,如果报"找不到 zbar 共享库",执行brew install zbar即可。 - Windows 终端乱码。先执行
chcp 65001切到 UTF-8 代码页,或者设置环境变量PYTHONIOENCODING=utf-8,基本就解决了。
另外按项目的免责声明说一句:这工具仅供学习和技术研究使用。导出的都是你自己账号的内容,留作个人备份没问题,别用于任何商业或侵权场景。
回到开头那件事:朋友想找的那条说说,最后确实在他的硬盘里被翻出来了,连当年的配图都在。周末泡杯茶,十分钟的事,克隆、扫码、等进度条走完。趁账号还能登、接口还在,现在就去跑一遍。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考