GetQzonehistory 实战教程免费把 QQ 空间历史说说、评论和图片完整存档到本地【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory你在 2015 年写过的一条说说突然被翻出来想回看配图却已经找不到地方翻。GetQzonehistory 能帮你把空间里的历史说说完整导出到电脑连同评论和转发一起落地最后产出六张 Excel 表、一个离线网页和一组高清图片全部放在以你 QQ 号命名的文件夹里。 从零跑通克隆、装依赖到扫码登录环境只要 Python 3Windows、macOS、Linux 都能跑。把下面的命令连起来执行即可git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate # Windows 请改用 .\myenv\Scripts\activate pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt python main.py命令里已经带了阿里云镜像源网络源不稳时不用手动换。仓库 release 页还有打包好的单文件不想配环境可以直接跑它。第一次运行终端会打印一个二维码用手机 QQ 扫一下就完成登录全程不输密码。登录信息会存进resource/user/下以 QQ 号命名的文件下次运行会列出已登录账号让你输序号选择输 0 才是重新扫码。 产出物说明一个 QQ 号文件夹里有什么跑完后终端会打印消息总条数、最早一条说说的发布时间和各类数量并自动打开结果文件夹。里面的内容逐项是这样文件是什么能拿来干什么QQ号_全部列表.xlsx全部消息时间、内容、图片链接、评论整体检索和统计的主表QQ号_说说列表.xlsx你本人发布的说说整理自己的时间线QQ号_转发列表.xlsx你转发过的内容追溯来源出处QQ号_留言列表.xlsx你留在别人空间的留言回顾旧留言QQ号_其他列表.xlsx好友出现在你动态里的消息把别人的内容滤出去QQ号_好友列表.xlsx互动好友的昵称、QQ 号、空间主页核对账号信息QQ号_说说网页版.html说说加转发按时间倒序的网页双击离线翻看QQ 表情已转成图片图片链接自动换成高清参数pic/全部配图的本地文件文件名取自说说正文原链接失效时图还在每行的发布时间精确到秒图片 URL 单独占一列评论按谁、何时、说了什么逐条拆开。数据是结构化的后面的统计全靠它。 数据是怎么来的登录、抓取、落盘三步扫码登录程序在终端生成二维码你扫一下它就拿到登录凭证存成resource/user/里以 QQ 号命名的文件。相当于你拿到一张空间门禁卡后面所有取数动作都用这张卡不再需要密码。双路抓取数据分两路走。第一路是空间历史消息列表每批取 10 条批与批之间主动停几秒做限速第二路是未删除的可见说说接口每页 30 条能补到 2014 年之前的老内容。两路合并、去重后才分类。原始请求按 QQ 号缓存在resource/fetch-all/下重跑不重复拉取多账号之间互不串。分类落盘数据收齐后按是谁发的拆进六张表图片逐张下载到pic/再生成离线网页。程序注册了中断处理按 CtrlC 时会先把已抓到的内容存盘再退出进度条走得慢也可以随时停下次接着跑。哪些拿不到仅自己可见的说说、以及根本不出现在消息列表里的内容都不会出现在结果里。这是数据来源决定的上限不是程序坏了。 遇到问题四个高频状况怎么处理pip 装依赖很慢或直接失败多半是默认网络源不稳定。把安装那条换成国内镜像源重装上面命令块里给的阿里云镜像可以直接用。提示无法找到 zbar 共享库pyzbar负责解析终端里的二维码依赖系统层的 zbar 组件。RPM 系的 Linux如 Fedora执行sudo dnf install -y zbarmacOS 上util/LoginUtil.py会引导你走 Homebrew 安装并自动建软链接跟着提示答 y 就行。扫码后一直认证中或提示二维码已失效二维码有有效期也可能和系统时间不准有关。重新运行生成新码即可如果刚被风控拦过一次等几分钟再试。抓到的说说比预期少两种原因仅自己可见的内容本来就不在消息列表里网络抖动导致个别批次漏取。前者属于正常范围后者可以重跑几次补上已抓到的部分会先存盘不会丢。 数据的二次利用用 pandas 算出你的活跃月份表头是现成的几行代码就能出统计import pandas as pd df pd.read_excel(你的QQ号_说说列表.xlsx) df[时间] pd.to_datetime(df[时间], format%Y年%m月%d日 %H:%M:%S) print(df.groupby(df[时间].dt.to_period(M)).size()) print(df[内容].str.len().sort_values(ascendingFalse).head(3))往上还可以加词频统计、配图数量随时间的变化回忆能直接变成图表。让存档按时自动跑登录凭证可以复用定时任务不需要再扫码。Linux/macOS 在 crontab 里加一行每月 1 号凌晨 3 点跑一次0 3 1 * * cd /path/to/GetQzonehistory source myenv/bin/activate python main.pyWindows 用任务计划程序做同样的事。另外仓库里还有fetch_all_message.py单独运行它能把全部可见说说的内容和配图另存成一份 Markdown适合想要纯文本档案的场景。 边界与安全抓到的数据只写进你硬盘的resource/result/不经过任何第三方服务器。登录靠扫码不收集密码凭证就在resource/user/不放心就删掉重扫。全部代码开源可查登录、请求、说说解析都按模块放在util/目录下改行为前先看对应文件。红线只有一条只备份你自己空间的内容不要用它去抓别人的数据。项目声明仅供学习与技术研究不得用于商业或非法用途。十分钟就能把十年的空间动态存成第二份底档觉得用得上记得给项目点颗 Star。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
