ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

GetQzonehistory:QQ空间历史说说本地备份 5 分钟实操指南(Excel 与网页版双格式导出)

GetQzonehistory:QQ空间历史说说本地备份 5 分钟实操指南(Excel 与网页版双格式导出) GetQzonehistoryQQ空间历史说说本地备份 5 分钟实操指南Excel 与网页版双格式导出【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistoryGetQzonehistory 是一款 QQ空间说说备份工具手机扫码登录后自动把可见的历史说说、评论和图片从消息列表全量拉取导出为本地 Excel 与网页版。一次运行即可完成说说导 Excel、图片本地化原帖删除也不影响硬盘里的副本。快速开始装好依赖并扫码登录整个流程敲四组命令环境检查、拉代码、装依赖、运行。唯一的交互是扫码一次其余全自动顺利的话 5 分钟内跑完。① 确认本机装有 Python记下版本号3.7 以上即可python3 --version② 把代码拉到本地工作目录随后进入项目目录git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory③ 创建虚拟环境并安装依赖避免污染系统 Python。requirements.txt 里列了 pandas、pyzbar 等依赖zbar 是解码终端二维码用的系统库必须单独安装命令随发行版而变python3 -m venv myenv source myenv/bin/activate # Windows 用 myenv\Scripts\activate pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt sudo dnf install -y zbar # Ubuntu/Debian 换 apt install -y zbarmacOS 换 brew install zbar④ 运行主入口。终端会先打印一块二维码字符手机 QQ 扫码确认后程序每 3 秒轮询一次登录状态成功后自动开始抓取python main.py⚠️ 登录 cookie 明文存放在resource/user/目录相当于账号凭证别把它放进网盘同步也别拷到别人的机器上不再需要某个账号时删掉对应文件即可。运行产物Excel 与网页版导出文件一览所有产物的根目录是resource/result/{QQ号}/每个账号一个独立子目录。缓存、cookie、结果三条路径由配置文件 resource/config/config.ini 统一控制想换存放位置改这份本地配置就行不用动代码。文件 / 目录内容用途{QQ号}_全部列表.xlsx全部消息时间/内容/图片链接/评论 四列主导出文件按关键词直接检索{QQ号}_说说列表.xlsx你自己发的说说去重后单列个人内容归档{QQ号}_转发/留言/其他列表.xlsx你转发的内容、你给别人的留言、他人动态按消息类型拆分归类{QQ号}_好友列表.xlsx消息中出现过的好友昵称、QQ 号、空间主页联系人信息补充pic/全部图片的本地副本图片本地化不受原链接失效影响{QQ号}_说说网页版.html仿空间样式的本地网页双击即可翻阅点图看高清其中_全部列表.xlsx体量最大含全部消息行其余列表是它按类型的拆分只想要自己发的内容时看说说列表即可。程序走消息列表 可见说说两路数据先各自拉全再按作者归属分类去重所以一份导出里既有你自己发的也有别人关于你的记录。Excel 负责分析与检索网页版负责翻阅双格式同一次运行生成不用跑两遍。工作原理从扫码登录到落盘的一条流水线结论先说全流程是一条登录 → 二分探总量 → 分批抓取 → 解析落盘的线性流水线没有分支逻辑。GetQzonehistory/ ├── main.py # 主入口登录 → 抓取 → 落盘 ├── fetch_all_message.py # 第二入口说说导出 Markdown ├── requirements.txt # 依赖清单 ├── resource/config/config.ini # 缓存/cookie/结果 三条路径配置 └── util/ ├── LoginUtil.py # 扫码登录、cookie 按 QQ 号缓存 ├── RequestUtil.py # 消息列表请求、二分探测总量 ├── GetAllMomentsUtil.py # 可见说说分页每页 30 条 └── ToolsUtil.py # HTML 解析、表情还原、网页模板核心循环在 main.py 里骨架如下user_info Request.get_login_user_info() # 验证登录态 count Request.get_message_count() # 二分锁定消息总量 for i in trange(int(count / 10) 1): response Request.get_message(i * 10, 10) # 每批抓 10 条 time.sleep(3) # 批间睡 3 秒模拟刷页 save_data() # 写 Excel、下图片、生成网页有几个机制值得知道。登录方面cookie 以 QQ 号为文件名缓存到本地见 util/LoginUtil.py重启程序会列出已登录用户输序号直接复用过期才需要重扫。总量方面接口不直接返回条数util/RequestUtil.py 就在 0 到 1000 万之间二分试偏移量有数据就调大、没有就调小最多 24 轮锁定总数。节奏方面每批 10 条之间睡 3 秒整体速度接近人工翻页降低被判定为异常流量的概率。抓取中的二维码由终端字符块绘制字体不支持时直接打开resource/temp/QR.png扫图即可。util/GetAllMomentsUtil.py 负责可见说说这一路按每页 30 条翻页拉取最后并入同一结果。程序还注册了信号处理按 CtrlC 中断时先把已抓数据落盘再退出断网不会白跑。踩坑速查常见报错与自检命令出错基本逃不出这几类先对表再重跑现象大概率原因解决命令备注启动报无法找到 zbar 共享库系统 zbar 库没装sudo dnf install -y zbar按系统换 apt / brew终端只有乱码看不到二维码字体不支持 ASCII 码块—打开resource/temp/QR.png直接扫图登录失败:请重新登录缓存 cookie 过期删除resource/user/对应文件重跑后输 0 重新扫码长时间停在获取消息列表数量二分每轮都要发请求—耐心等或 CtrlC 重跑已存数据不丢pic/少了几张图个别图片请求失败python main.pycookie 还在不用重扫下面这条自检命令把核心依赖的导入全部汇总任何一个缺失都会报错方便一次定位python -c import requests, pandas, qrcode, pyzbar, bs4, openpyxl; print(依赖全部OK)进阶用法Markdown 导出与多账号轮换备份导出 Markdown 纯文本档案。如果归档要放进 Obsidian 或发成博客用第二入口 fetch_all_message.py。它按每页 30 条拉取全部可见未删除说说在resource/fetch-all/下生成所有可见说说.md。图片同步下载并用本地路径引用转发和评论保留为引用块。Markdown 是纯文本方便进版本库做 diff配合图片目录整体迁移到别的设备即可。多账号轮换备份与二次统计。resource/user/会积累多个账号的 cookie启动时列出已登录用户输序号复用、输 0 重新扫码切号结果按 QQ 号分目录存放互不覆盖。缓存目录同样按 QQ 号区分两个账号交替使用不会串数据。备份完成后还能直接用 pandas 读 Excel按年 groupby 就能统计出哪一年发说说最多一条命令出结果。十年的说说成本是一次扫码加一次等待文字、图片、评论分列存放可检索、可筛选、可二次加工数据从头到尾只落在你自己的硬盘上平台改版也过不了期记忆别寄存到别人的服务器上——手里的副本才是自己的。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表