尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
把十年的QQ空间说说装进Excel,GetQzonehistory一个工具就够了
把十年的QQ空间说说装进ExcelGetQzonehistory一个工具就够了【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory凌晨两点我对着QQ空间一页页往前翻想找回2012年军训合影那条说说。翻到第38页页面卡住了刷新后弹出操作过于频繁。那一刻我才意识到这些记忆放在别人的服务器上我连完整翻一遍的权限都没有。GetQzonehistory正是为解决这个痛点而生的开源工具——它通过扫码登录把账号下所有历史说说、转发、留言、好友信息一次性抓取到本地导出成Excel和网页文件。适用人群很广想备份个人QQ空间数据的普通用户、想做回忆整理的学生党、需要批量导出素材的创作者都不需要任何编程基础。手动翻页的痛用过的人都懂先说说我之前的笨办法。QQ空间网页版没有全量导出功能想看老说说只能一页一页翻。几百上千条动态越往后页面加载越慢偶尔还会撞上风控提示。翻完一遍眼睛酸时间没了想留存的配图还得一张张右键另存为。这还不是最糟的。说说下面的评论、转发关系、留言板记录网页上根本没法批量整理。我一度以为这些数据这辈子就拿不出来了。它是怎么做到的一条自动流水线GetQzonehistory的思路很直接既然网页版能看那就模拟一次真实的网页登录批量读取历史消息列表再清洗、分类、落盘。流程大致四步生成QQ登录二维码手机扫码完成授权从消息列表接口分批拉取全部动态用BeautifulSoup解析页面提取时间、内容、图片、评论分类写入Excel并把配图下载到本地登录状态会被缓存下次运行无需重新扫码。程序每拉取10条数据会主动暂停3秒这是刻意设计的限速防止触发平台的频率限制。动手之前先备好三样东西Python 3.7及以上项目基于Python编写终端执行python --version即可确认版本Git用来拉取仓库代码稳定的网络全程需要联网网络差会导致二维码刷新失败或导出中断获取代码很简单git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory我强烈建议创建虚拟环境尤其当电脑上还跑着其他Python项目时能避免依赖互相打架python -m venv myenv # Windows 激活 myenv\Scripts\activate # macOS/Linux 激活 source myenv/bin/activate第一次运行扫码、等待、收文件安装依赖并启动pip install -r requirements.txt python main.py终端会打印出一张ASCII码二维码用手机QQ扫一下并确认登录即可。之后程序全自动干活拉数据、下载图片、写表格。几百条说说的账号几分钟内就能跑完动态上万条的大号因为每10条要停3秒耐心等一等就好。结束后程序会自动打开结果文件夹所有内容存放在resource/result/你的QQ号/目录下。导出的文件里到底有什么一次完整运行你会得到这样一组文件全部列表.xlsx所有动态的汇总含时间、内容、图片链接、评论说说列表.xlsx你自己发布的说说转发列表.xlsx转发的内容留言列表.xlsx留言板记录好友列表.xlsx出现过的好友昵称、QQ号和空间主页xxx_说说网页版.html按时间倒序还原的网页版说说打开就像在逛QQ空间pic/ 文件夹自动下载的说说配图Excel文件用WPS、LibreOffice、Excel都能直接打开方便按年份、主题筛选整理。HTML网页版是意外之喜还原度很高适合存成书签随时翻看。如果你连2014年之前的老说说也想完整收走可以再跑一个补充脚本它会把所有可见的未删除说说写成Markdown文档并把配图以高清原图保存python fetch_all_message.py三个值得一试的进阶用法1. 二次运行免登录。登录信息缓存在resource/user/下再次启动会列出已登录的QQ号让你选择直接回车即可继续。2. 中断了不用重头再来。程序注册了中断信号处理手动停止也会先把已抓取的数据存盘。登录状态和数据缓存都在重新运行会跳过已拉取的内容。3. 把Excel交给数据分析。导出的表格是标准结构化数据用pandas读进来可以统计每年发说说的数量、提炼高频话题词甚至生成一张发动态频率年表比手动翻页有意思得多。避坑指南注意事项与常见问题注意事项本工具仅供个人数据备份与学习研究别用于商业用途也别抓取他人账号的数据消息列表拿不到仅自己可见的说说这类内容本就只在你的隐私空间里属正常现象限速是故意的别为了求快手动调大每批抓取条数容易触发风控封接口建议在网络好的时段运行导出大号数据时保持电脑不休眠常见问题排查二维码识别不了macOS下若提示找不到zbar共享库先执行brew install zbarLinux按发行版安装zbar包后重试登录后立刻报登录失败多半是二维码超时重新运行程序再扫一次即可pip安装太慢加国内镜像参数例如pip install -r requirements.txt -i https://mirrors.aliyun.com/pypi/simple/导出数据比预期少先确认哪些属于仅自己可见的说说再看是否中途断网重新运行即可续传补齐最后说两句数据这东西备份下来才算真正属于你。GetQzonehistory把翻几十页网页的苦差事压缩成了一次扫码加几分钟等待。建议每半年跑一次把新发的说说也收进来。等哪天想重温某个瞬间打开本地Excel或HTML几秒钟就能定位到那条动态——这种安心感值得你花一个晚上把它配好。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED

相关推荐

4.7 网络配置练习

4.7 网络配置练习

1、按照图示的VLAN及IP地址需求,完成相关配置2、要求SW1为VLAN 2/3的主根及主网关,SW2为vlan 20/30的主根及主网关,SW1和SW2互为备份3、可以使用super vian4、上层通过静态路由协议完成数据通信过5、AR1为企业出口路由器6、要求全网可达二层配…

📅 2026/9/27 12:03:58
Vue3 + Esmx 实战:从零构建 SSR 微前端模块的完整教程

Vue3 + Esmx 实战:从零构建 SSR 微前端模块的完整教程

Vue3 Esmx 实战:从零构建 SSR 微前端模块的完整教程 【免费下载链接】genesis Next-generation micro-frontend framework based on ESM, sandbox-free with zero runtime overhead, supporting multi-framework hybrid development 项目地址: https://gitcode.c…

📅 2026/9/27 9:49:19
【Scrapy】Scrapy教程11——XPath详解

【Scrapy】Scrapy教程11——XPath详解

前面我们简单的先了解XPath的应用,这节我们来详细学习下XPath,XPath主要是XML的查询语言,因此这节内容和 Scrapy 关系不大,不过XPath确在scrapy、BS4等工具中有很广泛的应用,本文参考菜鸟教程的XPath教程编写,由于本人能力有限,如果文中有什么错误欢迎指正。 简介 XPa…

📅 2026/9/27 0:45:47
MORE NEWS

更多资讯

📰

脉搏血氧测量原理与方法深度解析

1. 这不是“测个血氧”那么简单:为什么你看到的98%和实际临床价值可能差着一个呼吸周期“脉搏血氧测量”这六个字,现在几乎成了家用健康设备的标配标签——智能手表抬手一扫、指夹式探头咔哒一扣、医院监护仪上跳动的数字……看起来简单到不需要说明书。…

📰

PHP分治算法实战指南:从二分查找到归并排序的性能优化

在PHP里聊算法,很多人第一反应是"业务用不上"。我做PHP开发八年,写过电商、爬虫、报表系统,坦白说分治算法在业务代码里的出场率确实不高,但每次真正用到,都能解决别的思路搞不定的问题:几十万行…

📰

GPT-6降价与Opus 5.5上线后,如何用AI网关丝滑调用多模型

1. 多模型调用这件事,为什么突然成了刚需前阵子圈子里聊得最多的两件事,一个是 GPT-6 的价格直接腰斩,另一个是 Opus 5.5 正式上线。单看每一条都是常规的模型迭代新闻,但把这两件事放在一起看,味道就完全不一样了——…

📰

ConcurrentDictionary实战:底层原理、避坑与性能调优

做后端三年的人一定用锁过Dictionary,但锁的粒度怎么选、死锁怎么避、吞吐量上不去怎么办,这些问题绕到最后都会指向同一个名字:ConcurrentDictionary。这篇文章不打算抄 MSDN,也不打算列一份 API 大全,而是把我在生产…

📰

Claude Code 安装配置与首次代码修改实战指南

1. 为什么我最终把 Claude Code 装进了日常工作流第一次听说 Claude Code 的时候,我其实没太当回事。命令行里跑一个 AI 助手,听起来像是极客的玩具,跟"提升开发效率"这种正经事沾不上边。直到有一次我需要在一个十几万行的老项目里…

📰

Python实现KMeans聚类算法:源码、数据集与实战避坑指南

简介:这份资源面向机器学习入门者与数据挖掘方向的学习者,提供了一套用Python实现的KMeans聚类算法完整方案,可用于理解聚类分析从数据预处理、核心算法执行到结果可视化的全流程,适合作为课程实验、算法练习或项目参考的实践素材…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬