尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
个人数据备份完整教程:用InfoSpider安全提取24+平台个人记录
个人数据备份完整教程用InfoSpider安全提取24平台个人记录【免费下载链接】InfoSpiderINFO-SPIDER 是一个集众多数据源于一身的爬虫工具箱旨在安全快捷的帮助用户拿回自己的数据工具代码开源流程透明。支持数据源包括GitHub、QQ邮箱、网易邮箱、阿里邮箱、新浪邮箱、Hotmail邮箱、Outlook邮箱、京东、淘宝、支付宝、中国移动、中国联通、中国电信、知乎、哔哩哔哩、网易云音乐、QQ好友、QQ群、生成朋友圈相册、浏览器浏览历史、12306、博客园、CSDN博客、开源中国博客、简书。项目地址: https://gitcode.com/GitHub_Trending/in/InfoSpider上个月整理旧手机想翻一下去年在B站看过哪些视频才发现观看历史全留在网站里自己手头一份完整副本都没有。淘宝买过的书、GitHub提交过的代码也一样散在各个平台导出入口难找能导出的格式还五花八门。InfoSpider 就是一个免费开源的个人数据提取工具箱支持 B站、GitHub、淘宝、知乎等 24 个平台的个人数据本地导出最终统一存成你能直接打开的 JSON 文件。InfoSpider 能帮你拿回哪些个人数据不必背平台清单按日常需求分五组看就够了创作与学习GitHub 的代码与 Star 数据博客园、CSDN、开源中国、简书的发文记录与浏览量消费与金钱淘宝、京东的订单历史支付宝的交易流水社交与互动知乎的回答与点赞QQ 好友、QQ 群列表朋友圈相册出行与生活12306 的出行记录中国移动、联通、电信的运营商数据账号与通讯QQ、网易、阿里、新浪、Hotmail、Outlook 六大邮箱的邮件数据浏览器浏览历史网易云音乐听歌记录所有结果都统一存成 JSON 格式——这是一种通用的数据交换格式任何文本编辑器都能打开。格式统一的好处是导出的文件可以直接喂给 pandas、Excel 这类工具做统一处理不用每个平台学一套清洗方法。为什么说这种个人数据提取方式是安全的你的个人数据会不会经过第三方的服务器答案是否定的原因有三点第一全程本地处理。工具在你的电脑上运行GUI 模式通过 selenium 库一个能程序化操控浏览器的 Python 库驱动你本机的 Chrome脚本模式则用 requests 直接请求平台的官方 API——API 就是各网站开放给客户端读取数据的正式网络接口。文件最终落在你自己选的文件夹里链路中没有任何中转服务器。第二代码全部开源。所有爬虫脚本都放在 Spiders 目录下每个平台是相互独立的模块。跑之前你可以逐行看它请求了哪些接口、把数据写到哪里流程透明。第三只走官方接口。以 B 站脚本为例它只调用 api.bilibili.com 上的两个官方接口一个取观看历史一个取会员信息不碰私有接口也不涉及任何他人的数据只读你自己账号的内容。第一次导出 B 站观看记录装环境、拿 Cookie、完成备份从零基础到第一次导出其实只需要 3 条命令。先确保电脑装了 Python 3 和 Chrome 浏览器然后git clone https://gitcode.com/GitHub_Trending/in/InfoSpider cd InfoSpider pip install -r requirements.txt依赖包括 selenium、requests 等十几个库装完就可以跑。GUI 入口在 tools/main.pycd tools python3 main.py界面弹出后点击想备份的数据源按钮选择保存路径在自动弹出的浏览器窗口里输入账号密码爬取完成后浏览器自动关闭保存目录里会出现 xxx.json 数据文件和 xxx.html 分析图表文件。如果单独运行 B 站脚本 Spiders/bilibili/main.pyCookie 要自己拿用 Chrome 登录 B 站后按 F12 打开开发者工具切到 Network 面板刷新页面点开任意一条发往 api.bilibili.com 的请求把请求头里 Cookie 的完整值复制出来填入脚本中 cookie 所在位置然后运行python3 Spiders/bilibili/main.py⚠️ Cookie 本质上是你的登录凭证相当于账号的临时钥匙不要发给别人或粘贴到不可信的网页里用完建议在浏览器里清除。程序确认登录状态后会弹出文件夹选择对话框让你定保存位置选一个专门的备份文件夹即可。结束后会生成两个文件bilibili_history.json记录观看历史脚本最多取 10 页、每页 200 条即最多 2000 条user_info.json记录账号与等级信息两个你可能马上会遇到的问题顺带说一下报 ChromeDriver 错误通常是驱动版本和 Chrome 版本对不上换一个匹配的版本即可中途中断或文件是空的多半是 Cookie 过期或网络波动重新拿一次 Cookie 再跑就行数据全在本地重跑没有任何额外成本。数据到手之后怎么做出年度回顾和消费复盘JSON 文件到手最直观的玩法是给自己做一份年度回顾。bilibili_history.json里带着视频标题、时间等字段用 Excel 打开或直接用 pandas 读取依赖列表里已包含按月分组统计就能看到自己哪几个月看得最多、哪类内容占大头项目本身也带数据分析能力部分数据源爬完后会直接生成可视化图表文件不用自己再写画图代码。另一份有画面感的是消费复盘。把淘宝订单和支付宝交易流水按月汇总哪个月花得最多一目了然往下翻到具体商品冲动消费的套路往往一眼就能认出来。拿这份记录和预算线做个简单对比下个月的消费心里会有底得多比盯 App 里的余额有用。个人数据提取的真正价值不在于爬取这个动作而在于你线上生活的原文第一次完整存放在自己手里——可以复盘、可以分析、可以留档主动权在你。现在就可以做两件事✅ 挑一个你最好奇的数据源把第一次导出跑完再定一个每月备份的节奏数据攒上半年你的第一份年度回顾就水到渠成了。【免费下载链接】InfoSpiderINFO-SPIDER 是一个集众多数据源于一身的爬虫工具箱旨在安全快捷的帮助用户拿回自己的数据工具代码开源流程透明。支持数据源包括GitHub、QQ邮箱、网易邮箱、阿里邮箱、新浪邮箱、Hotmail邮箱、Outlook邮箱、京东、淘宝、支付宝、中国移动、中国联通、中国电信、知乎、哔哩哔哩、网易云音乐、QQ好友、QQ群、生成朋友圈相册、浏览器浏览历史、12306、博客园、CSDN博客、开源中国博客、简书。项目地址: https://gitcode.com/GitHub_Trending/in/InfoSpider创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED

相关推荐

LTspice放大器仿真进阶:从同相放大到D类滤波的实战与避坑指南

LTspice放大器仿真进阶:从同相放大到D类滤波的实战与避坑指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

📅 2026/9/20 18:20:58
PySpark 黄金文件测试解析:pa.RecordBatch.from_pandas 在不同 preserve_index 下的行为矩阵

PySpark 黄金文件测试解析:pa.RecordBatch.from_pandas 在不同 preserve_index 下的行为矩阵

PySpark 黄金文件测试解析:pa.RecordBatch.from_pandas 在不同 preserve_index 下的行为矩阵 【免费下载链接】spark Apache Spark - A unified analytics engine for large-scale data processing 项目地址: https://gitcode.com/gh_mirrors/sp/spark 导读 …

📅 2026/9/20 18:20:58
Flow 抽象枚举(Abstract Enums):用 `Enum<>` 与 `EnumValue<>` 编写通用枚举工具函数

Flow 抽象枚举(Abstract Enums):用 `Enum<>` 与 `EnumValue<>` 编写通用枚举工具函数

开发工具静态分析代码质量 【免费下载链接】flow Adds static typing to JavaScript to improve developer productivity and code quality. 项目地址: https://gitcode.com/gh_mirrors/flow30/flow 点击查看 免费下载 导读 Flow Enums 是 Flow 引入的一组名义化&…

📅 2026/9/20 18:15:58
MORE NEWS

更多资讯

📰

DGX Spark上部署Qwen3.5-35B-A3B-FP8:vLLM实战与性能实测

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

📰

uni-app 请求拦截器 401?Codex 接入 TaoToken 后这样排查

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

📰

@eggjs/koa-static-cache 版本演进与静态缓存中间件实战解析

eggjs/koa-static-cache 版本演进与静态缓存中间件实战解析 【免费下载链接】egg 🥚🥚🥚🥚 Born to build better enterprise frameworks and apps with Node.js & Koa. https://307.run/eggcode 项目地址: https://gitcode…

📰

RMS、标准差与RMSE:别再混用这三个指标了

1. 三个指标为什么总被混着用做数据分析或者信号处理的人,几乎都遇到过这样的场景:手头有一组测量值,想描述它的波动大小,脑子里蹦出来的第一个词可能是“标准差”,也可能是“均方根”,偶尔还会有人提“均方…

📰

Aider 实战:TaoToken 跑通 Python 仓库的依赖升级

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

📰

Elfouhaily海浪谱详解:MATLAB实现海面电磁散射仿真统一谱模型

做海面电磁散射仿真那阵子,我一直在找一个能同时覆盖重力波和毛细波的海浪谱模型。PM谱、JONSWAP谱虽然很成熟,但都主要描述重力波段;雷达后向散射关心的布拉格波数通常在几十到几百 rad/m,恰好落在毛细波到短重力波的过渡段。后来…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬