
5分钟把200网站的小说批量下载到本地novel-downloader开源小说下载器实战指南【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader你追了两年多的小说某天再打开页面只剩一句内容已删除花真金白银买的章节目录里也悄悄消失了。如果你也经历过这种书还在书架上正文却找不回来的尴尬那么这个开源项目novel-downloader通用型小说下载器值得放进你的工具箱——它是一个油猴脚本支持200多个小说网站能把整本书按章节批量解析最终导出 TXT 和 EPUB 两种格式存到本地断网也能读。小说详情页上的批量解析界面上方是逐章打开的章节列表下方是脚本的实时下载日志进度与报错都摆在明面上一个脚本管住所有站点先搞清楚它是什么novel-downloader 的定位一句话就能说清它不是某个网站的下载插件而是一个站点适配层架构的通用下载器给需要把长篇小说离线保存的读者用解决的核心问题是平台会删书、网络会断但本地文件不会。它背后是 404 小说文库项目的一部分目标很朴素把那些质量不错但不够热门、随时可能彻底消失的作品留在本地。对无登录墙的站点如果你同意脚本还会尝试把书籍详情页和目录页存档到互联网档案馆为日后查书多留一条路。覆盖范围大致长这样站点类型代表站点付费章节国内原创大站起点中文网、晋江文学城、纵横、17K、长佩文学部分支持需登录且已购买轻小说平台SF轻小说、轻之文库、哩哔轻小说、米国度公共章节为主海外小说站カクヨム、小説家になろう、Novel Up Plus、Pixiv公共章节为主转载资源站笔趣阁系列、UU看书、腐书网、搜小说、乐文公共章节注意未登录或未购买的付费章节下载时会被直接跳过这是有意的设计不是 bug。脚本工作的典型场景小说站的书籍详情页右上角出现下载图标即可开始整本下载从零到第一本离线小说5步走通第 1 步装一个脚本管理器。Tampermonkey、Violentmonkey、Greasemonkey 三选一浏览器扩展商店里都有装完重启浏览器。第 2 步安装 novel-downloader。从项目的发布渠道把bundle.user.js装进管理器新手直接用现成的用户脚本安装页即可零门槛。第 3 步确认脚本活着。打开任意一个支持列表里的小说站书籍详情页右上角如果出现下载图标说明规则已经命中当前网站。第 4 步点图标开始下载。脚本会自动解析目录、逐章抓取正文和插图右下角进度条实时刷新也可以按 F12 在控制台看详细日志。第 5 步等待双格式落盘。完成后浏览器自动保存一份 TXT记事本就能读和一份 EPUB阅读器里打开整本书就此进入你的本地书库。下载期间脚本会循环播放一段无声音频这是防止浏览器把后台标签页休眠掉属正常现象。如果你想用最新版本或参与开发本地构建也很快git clone https://gitcode.com/gh_mirrors/no/novel-downloader克隆下来后执行yarn install装依赖、yarn run build编译产物就是dist/bundle.user.js拖进脚本管理器即可。yarn dev还能起一个本地代理调试模式边改代码边刷新页面验证适合准备给项目加新站点支持的贡献者。核心能力拆解它凭什么吃下这么多站点每个网站一套独立规则按目录分类管理打开src/rules/目录就能看到它的版图onePage/放单页正文的站点、twoPage/放目录页正文页两段的站点、onePageWithMultiIndexPage/放目录还要翻页的站点、special/放逻辑复杂的特殊站起点、晋江、Pixiv 都在这里。每个站点一个文件继承统一的BaseRuleClass实现bookParse和chapterParse再在src/router/download.ts和src/header.json里登记匹配规则。好处显而易见新加一个网站只是往抽屉里放一个新文件夹坏一个站点也不会拖累别人。正文被换成图片三层解码依次接力有些站点比如西瓜书屋为了反爬会把正文文字渲染成图片。脚本内置了一条递进的解码链文件名映射直接拿图片文件名对照映射表还原文字最快哈希映射文件名对不上就下载图片算哈希值再匹配依然很快OCR 识别前两步都失败才动用 PaddleOCR 模型识别最准但最慢。首次启用 OCR 会自动下载中文识别模型并缓存在本地之后离线可用映射表也会自动拉取缓存。输出的是整本书不只是文字抓取时正文里的插图会一并下载打包最终产出 TXT EPUB 双格式外加一份包含各章 HTML 和调试信息的 ZIP。文字版方便二次编辑EPUB 版保留排版可以直接进阅读器下载完成的 TXT 文件章节标题和正文段落完整保留可直接阅读或二次编辑进阶玩法把下载器调成你的习惯只下想要的章节。点运行前按 F12在控制台挂一个筛选函数返回true的章节才会被下载function chapterFilter(chapter) { return chapter.chapterNumber 100; // 只下前100章 }按卷筛chapter.sectionNumber 1、按标题关键词筛chapter.chapterName.includes(武器)同理超长篇分卷分批下比一口气灌几千章稳得多。改输出样式。往window.saveOptions里塞配置即可把章节名改成第x章 xxx、给每个自然段加缩进、删掉 EPUB 里的空行甚至让章节倒序排列。下载完自动收尾。定义window.customFinishCallback脚本生成 ZIP 后自动调用它比如顺手window.close()关掉标签页。小贴士这套筛选、保存参数、token 都可以再包一层用户脚本自动注入每次打开页面就生效不用手动敲。避坑与常见问题下载慢→ 设置里调并行线程数3~5 是稳妥区间对反爬严格的站点如长佩文学降到 1~2 并加大下载间隔别硬拉高线程。正文出现乱码或怪字符→ 多半是网站用了自定义字体。打开设置里的测试视图看日志找以[jjwxc-font]、[fanqie-font]开头的提示按提示提交字体匹配更新。下载到一半卡住→ 在设置里开启调试模式生成的 ZIP 里带debug.log是排查第一手材料如果连文件都没生成就把测试视图日志选项卡的内容完整复制下来反馈。付费章节没下下来→ 先登录对应网站账号并确认章节已购买未登录或未购买的部分会被跳过这是脚本的边界不是故障。想支持的站点不在列表里→ 去项目支持页面提交 issue 并填好模板更欢迎直接动手——继承BaseRuleClass写一个规则文件、登记路由和匹配规则就是贡献一个新站点的全部流程。下一步给你的书架加一道保险网站会改版、会删书、会整个消失但存在你自己硬盘里的 TXT 和 EPUB 不会。现在要做的就三件事装好脚本管理器把 novel-downloader 装进浏览器然后挑一本你最怕丢的小说把它的目录页打开、点右上角那个图标。合规提醒请只下载自己已购买或合法获取的内容尊重创作者控制抓取频率避免对目标站点造成过大访问压力。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考