一学就会:用novel-downloader把200+网站的小说一键保存到本地 📅 2026/8/17 18:17:05 一学就会用novel-downloader把200网站的小说一键保存到本地【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader在追更这件事上你一定经历过这样的绝望熬夜追了三年的小说第二天打开网站简介还在正文却显示内容已删除。novel-downloader 正是为这种场景而生的开源小说下载脚本它支持 200 多个小说网站打开目录页点一下图标整本书就以 TXT 和 EPUB 两种格式躺进你的硬盘。我用它存下了几十本书今天把从安装到进阶的全套经验分享给你。我为什么开始用这款脚本一个追更人的深夜崩溃说个真实经历。去年我追的一本冷门轻小说首发在某个小站热度不高没有转载站收录。某天我再点进去整个站都打不开了——书没了网上搜遍也找不到任何痕迹。那一刻我才意识到你以为是永久收藏的网页其实只是别人服务器上的一条临时数据。后来我了解到novel-downloader 背后是一个叫404 小说文库的存档计划初衷就是抢救那些质量不错、却不够热门、随时可能从互联网上彻底消失的作品。脚本还会在你同意的情况下把书籍详情页和目录页提交到互联网档案馆存档相当于给书上了份保险。也就是说用它下载不只是图方便更是在为防止内容蒸发这件事出力。这是脚本解析出的书籍目录页封面、简介、分卷、章节列表一目了然是下载的起点。从安装到首战老用户带你走一遍完整流程先给浏览器配一个脚本管家novel-downloader 是典型的油猴脚本运行需要一个宿主。最常见的三款分别是 Tampermonkey用户最多、功能最全、Violentmonkey开源轻量和 GreasemonkeyFirefox 用户常用。去浏览器扩展商店搜名字、点安装一分钟就搞定和装普通插件没有区别。把脚本请进浏览器两种方式任选方式一直接安装适合绝大多数人。在脚本管理器中新建脚本把发行版代码粘贴进去保存即可或者下载.user.js文件后拖进浏览器脚本管理器会自动识别并询问是否安装。方式二本地构建适合想研究源码的玩家。把仓库克隆到本地git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn run build编译结束后dist目录下会生成bundle.user.js把它拖进脚本管理器就完成了安装。第一本小说是怎么被我存下来的装好之后随便打开一个支持的小说网站找到书籍目录页。注意看网页右上角——只要脚本认出了这个网站就会浮出一个下载图标点它就开跑了。整个过程不需要你盯着看脚本为了不让浏览器后台休眠会悄悄播放一段无声音频右下角有进度条实时汇报进度按 F12 打开控制台还能看到更细的日志。章节多的书会下得久一些耐心等一会儿完成后浏览器会自动弹出一份 TXT 和一份 EPUB 文件。这就是下载进行中的样子底部日志区逐条列出每章的抓取状态谁成功谁失败写得清清楚楚。存下来的书长什么样先说 EPUB。把它丢进手机上的任意阅读器你会发现分卷、章节、标题层级都保留得很完整和网站上的排版几乎一致阅读体验非常接近原站。这是下载后正文在阅读器里的效果段落结构完整直接进入沉浸阅读。再说 TXT。它适合用记事本、编辑器或者墨水屏设备打开不挑软件、不挑设备属于永久保真的通用格式。一份下载完成的 TXT 文件章节标题和正文段落都规规矩矩方便二次编辑。进阶篇把下载器调教成私人书童只想下部分章节一个筛选函数就够了几千章的大长篇你可能只想留前 100 章或者只想要某一卷。下载前按 F12 打开控制台定义一个小小的chapterFilter函数即可function chapterFilter(chapter) { return chapter.chapterNumber 100; // 只要前100章 }改成chapter.sectionNumber 1就只下第一卷改成chapter.chapterName.includes(武器)就只收标题里带武器的章节。筛选逻辑完全由你说了算这也是断点续传式分批下载的基础——超长书一次下不完就分几次筛选着下。标题、缩进、空行都能改自定义保存参数对输出格式不满意定义window.saveOptions对象即可。比如把章节名改成第 N 章 xxx的标准格式const saveOptions { getchapterName: (chapter) { return 第${chapter.chapterNumber}章 ${chapter.chapterName || }; }, }; window.saveOptions saveOptions;同理你还能调整正文的缩进、行距删掉 EPUB 里多余的空行甚至让章节倒序排列。改完刷新页面再下载出来的文件就是你的专属版本。下载太快会被封试试线程与间隔的组合设置里可以调节并行下载线程数和下载间隔。我个人的经验是常规网站开 35 个线程速度和安全都够用遇到反爬特别较真的站点比如长佩、全职小说网这类降到 12 个线程并拉大间隔宁可慢一点也别把人家服务器逼急了眼。脚本为每个网站都预置了比较合理的默认值新手完全可以不碰这项设置。正文全是图片三层解码了解一下有些网站比如西瓜书屋、海棠小说网会把正文里的字替换成图片来防抓取。novel-downloader 对此有一套层层递进的还原方案先按图片文件名直接映射回文字最快匹配不上就计算图片哈希值去比对映射表较快前两者都失效时才动用OCR 光学识别最准但最慢。OCR 用的 PaddleOCR 中文模型会在首次使用时自动下载并保存在本地之后无需重复拉取。也就是说连图片化正文这种硬骨头它也有办法啃下来。那些年我踩过的坑附解药下载出来的字是乱码或怪字符多半是网站用了自定义字体。晋江、番茄这类站点需要手动做一次字体匹配脚本日志里会有以[jjwxc-font]或[fanqie-font]开头的提示照着提示提交字体信息即可。下载卡住不动了先在设置里打开调试模式卡住时生成的 ZIP 包里会有一份debug.log把这份日志发给维护者问题往往能很快定位。如果连文件都没生成可以在测试视图里把日志选项卡的内容全部复制出来反馈。付费章节被跳过了这是正常现象——未登录、或者没购买相应章节脚本会直接忽略这些章。想下载 VIP 内容务必先登录账号并完成购买。想支持的新网站不在列表里项目是模块化设计的每个网站的解析规则独立存放在src/rules/目录下继承基础类、补上解析方法再注册匹配规则就能接入新站。你可以在项目仓库提交 issue 提出需求当然直接贡献代码会更受欢迎。这款脚本真正打动我的地方坦白讲用了一段时间后我发现它的价值早已超出下载本身。对普通读者来说它意味着真正的离线阅读自由——坐飞机、钻地铁、进电梯任何时候打开本地书库就能读也意味着安全感——再也不用担心喜欢的作品某天突然查无此书。我自己的书库已经按类别整理得井井有条搬家换设备也毫无压力。对技术爱好者来说它是一份相当优秀的学习素材TypeScript 工程化、浏览器脚本开发、网页结构解析、反爬对抗策略全都在一个真实项目里跑着。照着它的规则文件写几个新站适配你对网页是怎么构成的理解会瞬间上一个大台阶。最后说一句心里话工具无罪使用有道。下载前请确认内容的来源是合法的付费章节要买、作者要支持别拿它去做损害创作生态的事。把好工具用在对的地方才能长久地享受它带来的便利。现在轮到你动手了无论你是想收藏一本可能消失的心头好还是想在没网的地方继续追更novel-downloader 都能在几分钟内满足你。装好脚本管理器、装上脚本、打开目录页点一下图标——属于你的第一本离线小说就到手了。与其等某本书消失后才追悔莫及不如现在就把它存进你的硬盘。好的故事值得被长久保存而这一次主动权在你手里。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考