小说下载器,把 100+ 小说网站的书籍批量下载成本地 TXT 和 EPUB

📅 2026/8/22 1:14:31
小说下载器,把 100+ 小说网站的书籍批量下载成本地 TXT 和 EPUB
小说下载器把 100 小说网站的书籍批量下载成本地 TXT 和 EPUB【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader先解决网页小说随时消失的问题你在某平台追更到第 80 章某天点开书架整本书连同作者主页一起没了。起点、晋江的入 V 作品也常毫无征兆地下架除非事先批量下载否则链接一失效内容就找不回来。小说下载器正为此而生它是一个油猴脚本装在浏览器里、随网页自动运行的一段代码随浏览器运行打开支持站点的书籍目录页时自动挂出下载按钮把整书章节抓取下来打包成 TXT纯文本与 EPUB通用电子书格式存进硬盘。从安装、下载流程到自定义调教全文一次讲完。装好脚本并跑通第一次下载整个安装过程十分钟以内分三件事给浏览器准备运行环境、把脚本挂上去、触发第一次下载。给浏览器装好运行环境油猴脚本需要由脚本管理器托管运行Tampermonkey、Violentmonkey、Greasemonkey 三选一从浏览器扩展商店安装即可装好后工具栏会出现管理器图标。把脚本挂进浏览器习惯自己构建的话克隆仓库并本地编译git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build编译完成后把dist目录下的bundle.user.js拖进脚本管理器界面按弹窗提示允许所需权限即可。打开任意支持站点打开支持列表中任一网站的书籍目录页右上角会出现下载图标点击它下载即开始右下角进度条显示总体进度按 F12 可在控制台查看逐章请求日志。下载完成后浏览器自动落一个 TXT 文档和一个 EPUB 文件。注意下载期间脚本会播放一段无声音频用于阻止浏览器将后台页面休眠属正常现象。下载进行中底部已生成成品文件从目录页到 TXT一次下载的完整链路点击一次图标背后数据完整走了四段路读目录、抓正文、清洗、打包。脚本先读取目录页把书名、作者、简介和分卷下的章节链接整理成结构化清单随后逐章请求正文页未登录或未购买的付费章节直接跳过拿到的 HTML 经过清洗剥掉广告、导航和无关脚本只留正文段落与插图最后按模板生成 TXT 与 EPUB插图嵌入其中流式压缩后写出文件。遇到把正文替换成图片的站点脚本按文件名映射、哈希匹配、OCR 识别三层顺序解码文字前两层失败才动用最慢但最准的识别层。每个站点由一条独立规则负责。项目按页面结构把规则分为几类新站点只需在对应模板里补上取章节链接和取正文两段逻辑规则类型页面特征典型站点onePage目录单页展示全部章节笔趣阁系列、UU 看书twoPage目录跨多页分页轻小说文库、18 看书special需登录、token 等特殊处理起点、晋江、pixiv、Loftermbtxt目录与正文混杂全书斋另有一类 biquge 模板专门覆盖笔趣阁系变体站几类合起来支撑起目前一百多个已支持站点。解析结果封面、简介与章节列表完整还原把下载调成你自己的样子三个注入到 window 的入口覆盖最常用的定制需求筛章节、改成品样式、下载后自动收尾。筛章节点击下载前按 F12 打开控制台定义 chapterFilter 函数返回 true 的章节才进入下载队列比如只收前 100 章function chapterFilter(chapter) { return chapter.chapterNumber 100; }把条件换成chapter.sectionNumber 1就只下载第一卷。注意自定义入口必须在点击下载按钮之前注入之后定义不会生效。改成品样式定义 saveOptions 对象可重写输出内容比如把所有章节标题统一为第 N 章 XXXconst saveOptions { getchapterName: (c) 第${c.chapterNumber}章 ${c.chapterName}, }; window.saveOptions saveOptions;同一对象里给 mainStyleText 赋值一段 CSS即可调整段落缩进与行距。下载后自动收尾customFinishCallback 在打包完成后自动执行批量挂机下载时可用它自动关闭标签页function customFinishCallback() { window.close(); } window.customFinishCallback customFinishCallback;边界与下一步小说下载器目前的边界同样清楚未登录或未购买的付费章节会直接跳过晋江、番茄遇到字体加密乱码时需按控制台[jjwxc-font]、[fanqie-font]提示手动做一次字体匹配图文站三层解码全部失败的文字会被忽略建议用 HTML 版核对单页应用站点若右上角没出现图标按 F5 刷新一次即可。问题反馈走仓库 issue 区按模板附上开启调试模式后产物 zip 里的 debug.log定位效率最高。项目对新站点规则持开放态度在src/rules/下仿照同类模板实现 bookParse 与 chapterParse 两个方法即可贡献。书还在的时候把它批量下载下来哪天链接 404硬盘里的 TXT 和 EPUB 还在。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考