小说下载器完整指南:4 步跑通批量下载,把整本网文打包成 TXT 与 EPUB

📅 2026/8/22 20:34:07
小说下载器完整指南:4 步跑通批量下载,把整本网文打包成 TXT 与 EPUB
小说下载器完整指南4 步跑通批量下载把整本网文打包成 TXT 与 EPUB【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader你花钱入 V 的书网站说删就删连个招呼都不打。小说下载器是一个跑在浏览器里的油猴脚本打开受支持网站的目录页点一下右上角的图标整本书按分卷结构批量抓下来打包成 TXT 和 EPUB 存进你的硬盘。书还在的时候它就替你留住。先说它能替你解决什么一句话把手动复制粘贴几百章压缩成一次点击。批量抓全书目录页点一下几百章逐章自动抓取右下角进度条实时可看双格式成品TXT 任何设备直接打开EPUB 带封面、目录、插图扔进阅读器就能读反爬有对策图片藏字、字体加密、单页应用都有现成处理方案高度可定制下哪些章节、标题长什么样、多快下完全都能按你的习惯调。上图是脚本输出的 EPUB 成品书页书名、封面、简介、分卷章节一层不差这就是保存的最终形态。知道它给什么之后花十秒钟判断它适不适合你。定位与选型一枚贴在浏览器上的书签它不是要单独安装的应用而是一枚贴在浏览器上的书签——书签背后站着完整的下载逻辑借你现成的登录态和网络环境干活你在网站上登录过、买过什么下载时就默认拥有这些权限不用二次配置账号。对比维度油猴脚本本项目独立抓取软件安装浏览器装脚本管理器拖入脚本即可下载安装包长期维护独立进程登录状态直接沿用浏览器里的会话常需单独导出、配置 Cookie运行环境就在你正看着的页面上工作脱离页面另行模拟请求单页应用读页面实时 DOM天然适配需重新渲染适配成本高结论要下需要登录才可见的付费章节基本只有脚本方案顺手。判断标准也简单——目标网站在支持列表里、浏览器能正常登录就可以往下走。判断合适的话下面四步跑通全流程。⚡ 首次上手4 步拿到你的第一个成品装脚本管理器。Tampermonkey、Violentmonkey、Greasemonkey 三选一装完浏览器工具栏会出现管理器图标。构建脚本本体。克隆仓库并编译产出成品脚本git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build安装脚本。把dist/bundle.user.js拖进脚本管理器权限弹窗全部允许。预期结果管理器列表里多了一条小说下载器。下载一本书。打开任一受支持网站的目录页点右上角的下载图标右下角进度条走完后浏览器自动落盘 TXT 与 EPUB另附一个含 HTML 章节的 zip。上图是一次真实下载的收尾画面控制台逐章打印下载完成任务栏里 zip 与 txt 成品已经落袋全程零人工干预。小贴士下载全程有一段听不见的音频在播那是脚本用来阻止浏览器休眠后台标签页的不是卡死。跑通只是开始接下来看它最硬核的一手。硬核透视正文被做成图片时它怎么读回来有些站比如西瓜书屋把正文整段替换成图片普通抓取只能拿回一堆无意义图片。小说下载器为此设计了先查单号、再比指纹、最后请人认字的三层解码按成本从低到高逐层兜底解码层原理成本文件名映射图片文件名本身编码了文字查表即得最低命中零耗时哈希匹配下载图片计算哈希与远程映射表比对较低内容相同即可命中OCR 识别PaddleOCR 中文模型逐字识别最高但准确度最好匹配表会自动拉取并缓存在脚本管理器本地存储OCR 模型仅首次使用时下载之后全程本地复用实现见 src/lib/decoders/。三层都没命中的字会被略过所以图文站建议再用 zip 里的 HTML 版核对一遍。另一道常见的墙是字体加密正文用自定义字体渲染抓回来是乱码。脚本会自动下载字体并建立字符映射还原真字晋江文学城、番茄小说偶尔需要手动配合一次字体匹配留意控制台以[jjwxc-font]、[fanqie-font]开头的提示即可。上图是保存后的章节页段落干净、插图原位保留阅读体验接近原站。会读了再让它听你的。个性化配置三种常见需求的改法需求一只下部分章节。点下载前按 F12在 Console 挂一个chapterFilter只有返回 true 的章节才进下载队列function chapterFilter(chapter) { return chapter.chapterNumber 50; // 只下前 50 章 }按分卷筛就改判sectionNumber按关键词筛就查chapterName。需求二统一成品排版。挂一个saveOptions对象改标题格式、注入 CSS 调缩进行距都行const saveOptions { getchapterName: (c) 第${c.chapterNumber}章 ${c.chapterName} }; window.saveOptions saveOptions;需求三下完自动收尾。定义一个customFinishCallback函数它会在 zip 生成后自动执行比如顺手window.close()关掉标签页。避坑三个钩子都必须在点击右下角下载图标之前注入之后再点下载才生效顺序反了配置会被直接忽略。调得越狠越要会排障。 排障速查下载不顺先看这张表现象常见原因怎么办右上角没有下载图标单页应用尚未初始化按 F5 强制刷新当前页付费章节全部跳过未登录或未购买先登录网站账号确认已购买对应章节速度明显变慢网站限速反爬设置里调高并行下载线程数正文出现乱码字符字体加密未完成匹配按控制台[jjwxc-font]/[fanqie-font]提示提交匹配图片处文字空白三层解码均未命中改用 zip 内 HTML 版章节核对拿调试信息的路径先在设置里开启调试模式下载完成后 zip 内会多出一份debug.log若卡到连文件都没生成就在设置里打开测试视图把日志选项卡内容整个复制存成 txt连同环境信息按模板提交 issue。反馈请走项目 issue 区——评论区、交流群里的反馈不会被处理。上图是 TXT 成品的最终形态分卷、章节标记分层离线打开无障碍。自己搞不定的交给社区。生态与参与新站点是怎么长出来的项目覆盖国内外一百多个站点起点、晋江等国内原创平台Lofter、pixiv 等创作社区小説家になろう等日本平台再加一大批笔趣阁系转载站。规则按页面结构分类存放在 src/rules/onePage、twoPage、special、biquge、mbtxt 等每个网站像一张配方卡——新站接入大多只需照同类模板填两个空章节链接怎么取、正文怎么取其余能力全部复用。想扩展或反馈的最短路径先在 issue 区搜是否已有同类请求有就补充没有就按模板新开想自己加站继承BaseRuleClass实现bookParse与chapterParse到 src/router/download.ts 登记域名构建后提交即可。下一步下次再遇到想长期留下的作品别再只点收藏打开目录页等右上角图标出现点下去。十分钟后你的硬盘里会多一本随时能打开的 EPUB——网站哪天关不关都关不到它头上。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考