5步把网页小说转为EPUB:WebToEpub指南

📅 2026/8/22 15:45:56
5步把网页小说转为EPUB:WebToEpub指南
5步把网页小说转为EPUBWebToEpub指南【免费下载链接】WebToEpubA simple Chrome (and Firefox) Extension that converts Web Novels (and other web pages) into an EPUB.项目地址: https://gitcode.com/gh_mirrors/we/WebToEpub你在一个轻小说站点追一部连载更新到第401章每章之间隔着广告和弹窗而周五飞东京的四个小时没有网。你需要一份能离线打开、带目录、带封面的 EPUB 文件。WebToEpub 就是干这个的一个浏览器扩展把网页小说批量抓取、清理、打包成标准 EPUB全部在你本机的浏览器里完成。它 400多个网站专用解析器 章节级批量下载器 EPUB 打包器。解析器负责认出正文在哪、章节列表在哪下载器按你勾选的范围抓页面和图片打包器用 zip.js 生成带元数据的 EPUB 文件。项目开源、免费GPLv3 协议。从克隆到装好浏览器扩展装好 Node.js 后三条命令完成构建git clone https://gitcode.com/gh_mirrors/we/WebToEpub cd WebToEpub npm install npm run lint跑完后 eslint 目录下会多出两个文件.xpiFirefox 版和 .zipChrome 版输出结尾出现Wrote Zip to disk; Done表示构建成功。Firefox地址栏输入about:debugging#/runtime/this-firefox点 Load Temporary Add-on选中 .xpi 文件。Chrome/Edge打开chrome://extensions右上角打开开发者模式点加载已解压的扩展程序选择 .zip 解压后的文件夹。装好后工具栏出现书本图标。注意临时加载的扩展在浏览器重启后失效长期使用要重新加载或从商店安装。三种任务对应三个功能入口点扩展图标打开面板面板结构正好对应三件事。1. 认出网站、拉出章节列表专用解析器。打开一个被支持的站点baka-tsuki.org、fanfiction.net、wuxiaworld.com、royalroad.com 等面板自动填好 Starting URL、标题、作者并列出 First Chapter 到 Last Chapter 的全部章节。插件内置 400 多个解析器见 plugin/js/parsers/一个站点一个文件匹配成功就跳过下面的手动配置。2. 选章节、点按钮、出文件Pack EPUB。在 Include 区域按章节勾选点 Pack EPUB进度条走完EPUB 落到你的下载目录。截图是一本 401 章轻小说的面板可全选章节也可只勾其中一部分Advanced Options 里能进一步控制章节标题的处理方式。3. 站点没解析器用 Default Parser 手动指路。面板顶部显示 Using Default Parser 时说明该站没有专用解析器。填域名、填一个测试章节 URL、填正文区域的 CSS 选择器如div#content点 Test 按钮面板会预览第一章实际会被打包进什么内容内容对了再 Finish。401章EPUB的完整打包流程以一部 baka-tsuki.org 上的连载为例从头到尾走一遍打开小说目录页点工具栏 WebToEpub 图标面板自动填充标题、作者、语言、封面候选核对 First/Last Chapter取消不想要的章节点 Pack EPUB进度条对应各章下载进度下载目录出现 .epub 文件 用 Calibre 打开检查400 章大概需要几分钟取决于网速。中途某章抓取失败时面板弹出错误框带 Retry / Cancel / Open URL 按钮点 Retry 只重试失败的部分不用从头再来。四类高频报错的现象与解法第120章之后正文整段空白。原因是站点有访问频率限制连续请求被 403 拦截。解法在错误面板点 Retry 间隔重试给站点写解析器时可在构造函数里设this.minimumThrottle 3000让请求间隔 3 秒。面板一直显示 Using Default Parser章节列表拉不出来。原因是该站没有专用解析器自动匹配失败。解法按第三节的 Default Parser 配置填选择器并点 Test 验证常去的站点值得按进阶部分补一个解析器文件。EPUB 里正文有了图片全是占位符。原因是部分图片请求失败或跨域被拦截。解法先在浏览器里手动翻几章让图片进入缓存再打包仍失败的章节用错误框的 Open URL 定位是哪个图源。Chrome 加载扩展报 Manifest file is missing。原因是选的是 zip 包本身而不是解压后的目录。解法先解压 .zip选解压目录再点加载。进阶给新网站写解析器常去的站点不在列表里自己写一个成本很低。在 plugin/js/parsers/ 下新建 MySiteParser.js注册到 ParserFactoryparserFactory.register(mysite.org, () new MySiteParser()); class MySiteParser extends Parser { findContent(dom) { return dom.querySelector(article); } }findContent返回正文容器就能跑通最基本的场景。章节列表提取、作者/语言提取等可选方法参考 plugin/js/parsers/Template.js每个方法的用途都有注释。改完npm install后执行npm test在浏览器里过一遍单元测试确认没破坏现有解析器。下一步仓库就是文首 clone 命令指向的那个地址按流程构建装好今晚就能把在追的那本书离线读完。【免费下载链接】WebToEpubA simple Chrome (and Firefox) Extension that converts Web Novels (and other web pages) into an EPUB.项目地址: https://gitcode.com/gh_mirrors/we/WebToEpub创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考