小说下载器教程:在浏览器里批量保存整本小说为 TXT 和 EPUB

发布时间:2026/8/22 6:46:55
小说下载器教程:在浏览器里批量保存整本小说为 TXT 和 EPUB 小说下载器教程在浏览器里批量保存整本小说为 TXT 和 EPUB【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader小说下载器novel-downloader是一个运行在浏览器里的油猴脚本打开支持的小说网站目录页它就能把整本书逐章抓取下来导出成 TXT 和 EPUB 两种格式。不用装软件、不用配账号跟着下面的步骤走十分钟就能跑通第一次下载。先说清楚为什么要把小说存到本地小说托管在网站上而网站随时可能变天作者停更、作品下架、站点关停一条公告就能让整本书从互联网上消失。你读过、收藏过的内容之后想再打开可能连链接都找不到。想长期留住一本作品最稳妥的办法就是在它还在的时候把它完整存进自己的硬盘之后无论网站怎样本地的文件都能照常打开。一个住在浏览器里的图书馆管家小说下载器是一款通用型小说下载工具你在浏览器里访问受支持的小说网站它就接管抓取章节 → 清洗内容 → 打包文件的整套流程把你当前登录状态下能看的内容原样保存下来。三个最突出的特点覆盖面广内置一百多个国内外小说网站的适配规则从起点、晋江到日本轻小说平台都能找到对应站点对抗反爬文字被换成图片、正文被字体加密的情况有现成的解码和破解方案高度可定制下哪些章节、输出什么样式、下载节奏多快都能按你的习惯调整。上图是脚本解析一本书后的效果书名、封面、简介和分卷章节列表整理得清清楚楚确认列表完整后就可以开始下载。 安装只需五步在浏览器装一个脚本管理器Tampermonkey、Violentmonkey、Greasemonkey 三选一装完工具栏会多出管理器图标在管理器里新建脚本把成品脚本文件dist/bundle.user.js的全部内容粘贴进去权限弹窗直接允许如果习惯自己构建克隆仓库编译一次即可得到成品脚本git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build构建完成后在dist目录里能拿到bundle.user.js复制内容粘贴到脚本管理器即可打开任意受支持网站的书籍目录页右上角会出现一个下载图标点击图标右下角弹出进度条等它跑完浏览器会自动下载一个 TXT 文档和一个 EPUB 文件。上图是下载进行中的画面页面停留在章节列表开发者工具的 Console 里能看到脚本正在逐章请求正文并打印进度底部已经出现了正在生成的 TXT 和 zip 文件整个过程自动运转不用人工干预。下载期间脚本会播放一段无声音频那是为了阻止浏览器把后台页面休眠属于正常现象不用慌。点一次图标后台走了四步流水线下载看着是点一下就好实际是一套固定流水线解析目录读取目录页的章节链接连同书名、作者、简介、分卷一起整理成结构化清单抓取章节按清单逐个请求正文未登录或未购买的付费章节直接跳过清洗内容去掉广告、导航和无关脚本只保留正文段落和插图打包输出按模板生成 TXT 和 EPUB插图一并嵌入。项目把所有网站按页面结构特征分成了几类规则——单页目录、分页目录、需要特殊逻辑的平台、笔趣阁变体站等等每一类都有现成模板。给新站点做适配时只需要补上怎么取章节链接和怎么取正文两个关键逻辑其余环节全部复用这也是它能快速扩张支持站点的办法。 文字被藏进图片时它分三层解码有些站点比如西瓜书屋会把正文文字直接替换成图片抓下来的只剩一堆图片文件。小说下载器对此准备了一套三层解码方案解码层工作方式特点文件名映射按图片文件名查表匹配文字最快哈希匹配下载图片算哈希与远程映射表比对内容相同即可命中OCR 识别调用 PaddleOCR 中文模型识别图片文字最准但最慢顺序是先快后准前两层搞不定才动用 OCR。匹配表会自动拉取并缓存在脚本管理器的本地存储中OCR 模型首次使用时才下载之后一直本地复用。三层全部失败的文字会被忽略遇到这类站点建议用 HTML 版成品核对一遍。另一类常见手段是字体加密正文用自定义字体渲染直接抓到的文本是乱码。脚本会自动下载字体文件建立字符映射晋江文学城、番茄小说目前需要手动配合一次字体匹配留意控制台里以[jjwxc-font]或[fanqie-font]开头的提示按内容提交字体映射即可。️ 下载前先把下载范围调对只下部分章节按 F12 打开开发者工具在 Console 里定义一个chapterFilter函数只有返回true的章节才会进入下载队列比如只下载前 50 章function chapterFilter(chapter) { return chapter.chapterNumber 50; }调整成品排版同样方式注入window.saveOptions对象比如给正文段落加首行缩进、放宽行距const saveOptions { mainStyleText: p { text-indent: 2em; line-height: 1.6; }, }; window.saveOptions saveOptions;注意所有自定义都必须在点击下载按钮之前注入否则脚本读取不到配置不会生效。想要第 N 章 XXX风格的统一章节名也可以在saveOptions里改getchapterName函数。支持范围国内外主流站点基本都有平台类型代表站点国内原创平台起点中文网、晋江文学城、番茄小说、七猫中文网创作社区Lofter、长佩文学、pixiv日本小说平台カクヨム、小説家になろう转载与免费站笔趣阁系列、UU 看书、轻小说文库完整站点列表见 README.md 的目前支持小说网站一栏。想新增一个站点的话继承BaseRuleClass实现目录解析和正文解析两个方法再在路由文件里登记域名构建后就能用了项目对这类贡献很友好。❓ 下载不顺先看这张表现象常见原因解决办法右上角没有下载图标单页应用未初始化按 F5 强制刷新页面付费章节全部跳过未登录或未购买登录网站账号确认已购对应章节下载速度慢网站反爬限速设置里调高并行线程数、调低间隔文档出现乱码字符字体加密未完成匹配开调试模式按控制台提示提交字体匹配图片文字变空白三层解码均失败用 HTML 版成品查看核对调试是排查问题的钥匙在设置中开启调试模式后下载包内会附带一份debug.log把它完整提交给开发者问题定位效率会高很多。如果下载卡住、压根没产出文件可以打开设置里的测试视图把日志选项卡的内容复制下来保存。上图是一份下载完成的 TXT 成品分卷、章节层级分明任何文本编辑器或阅读软件都能打开离线阅读没有任何门槛。打开任意一个支持网站的书籍目录页点右上角那个下载图标你的第一本离线书库就开始了。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考