小说下载器新手完整指南:三步批量保存网页小说,打造你的离线书库

发布时间:2026/8/18 17:06:03
小说下载器新手完整指南:三步批量保存网页小说,打造你的离线书库 小说下载器新手完整指南三步批量保存网页小说打造你的离线书库【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader深夜十二点你追更的小说正到高潮翻回目录想继续看下一章页面却弹出一行冰冷的提示该章节已删除。你这才意识到自己付费订阅过的作品居然会毫无征兆地从互联网上消失。这种遗憾每个网文读者都可能遇到。novel-downloader小说下载器就是为解决这个问题而生的通用型小说下载工具它能在浏览器里把一百多个小说网站的章节批量抓取下来一键打包成 TXT 和 EPUB 文件让心爱的故事真正存进你的硬盘。一次书消失的经历让我开始认真研究保存工具故事要从一本冷门小说说起。它首发于某个不算热门的平台没有转载网站愿意收录作者更新了两年突然有一天整部作品连同网站一起下线了。后来者想再读连搜索都搜不到任何痕迹。这类事并不罕见起点、晋江上入 V 的小说可能下架轻小说网站可能整体关停付费订阅的内容说没就没。小说下载器的核心价值一句话就能讲清趁作品还在把它完整、结构化地保存到本地TXT 留给任何设备EPUB 留给阅读器从此不再依赖网站是否还活着。它的三个突出特点值得先记在心上覆盖面广支持国内外一百多个小说网站从起点、晋江到日本小说平台都有对应规则对抗反爬内置图片解码、字体加密破解等方案能处理不少防抓取手段高度可定制章节筛选、输出格式、下载节奏都可以按你的习惯调整。小说下载器是什么一个住在浏览器里的数字图书馆管家先澄清一个容易混淆的概念小说下载器不是需要安装的桌面软件而是一个油猴脚本UserScript。它寄生在浏览器中当你打开受支持的小说网站时自动运行在页面右上角挂出一个下载按钮。用油猴脚本而非独立软件好处显而易见对比维度油猴脚本方案桌面抓取软件安装门槛浏览器装个插件即可需要下载安装程序登录状态自动沿用浏览器会话往往要单独配置 Cookie跨平台跟随浏览器Win/Mac/Linux 通吃每平台单独维护单页应用兼容直接操作页面 DOM天然适配需另开浏览器内核抓取简单说脚本跟着浏览器走你在网站上是什么状态下载时就是什么状态基本不需要额外的账号配置。三步完成安装并跑通你的第一次下载整个上手过程不超过十分钟跟着下面三步走即可。第一步给浏览器装上脚本管理器油猴脚本需要运行环境这个环境就是脚本管理器三选一即可Tampermonkey功能最全、文档最多新手首选Violentmonkey开源免费轻量无广告GreasemonkeyFirefox 用户的经典选择。安装完成后浏览器工具栏会出现对应的管理器图标第一步就完成了。第二步把小说下载器脚本装进浏览器如果你习惯自己构建可以克隆仓库后编译出成品脚本git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build构建完成后把dist目录下的bundle.user.js文件拖入脚本管理器界面按提示确认安装即可。脚本管理器会弹窗询问权限直接允许就行。第三步打开小说目录页点击下载图标装好之后打开任意受支持网站的目录页右上角会出现一个下载图标。点击它下载就正式开始了右下角弹出进度条显示当前下载进度想看得更细可以按 F12 打开控制台查看实时日志下载完成后浏览器会自动下载一个 TXT 文档和一个 EPUB 文件。小贴士下载期间脚本会播放一段无声音频这是为了阻止浏览器在后台把页面休眠属于正常现象不用慌。上图展示的是下载进行中的画面左侧是小说章节列表底部开发者工具里能看到脚本正在逐个请求章节内容整个过程自动运转无需人工干预。上面这张是脚本解析后的书籍页面效果封面、简介、分卷章节一目了然。确认章节列表完整后再点击下载按钮就能一次性把整本书搬回家。下载一本书的完整流程从目录到 TXT/EPUB第一次用会觉得点一下就好但背后其实是四步流水线作业解析目录bookParse脚本读取目录页的章节链接连同书名、作者、简介、分卷信息一起整理成结构化清单抓取章节chapterParse逐个请求章节正文这一步会跳过未购买或未登录的付费章节清洗内容cleanDOM去掉广告、导航、无关脚本只保留正文段落和插图避免打包进杂质打包输出按预设模板生成 TXT 和 EPUB插图会一并嵌入最后通过流式压缩写出。为了让逐站适配这件事可维护项目把所有网站规则按目录结构特征分了五大类每一类都有现成模板规则类型适用特征典型网站onePage单页式目录章节列表一页展示各类笔趣阁、UU 看书twoPage分页式目录章节列表跨多页轻小说文库、18 看书special需要特殊处理的平台起点、晋江、pixiv、Lofterbiquge笔趣阁系列变体网站各种笔趣阁 XX站mbtxt目录与正文混杂的特殊格式全书斋等新网站上线时开发者只需找到对应分类的模板补上如何取章节链接和如何取正文这两个关键逻辑即可其他都是现成的。上图是保存后的章节正文效果标题、段落层次分明没有广告和干扰元素直接阅读也很舒服。当网站把文字藏进图片三层解码方案是怎么工作的有些网站比如西瓜书屋会用更狠的手段——把正文文字直接替换成图片让抓取工具只能拿到一堆图片文件。小说下载器对此准备了一套三层解码方案解码层工作方式速度准确度文件名映射按图片文件名直接查表匹配文字最快依赖匹配表覆盖哈希匹配下载图片计算哈希值与远程映射表比对较快内容相同即可命中OCR 识别调用 PaddleOCR 中文模型识别图片中的字最慢最高但非 100%解码顺序是先快后准前两层搞不定才动用 OCR。匹配表会自动拉取并缓存在脚本管理器的本地存储中OCR 模型首次使用时才下载之后就本地复用。三层全部失败的文字会被忽略所以遇到图文站建议优先用 HTML 版成品核对一遍。面对这类图文混合的内容脚本会把图片和文字一起保存进 EPUB阅读时图文并茂、完整还原原站体验上图就是一个典型的图文混排章节效果。另一类常见手段是字体加密正文用自定义字体渲染直接抓取的文本全是乱码。脚本会自动下载字体文件并建立字符映射还原真实文字。目前晋江文学城、番茄小说可能需要你手动配合一次字体匹配操作时留意控制台里以[jjwxc-font]、[fanqie-font]开头的提示即可。把下载调教成你的专属流程默认行为已经够用但真正让它懂你的是几个暴露在浏览器全局对象上的自定义入口。只下载你想要的章节在点击下载按钮之前按 F12 打开开发者工具在 Console 里定义一个chapterFilter函数就能精确控制下载范围。只下载前 50 章function chapterFilter(chapter) { return chapter.chapterNumber 50; }只想收录某一卷的内容function chapterFilter(chapter) { return chapter.sectionNumber 1; }这行代码的意思是只有满足条件这里是第一卷的章节才会进入下载队列其余全部跳过。调整成品的排版样式定义window.saveOptions对象可以控制输出格式。比如把所有章节标题统一成第 N 章 XXX的格式const saveOptions { getchapterName: (chapter) { if (chapter.chapterName) { return 第${chapter.chapterNumber}章 ${chapter.chapterName}; } return 第${chapter.chapterNumber}章; }, }; window.saveOptions saveOptions;想让正文段落拥有首行缩进、更宽松的行距也可以直接注入一段 CSSconst saveOptions { mainStyleText: p { text-indent: 2em; line-height: 1.6; }, }; window.saveOptions saveOptions;下载完自动收尾如果你希望下载完成后自动执行某个动作比如关闭标签页可以定义customFinishCallbackfunction customFinishCallback() { window.close(); }避坑提示以上自定义变量都必须在点击下载按钮之前注入否则脚本读取不到配置不会生效。常见问题速查下载不顺时先看这张表现象常见原因解决办法右上角没有下载图标单页应用页面未初始化按 F5 强制刷新当前页面付费章节全部跳过未登录或未购买登录网站账号并确认已购买对应章节下载速度太慢网站反爬限速在设置里调高并行线程数或调低下载间隔下载的文档出现乱码字符字体加密未完成匹配开启调试模式按控制台提示提交字体匹配图片文字变成空白三层解码均失败优先使用 HTML 版成品查看长时间无进展网络波动或页面休眠保持页面在前台耐心等待重试调试是排查问题的钥匙在设置中开启调试模式后下载包内会附带一份debug.log把它完整提交给开发者能大幅提高问题定位效率。如果下载压根没产出文件可以打开设置里的测试视图复制日志选项卡的内容另行保存。上图是一本下载完成的 TXT 成品书名、分卷、章节层层分明用任何文本编辑器或阅读软件都能打开离线阅读毫无压力。支持哪些网站以及如何让更多网站可用项目目前覆盖的站点横跨国内外从主流原创平台到小众社区都有涉猎这里列出一部分平台类型代表网站国内原创平台起点中文网、晋江文学城、番茄小说、七猫中文网、纵横中文网创作社区长佩文学、书耽、Lofter、pixiv日本小说平台小説家になろう、カクヨム、ハーメルン转载与免费站笔趣阁系列、UU 看书、69 书吧、轻小说文库如果你发现心仪的网站不在支持列表里也不必干等——项目对贡献者非常友好克隆仓库到本地yarn install安装依赖参考同类型网站模板继承BaseRuleClass实现bookParse解析目录和chapterParse解析正文两个方法在src/router/download.ts中登记域名对应的规则运行yarn build编译提交改动等待合并。遇到问题想反馈时请优先在项目支持页面提交 issue并按模板填写环境信息和日志发布在评论区或交流群组的反馈通常不会被处理。如果是新网站或新功能请求先去 issue 区搜搜有没有人提过在已有 issue 下补充内容即可。写在最后把阅读记忆牢牢握在手里网络时代内容的所有权越来越脆弱一条公告就能让整本书消失得无影无踪。小说下载器能做的就是让你在作品还活着的时候把文字、插图、分卷结构完整地保存成自己的资产。它不挑平台、不怕反爬、允许你按习惯定制输出一百多个网站的支持规模也意味着——你收藏夹里的书大概率已经能下载了。下次再遇到心动的作品别再只收藏链接了。打开小说下载器把它变成你硬盘里随时可读的电子书让每一段故事都真正属于你。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考