小说下载器零门槛指南:3个技巧把网页小说一键变成离线TXT与EPUB
【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader
凌晨一点,你追更的那本冷门小说刚推进到最精彩的部分,手指习惯性地按下刷新——屏幕上却弹出一个刺眼的 404。没有转载、没有备份,几十万字的作品一夜之间从互联网上蒸发。这种"书突然没了"的痛,追更党几乎人人都经历过。而小说下载器 novel-downloader,正是为对抗这种无力感而生的开源油猴脚本:它能把网页小说一键解析成离线 TXT 与 EPUB,让作品稳稳住进你的硬盘。
三十秒速览:它是什么、解决什么、适合谁
- 它是什么:一个跑在浏览器里的用户脚本(油猴脚本),打开小说目录页就能用,无需安装任何客户端。
- 解决什么:把 200+ 小说网站的章节,自动整理成规整的 TXT 和 EPUB 文件,断网也能读。
- 适合谁:追更党、收藏党,以及所有被"全书消失"吓怕过的人。
一句话总结:网页小说一键下载,离线阅读自由。
下载器在目录页实时解析章节列表,配合控制台日志,整个抓取过程一目了然
🚀 从零到一:首次安装与首次下载的完整流程
一个新手的完整动线,其实只有三件事:装好"壳"、装好脚本、点一下图标。
前置准备:给浏览器装一个脚本管理器。Tampermonkey、Violentmonkey、Greasemonkey 三选一即可,去各自的扩展商店搜索安装,一分钟搞定。接着获取脚本本体:想从源码构建的话,先克隆 https://gitcode.com/gh_mirrors/no/novel-downloader 到本地,依次执行yarn install和yarn run build,把生成的dist/bundle.user.js拖进脚本管理器;不想折腾的,直接用项目发布页的现成脚本。
关键动作:打开目录页,点击右上角的下载图标。脚本启动后,访问任意受支持的小说网站,打开书籍目录页,右上角就会浮现下载图标。点击它,任务开始。这里有个贴心的小设计:脚本会播放一段无声音频,防止浏览器因为"太安静"而被系统休眠——这是很多下载工具容易忽略的细节。下载进度看右下角的进度条即可,想看细节就按 F12 打开控制台。
预期结果:几分钟到几十分钟后,浏览器自动下载两个文件——一个 TXT、一个 EPUB。TXT 用记事本或任意阅读软件打开,EPUB 交给专属阅读器,排版、目录、章节结构全都在。
下载后的小说正文保留了完整章节与段落结构,和网页阅读体验几乎一致
🛠 解锁进阶能力:把下载器调教成你想要的样子
用得越久你会发现,这个工具真正值钱的地方在于"可定制"。
只下载你想读的章节。场景:一本连载 800 章的书,你只关心前 100 章,或者只想重温第一卷。按 F12 在控制台定义一个chapterFilter函数即可:return chapter.chapterNumber <= 100;只下前 100 章,return chapter.sectionNumber === 1;只下第一卷,还能用chapterName.includes("武器")只保留标题里带"武器"的章节。
自定义输出排版。场景:你不喜欢默认的章节命名,想要"第 12 章 标题"这种格式;或者希望 TXT 正文每段首行缩进两格。在window下挂一个saveOptions对象,就能全权接管章节命名、文本样式甚至排序逻辑。配合用户脚本自动注入,这些偏好可以永久生效,每次下载都自动按你的习惯来。
破解"图片防爬"。场景:西瓜书屋这类网站把文字渲染成图片,普通抓取根本拿不到文字。下载器为此内置了三层解码——先按图片文件名映射直接匹配文字(最快),匹配不到就下载图片计算哈希再匹配,前两招都失灵时,才动用 PaddleOCR 模型识别(最准但最慢)。三层层层兜底,基本没有读不出来的图。
导出的 TXT 在编辑器里打开,章节标题与正文段落层次分明,可直接用于二次整理
🕳 新手最容易踩的3个坑与补救方案
坑一:打开书籍页却没有下载图标。原因多是网站是单页应用(SPA),内容由 JS 动态加载,脚本没抓到时机。对策很简单:按 F5 刷新当前页面,等图标出现再点击,八成能解决。
坑二:付费章节一个都没下下来。这不是 bug——脚本会刻意跳过未登录、未购买的 VIP 章节。先登录对应网站账号并确认已购买相应章节;部分网站(如晋江文学城)还需要在设置里填入登录 token,才能顺利下载。
坑三:文档里出现乱码或诡异字符。常见于晋江、番茄等使用了自定义字体混淆的网站。打开设置里的测试视图查看日志,留意以[jjwxc-font]或[fanqie-font]开头的提示,按提示完成字体匹配操作,乱码即可消除。
🔍 走进幕后:200多个网站是怎么"听懂"的
一个脚本要同时服务 200+ 结构迥异的网站,靠的是模块化规则设计。打开项目的src/rules/目录你会看到,每个网站都有专属规则文件,按"单页 / 双页 / 多页索引 / 特殊站点"等类型分门别类存放。新站点接入时,只需继承基础类、实现bookParse和chapterParse两个方法,再把匹配规则登记进路由,一次构建即可生效。解析、清洗、存储彼此解耦,所以才能做到"加一个新站不动旧逻辑"。如果你恰好懂 TypeScript,这个项目本身就是一个极佳的开源练手素材。
🏁 尾声:把喜欢的作品留在身边
回到开头那个凌晨——下次再遇到心动的冷门作品,别再赌它会不会消失。装好脚本、打开目录页、点一下下载图标,几十万字的作品就从此住进你的硬盘,随时可读、永不 404。
现在就动手:克隆 https://gitcode.com/gh_mirrors/no/novel-downloader ,构建一份属于你自己的小说下载器,把每一本值得珍藏的书,都收进自己的数字图书馆。
【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考