news 2026/8/17 17:25:28

小说下载器零门槛指南:3个技巧把网页小说一键变成离线TXT与EPUB

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
小说下载器零门槛指南:3个技巧把网页小说一键变成离线TXT与EPUB

小说下载器零门槛指南:3个技巧把网页小说一键变成离线TXT与EPUB

【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader

凌晨一点,你追更的那本冷门小说刚推进到最精彩的部分,手指习惯性地按下刷新——屏幕上却弹出一个刺眼的 404。没有转载、没有备份,几十万字的作品一夜之间从互联网上蒸发。这种"书突然没了"的痛,追更党几乎人人都经历过。而小说下载器 novel-downloader,正是为对抗这种无力感而生的开源油猴脚本:它能把网页小说一键解析成离线 TXT 与 EPUB,让作品稳稳住进你的硬盘。

三十秒速览:它是什么、解决什么、适合谁

  • 它是什么:一个跑在浏览器里的用户脚本(油猴脚本),打开小说目录页就能用,无需安装任何客户端。
  • 解决什么:把 200+ 小说网站的章节,自动整理成规整的 TXT 和 EPUB 文件,断网也能读。
  • 适合谁:追更党、收藏党,以及所有被"全书消失"吓怕过的人。

一句话总结:网页小说一键下载,离线阅读自由

下载器在目录页实时解析章节列表,配合控制台日志,整个抓取过程一目了然

🚀 从零到一:首次安装与首次下载的完整流程

一个新手的完整动线,其实只有三件事:装好"壳"、装好脚本、点一下图标。

前置准备:给浏览器装一个脚本管理器。Tampermonkey、Violentmonkey、Greasemonkey 三选一即可,去各自的扩展商店搜索安装,一分钟搞定。接着获取脚本本体:想从源码构建的话,先克隆 https://gitcode.com/gh_mirrors/no/novel-downloader 到本地,依次执行yarn installyarn run build,把生成的dist/bundle.user.js拖进脚本管理器;不想折腾的,直接用项目发布页的现成脚本。

关键动作:打开目录页,点击右上角的下载图标。脚本启动后,访问任意受支持的小说网站,打开书籍目录页,右上角就会浮现下载图标。点击它,任务开始。这里有个贴心的小设计:脚本会播放一段无声音频,防止浏览器因为"太安静"而被系统休眠——这是很多下载工具容易忽略的细节。下载进度看右下角的进度条即可,想看细节就按 F12 打开控制台。

预期结果:几分钟到几十分钟后,浏览器自动下载两个文件——一个 TXT、一个 EPUB。TXT 用记事本或任意阅读软件打开,EPUB 交给专属阅读器,排版、目录、章节结构全都在。

下载后的小说正文保留了完整章节与段落结构,和网页阅读体验几乎一致

🛠 解锁进阶能力:把下载器调教成你想要的样子

用得越久你会发现,这个工具真正值钱的地方在于"可定制"。

只下载你想读的章节。场景:一本连载 800 章的书,你只关心前 100 章,或者只想重温第一卷。按 F12 在控制台定义一个chapterFilter函数即可:return chapter.chapterNumber <= 100;只下前 100 章,return chapter.sectionNumber === 1;只下第一卷,还能用chapterName.includes("武器")只保留标题里带"武器"的章节。

自定义输出排版。场景:你不喜欢默认的章节命名,想要"第 12 章 标题"这种格式;或者希望 TXT 正文每段首行缩进两格。在window下挂一个saveOptions对象,就能全权接管章节命名、文本样式甚至排序逻辑。配合用户脚本自动注入,这些偏好可以永久生效,每次下载都自动按你的习惯来。

破解"图片防爬"。场景:西瓜书屋这类网站把文字渲染成图片,普通抓取根本拿不到文字。下载器为此内置了三层解码——先按图片文件名映射直接匹配文字(最快),匹配不到就下载图片计算哈希再匹配,前两招都失灵时,才动用 PaddleOCR 模型识别(最准但最慢)。三层层层兜底,基本没有读不出来的图。

导出的 TXT 在编辑器里打开,章节标题与正文段落层次分明,可直接用于二次整理

🕳 新手最容易踩的3个坑与补救方案

坑一:打开书籍页却没有下载图标。原因多是网站是单页应用(SPA),内容由 JS 动态加载,脚本没抓到时机。对策很简单:按 F5 刷新当前页面,等图标出现再点击,八成能解决。

坑二:付费章节一个都没下下来。这不是 bug——脚本会刻意跳过未登录、未购买的 VIP 章节。先登录对应网站账号并确认已购买相应章节;部分网站(如晋江文学城)还需要在设置里填入登录 token,才能顺利下载。

坑三:文档里出现乱码或诡异字符。常见于晋江、番茄等使用了自定义字体混淆的网站。打开设置里的测试视图查看日志,留意以[jjwxc-font][fanqie-font]开头的提示,按提示完成字体匹配操作,乱码即可消除。

🔍 走进幕后:200多个网站是怎么"听懂"的

一个脚本要同时服务 200+ 结构迥异的网站,靠的是模块化规则设计。打开项目的src/rules/目录你会看到,每个网站都有专属规则文件,按"单页 / 双页 / 多页索引 / 特殊站点"等类型分门别类存放。新站点接入时,只需继承基础类、实现bookParsechapterParse两个方法,再把匹配规则登记进路由,一次构建即可生效。解析、清洗、存储彼此解耦,所以才能做到"加一个新站不动旧逻辑"。如果你恰好懂 TypeScript,这个项目本身就是一个极佳的开源练手素材。

🏁 尾声:把喜欢的作品留在身边

回到开头那个凌晨——下次再遇到心动的冷门作品,别再赌它会不会消失。装好脚本、打开目录页、点一下下载图标,几十万字的作品就从此住进你的硬盘,随时可读、永不 404。

现在就动手:克隆 https://gitcode.com/gh_mirrors/no/novel-downloader ,构建一份属于你自己的小说下载器,把每一本值得珍藏的书,都收进自己的数字图书馆。

【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/17 17:24:41

Windows备份策略全解析:完整、增量、差异备份实战指南

1. 数据守护的基石&#xff1a;为什么Windows备份远不止“复制粘贴”干了这么多年运维和IT支持&#xff0c;我见过太多因为一次误删、一次勒索病毒或者一次硬盘突然暴毙&#xff0c;导致重要数据彻底消失的案例。很多人对Windows备份的理解&#xff0c;还停留在“把文件复制到U…

作者头像 李华
网站建设 2026/8/17 17:24:40

Matt Pocock 亲测/wayfinder,AI 编程动工前先给需求画张地图

Matt Pocock 在一场一个多小时的直播里&#xff0c;用一个真实需求演示了 Wayfinder 这个新技能。需求是他自建的内容创作平台要加一个 TikTok 竖屏发布功能。全程没有幻灯片&#xff0c;只有一张不断被填满的决策地图&#xff0c;和一堆被逐一敲定的问题。这篇文章把这条「先画…

作者头像 李华
网站建设 2026/8/17 17:24:38

BGP路由优化实战:从基础配置到高级策略

1. BGP路由优化概述 BGP&#xff08;Border Gateway Protocol&#xff09;作为互联网的核心路由协议&#xff0c;承担着全球AS&#xff08;自治系统&#xff09;间路由信息交换的重任。在实际网络运维中&#xff0c;BGP路由优化直接关系到网络稳定性、传输效率和业务连续性。不…

作者头像 李华
网站建设 2026/8/17 17:19:44

双电解液系统与超浓电解液:突破350Wh/kg电池能量密度的关键技术

1. 从实验室奇闻到产业曙光&#xff1a;350Wh/kg的能量密度意味着什么&#xff1f;最近&#xff0c;一篇关于“24M双电解液系统”的论文在电池圈里激起了不小的水花。标题很直接&#xff0c;也很震撼&#xff1a;“24M双电解液系统可以产生350Wh/kg电池”。对于圈外人&#xff…

作者头像 李华
网站建设 2026/8/17 17:19:22

MySQL视图创建与管理:三种方法详解与实战避坑指南

1. 视图是什么&#xff0c;以及为什么你需要它如果你经常和数据库打交道&#xff0c;尤其是处理一些需要反复查询、但查询逻辑又比较固定的报表或数据组合时&#xff0c;你可能会发现自己在重复编写一些冗长且复杂的SQL语句。每次都要写一遍&#xff0c;不仅效率低下&#xff0…

作者头像 李华