拓冰建站拓冰建站
首页 / 资讯中心 / 正文

小说下载器完整指南:10 分钟批量保存网页小说,导出 TXT 和 EPUB

小说下载器完整指南10 分钟批量保存网页小说导出 TXT 和 EPUB【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader换到新阅读器那天你才意识到追了大半年的那本书只活在某个小说网站的网页里封面、插图、分卷全绑在对方服务器上。上周那个站还悄悄关了你连再翻一遍都做不到。novel-downloader小说下载器就是解决这件事的——它在浏览器里把一整本小说批量抓取下来打包成 TXT 和 EPUB让作品真正落到你的设备。先看清楚它是什么、能替你干什么先澄清一个容易混淆的概念它不是要单独安装的桌面软件而是一段油猴脚本UserScript跟着浏览器一起跑的小插件。你不妨把它想成一台随身携带的图书扫描仪藏在浏览器里——你每打开一本想留的书它就扫一份底稿、整理好归档存进你自己的档案柜TXT 和 EPUB。你在哪个浏览器、以什么身份登录网站它就跟着什么身份工作基本不用另配账号。它能替你做三件事整本批量抓取几百章逐章抓全封面、简介、分卷结构一并整理出来两种成品导出TXT 哪个设备都能打开EPUB 直接丢进阅读器对抗反爬正文被换成图片、字体被换成乱码时有专门的还原手段。十分钟装好脚本跑通第一本浏览器里先装一个脚本管理器Tampermonkey、Violentmonkey、Greasemonkey 任选其一。装完工具栏会多出管理器图标。拿到脚本。习惯自己构建的话克隆仓库、装依赖、编译出成品git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build编完把dist/bundle.user.js拖进脚本管理器、按提示确认安装即可不想编译的话直接在脚本管理器里装现成的成品脚本也行。打开任意受支持网站的目录页右上角会出现一个下载图标点它就开始下载。点图标后弹出的是设置面板能看到并行线程数、下载间隔这些选项一般保持默认就行。右下角会弹进度条看进度想更细就按 F12 看控制台日志。下完浏览器会自动存下 TXT 和 EPUB。上面是脚本解析后的书籍页封面、简介、分卷和章节列表都整理好了确认目录完整后再点下载。 小贴士下载时脚本会一直播一段听不见的音频是为了防止浏览器把后台页面休眠属正常现象别去关它。正文藏进图片、字体变乱码时它怎么救场有些站点比如西瓜书屋为了防抓把正文文字直接换成图片你抓到的只是一堆图还有些站点用自定义字体渲染直接取出来的文本全是乱码。针对这两种脚本分别备了还原方案。图片这套走的是三层解码按先快后准的顺序来解码层工作方式速度命中率文件名映射直接拿图片文件名查表换字最快取决于对照表覆盖哈希映射下载图片算哈希和远程表比对较快图片内容相同即可命中OCR 识别调 PaddleOCR 中文模型认字最慢最高但非 100%前两层没兜住才动用 OCR。对照表会自动拉取、缓存在脚本管理器的本地存储里OCR 模型首次用到才下载之后本地复用。简单说它先拿最省事的办法试试不出来再逐级加码大多数情况不用白等。三层都失败的字会被跳过所以图文站建议优先核对 HTML 版成品。面对图文混排的章节图片会和文字一起打包进 EPUB读起来和原站一样图文并茂。字体那边脚本会下载字体文件、建立字符映射来还原真实文字晋江、番茄有时需要你手动配合一次留意控制台里以[jjwxc-font]、[fanqie-font]开头的提示即可。只下指定章节、改排版注入几个变量就行默认行为够用想更省事就注入几个变量。注意这些变量必须在点下载图标之前写好脚本才读得到。按 F12 打开控制台在window下定义。只下载某一卷定义chapterFilterfunction chapterFilter(chapter) { return chapter.sectionNumber 1; }想改章节标题格式统一成第 N 章 XXX定义saveOptionswindow.saveOptions { getchapterName: (c) c.chapterName ? 第${c.chapterNumber}章 ${c.chapterName} : 第${c.chapterNumber}章 };还想要下载完自动收尾比如关掉标签页定义一个customFinishCallback打包完成后它会自动执行。⚠️ 避坑提示chapterFilter、saveOptions、customFinishCallback都得在点下载图标之前注入事后补写不会生效。图标不出现、下载卡住这样排查遇到不顺先对号入座这张表现象常见原因解决办法右上角没有下载图标单页应用没初始化完按 F5 强制刷新当前页付费章节整段跳过没登录或没购买登录账号并确认已购买下载速度很慢网站反爬限速在设置里调并行线程数 / 下载间隔文档出现乱码字符字体加密没匹配上开调试模式按控制台提示补字体匹配图片文字变空白三层解码都失败优先用 HTML 版成品查看排障的关键是日志在设置里开启调试模式后下载生成的 ZIP 里会多一个debug.log把它完整交给开发者最能快速定位问题。如果压根没产出文件就在设置里打开测试视图把日志选项卡内容另存下来。下载进行中就是这样章节列表在动、控制台逐条打出请求全程自动跑完不用手动干预。支持哪些站又会碰你哪些数据它覆盖的站点横跨国内外一百多个起点、晋江、番茄、七猫、纵横这类原创平台长佩、书耽、Lofter、pixiv 这类社区日本的小说平台小説家になろう、カクヨム 等以及一大批笔趣阁类转载站。想让新站可用也不难找到对应分类的模板继承BaseRuleClass补上怎么取章节链接怎么取正文两个逻辑再到src/router/download.ts登记域名、编译提交即可其余基本是现成的。有一点值得先说清楚——它会不会碰你的数据。对没有登录墙的公开页面在你同意的情况下脚本会尝试把书籍详情页和目录页存档到互联网档案馆archive.org。这一过程会上报IP 地址、User-Agent、Referer、详情页与目录页 URL、脚本版本、管理器版本除此之外不收集其他信息登录墙和付费内容也不在存档范围内。把想留的书变成自己手里的文件开头那本只剩链接的书现在你有了对策。下次再遇到想留的作品别再只点收藏——打开小说下载器把它变成 TXT 和 EPUB 存进硬盘故事就真正属于你了。下完的 TXT 长这样书名、分卷、章节层层分明用任何文本工具或阅读器都能打开离线读着不费劲。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门