ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

还在手动复制粘贴存小说?novel-downloader小说下载器让100+网站一键导出TXT与EPUB

还在手动复制粘贴存小说?novel-downloader小说下载器让100+网站一键导出TXT与EPUB 还在手动复制粘贴存小说novel-downloader小说下载器让100网站一键导出TXT与EPUB【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader凌晨两点你点开书架里追了三个月的连载屏幕却只回给你一行冰冷的404。起点、晋江、刺猬猫……这些平台上的小说可能毫无征兆地消失——即便你已经订阅、甚至付费过它。这不是小概率事件随便打开一个转载站首页满是首发于起点、起点却已查无此书的案例。如果你也经历过这种书没了的失落这篇要讲的 novel-downloader 小说下载器值得看完。它是一款开源的油猴脚本能识别超过100个中外小说网站把整本小说一键下载为 TXT 与 EPUB 两种格式让你离线阅读、永久保存。更难得的是它把保存这件事本身也当成一种责任凡是你能合法访问的小说它都尽量帮你留一份本地备份。 先说成果一个按钮换来两本书不谈原理先看它到底能给你什么。装好脚本后你打开任意支持网站的小说目录页网页右上角会出现一个下载图标。点击它脚本开始逐章抓取正文右下角的进度条实时汇报进度下载完成浏览器会自动弹出两个文件TXT 文档记事本、各类手机阅读器直接打开纯文本零门槛EPUB 文件自带目录与封面导入 Kindle、微信读书等阅读器即可获得完整阅读体验。上面这张图就是实际下载时的场景上方是小说目录页下方开发者工具里滚动着脚本抓取章节的网络请求。不需要你懂任何技术脚本自己会把整本书读完再整整齐齐打包给你。下载后的正文排版干净利落长章节还会自动分页长时间阅读也不累眼。对于图文混排的小说比如 Lofter 上的连载脚本会连插图一起下载文字与图片自然衔接而 TXT 版则自带章节层级标记标题、正文一目了然用任何文本编辑器打开都能快速定位这一节想让你记住的收获是它是成品级下载器拿到的不是一堆乱糟糟的网页而是可以直接进书架的文件。 三分钟装好你的私人图书馆管理员novel-downloader 是油猴脚本也就是运行在浏览器脚本管理器里的扩展。安装分三步第一步装一个脚本管理器。Tampermonkey 功能最全Violentmonkey 开源轻量Greasemonkey 则是 Firefox 用户的老朋友任选其一即可。第二步构建脚本。克隆仓库后安装依赖并构建git clone https://gitcode.com/gh_mirrors/no/novel-downloader cd novel-downloader yarn install yarn build构建完成后dist目录里会出现bundle.user.js把它拖进脚本管理器的界面安装即完成。第三步打开目录页开始下载。访问任意支持的小说网站当打开小说目录页时右上角会出现下载图标点击即开始。这里有两个小提示提前知道能少踩坑下载任务进行时脚本会播放一段无声音频这是为了防止浏览器休眠、保证后台抓取不停属于正常现象章节特别多的书需要一点耐心进度条和 F12 控制台都能看到实时状态。这一节的收获是从零到能用全程不需要写一行代码十分钟内可以搞定。 网站反爬怎么办三层解码方案拆给你看读者最常问的其实是小说网站防抓取那么狠凭什么你能下载现实确实不温柔。有的网站把文字替换成图片有的用自定义字体加密还有的上 Cloudflare 验证。novel-downloader 的应对思路不是硬碰硬而是分层递进、逐级兜底。以图片化文字为例它准备了三级解码方案你可以在src/lib/decoders/目录下看到对应实现文件名映射解码最快的一招。许多网站把图片文件名直接写成对应的文字脚本先按文件名匹配命中即用哈希值匹配解码文件名失效时下载图片并计算哈希值去映射表里比对速度也很快OCR 光学字符识别前两招都失效才动用重武器内置 PaddleOCR 中文识别模型OCRDecoder.ts把图片里的文字真正认出来。模型文件首次使用会自动下载并缓存之后离线可用。这套设计的妙处在于成本控制能靠文件名秒解的绝不让它走耗时的 OCR三级联动把最快和最准同时握在手里。至于晋江文学城这类用自定义字体加密的站点脚本会自动下载字体文件、建立字符映射保证下载出来的文档没有乱码。反爬严格的站点还能在设置里调整并行线程数与请求间隔既保护自己不被封 IP也不给网站服务器添乱。这一节的收获是面对五花八门的反爬手段它的策略是先便宜后昂贵、逐级兜底而不是一味硬刚。✂ 别整本下载三个参数精准圈定你的章节整本下载固然爽但很多时候你只想要其中一部分——比如只想存前100章试读或者只想要某卷的内容。脚本为此留了后门在点击下载前按 F12 打开开发者工具在window下定义一个chapterFilter函数即可。这段代码解决的问题是只下载前100章function chapterFilter(chapter) { return chapter.chapterNumber 100; }想只下载第一卷换一行判断即可function chapterFilter(chapter) { return chapter.sectionNumber 1; }同样的思路也适用于保存格式。你可以在window.saveOptions里自定义章节标题样式、段落缩进、甚至 EPUB 里的空行处理。比如把章节名统一改成第N章 XXX的格式const saveOptions { getchapterName: (chapter) { if (chapter.chapterName) { return 第${chapter.chapterNumber.toString()}章 ${chapter.chapterName}; } return 第${chapter.chapterNumber.toString()}章; }, }; window.saveOptions saveOptions;如果你总是用同一套偏好还可以写一个小的用户脚本自动注入从此每次下载都自动套用无需重复设置。这一节的收获是下载范围、章节命名、排版样式都可以按你的习惯定制它不强迫你接受默认值。 不止下载为什么它想给作品上一道双保险聊到最后我想说说这个项目藏在代码背后的动机。它属于404 小说文库项目的一部分——这个项目的初衷很朴素在这个信息说消失就消失的时代那些质量上乘却不够热门、没有被任何网站转载的作品一旦原站删除就等于从互联网上彻底蒸发。所以除了本地下载只要你同意脚本还会尝试把当前书籍的详情页与目录页存档至互联网档案馆为作品再上一道时间保险。它搜集的信息IP、User-Agent、页面地址等都会在说明文档里如实告知把选择权完全交还给你。说白了这已经超越了下载工具的范畴。对普通读者它是通勤地铁上的离线书库对收藏爱好者它是个人数字图书馆的搬运工对研究者它是批量获取文本语料的助手。而对整个阅读生态而言它让每一本值得被记住的书都有机会被永远记住。下一步建议现在就装上脚本管理器克隆项目、构建脚本挑一本你最喜欢的连载试试。下载前记得尊重版权——只保存你已购买或有权阅读的内容。当书架里的书真正握在你自己手里时你会发现阅读这件事从此再也不必看服务器的脸色。【免费下载链接】novel-downloader一个可扩展的通用型小说下载器。项目地址: https://gitcode.com/gh_mirrors/no/novel-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表