想一口气存下上百本小说,靠手动点击网页逐一保存,既慢又可能触发网站反爬。真正高效的办法是组合使用开源工具和批量脚本,十到二十分钟就能完成从书源抓取到本地整理的全流程。这里给出一个经过验证的完整路径,以合法免费书源为核心,兼顾速度和稳定性。
首次准备工作需要安装Calibre,这是老牌电子书管理软件,免费开源,最新版6.x支持Windows、macOS和Linux。同时安装它的插件“FanFicFare”,该插件诞生于同人小说下载需求,后来扩展支持大量公开书源。打开Calibre的偏好设置,进入插件区域,从官方仓库获取FanFicFare,安装后重启。这个插件能识别书目列表页,批量解析每个条目的详情链接,并调用网站接口抓取正文和元数据。
更直接的批量下载方案是使用“kindle”开源的命令行工具,例如“KindleCount”或“kindlegen”,但这里推荐一个专门针对批量获取的Python脚本“mass-downloader”。在GitHub上搜索“novel_downloader”,有上千个相关项目,选星标超过500的即可。下载后安装依赖,修改配置文件中的书源地址、分类标签、语言过滤条件。比如要抓取某个文学网站“古典文学”分类下的所有小说,只需设置base_url为分类页,脚本会自动翻页并提取每本书的TXT或EPUB链接,支持并发请求,默认五个线程,实测在普通家用宽带上每分钟能下载三十到五十本。若网速稳定且网站无验证码,一小时可拖回两千本。
但要注意,多数现代小说网站设有反爬,直接批量抓取容易返回403或空内容。更稳妥的路径是走“书源聚合平台”,比如“Gutenberg”即古登堡计划,拥有超过七万本公版书,全部合法免费,且提供稳定的书籍ID和多种格式。将古登堡的“热门下载”列表页作为输入源,运行脚本读取前一百个ID,然后通过其API构造下载链接,单线程五秒内完成一本,百本耗时不足十分钟。如果想下载中文公版书,推荐“国学网”和“中华经典古籍库”,这两个源开放了全文检索,每本书对应一个唯一编号,用脚本批量提交编号即可。
除了抓取现成电子书,还可以利用RSS订阅创建批量下载任务。不少原创小说网站提供“作者RSS”或“标签RSS”,把十位作者的RSS链接放入一个opml文件,使用“Calibre”的内置新闻下载功能添加该文件,设置每天定时拉取最新章节。虽然是增量更新,但首次运作时同样能把历史章节全部打包,效果等同于一次性下载一个作者的全集。

流程中的关键点是去重和格式整理。下载百本之后,文件名可能混乱,用Calibre的“质量检查”插件一键查找重复ISBN和标题,再使用“转换批量”功能统一转为EPUB或AZW3。设定输出路径为“书名/[作者名]书名.epub”,确保目录结构干净。对于缺少封面的书,可通过Calibre的“获取元数据”按钮从亚马逊或豆瓣抓取封面、简介和标签,百本数量两分钟即可补齐。
最后强调安全边界。不要触碰仍受版权保护的国内网络小说站,这些网站几乎都禁止爬虫且用户协议明确不允许批量下载。合法的批量规模应以公版书、开放授权文本、作者自发布的无版权声明内容为限。例如“Planet eBook”提供一百多部经典小说的免费版图书,“Standard Ebooks”也提供超过八百本精心校对的公版书,这些源支持列表页直接批量获取,一本书的EPUB文件大小平均在0.5到3MB之间,下载一百本所需流量不足300MB,普通手机热点就能完成。
实操一次记住核心三步:选公版书源,运行批量脚本,导入Calibre整理。不要试图靠“一键工具”绕过付费墙,那既是违法犯罪,也无法保存完整且无乱码的文本。只要书源选对,一次性下载上百本小说只是一次普通的文件搬运工作。