
FictionDown是一款互联网小说爬取工具,支持自动校对、多格式转换,解决章节缺失和章节顺序错乱的问题,内置了简单的广告过滤,事实上大多数需要手工删除!
小说站内搜索
命令行整理
修改站点匹配结构
每个输出格式略作整理
支持导出txt,以兼容大部分阅读器
支持导出markdown,可以用pandoc转换成epub,保留书本信息、卷结构、作者信息
内置简单的广告过滤(目前还不健全)
用Golang撰写,安装部署便捷,外部依靠只有PhantomJS
获得到书本信息,开始爬取每章内容,遇见vip章节放入Example中作为校对样本
手工设置笔趣阁等盗版小说的对应链接,tamp字段
第三启动,开始爬取,只爬取VIP部分,并跟Example进行校对
手工编辑对应的缓存文件,手工删除广告和某些随机字符
d -f md生成markwown
用pandoc转换成epub,pandoc -o xxxx.epub xxxx.md
爬取起点的时候带上Cookie,用于爬取已购买章节
支持刺猬猫(即“欢乐书客”)
支持直接输出epub,无需pandoc
支持小说站内搜索
多线程转换md
整理main包中的面条逻辑
整理命令行参数风格
在windows下,md转换到epub时有路径问题
健全广告过滤
简化用步骤
优化log输出
??
而不是目前的用\t和\nTAG标签:FictionDown(1)
转载请说明来源于当下软件园(https://www.gpsdan.com)
本文地址:https://www.gpsdan.com/soft/7258.html
郑重声明:文章来源于网络作为参考,本站仅用于分享不存储任何下载资源,如果网站中图片和文字侵犯了您的版权,请联系我们处理!邮箱3450399331@qq.com