俺的初步想法:
1,用个txt保存关注的小说的主页链接。
例如:http://club.book.sina.com.cn/yuanchuang/writing.php?wid=21359
2,过滤出有效的章节列表。
就是那些类似下面的链接。
http://club.book.sina.com.cn/yuanchuang/chapter.php?id=339061
然后和保存的列表比较,如果发现新链接就下载。
我现在遇到的问题是,发现我这样的做法对于网站本身的选择非常重要。
因为我现在就发现,sina的虽然容易抓取,但是更新慢,小说似乎也不多。
于是考虑,对于同一个小说,同时监控几个网站的更新情况。
但是又遇到问题,就是不同网站上面的同一个小说的章节划分,
可能是不一样的。
请教大家,这个有什么可行的处理方法?
1,用个txt保存关注的小说的主页链接。
例如:http://club.book.sina.com.cn/yuanchuang/writing.php?wid=21359
2,过滤出有效的章节列表。
就是那些类似下面的链接。
http://club.book.sina.com.cn/yuanchuang/chapter.php?id=339061
然后和保存的列表比较,如果发现新链接就下载。
我现在遇到的问题是,发现我这样的做法对于网站本身的选择非常重要。
因为我现在就发现,sina的虽然容易抓取,但是更新慢,小说似乎也不多。
于是考虑,对于同一个小说,同时监控几个网站的更新情况。
但是又遇到问题,就是不同网站上面的同一个小说的章节划分,
可能是不一样的。
请教大家,这个有什么可行的处理方法?
