一个正文抽取的微服务,目前采用的算法是行块密度算法,大概测试了一下,可以抽取大部分的网页正文,但是效果还不是很理想,打算再用 Readability 再实现一遍。
项目用到了下面一下技术,感兴趣可以一起改进一下
1
kikyous 2015 年 11 月 9 日
微信的优化阅读不知道用什么做的,效果很棒
|
2
domty 2015 年 11 月 9 日
已 fork, 就当 spring-boot 学习教材了
|
4
zts1993 2015 年 11 月 9 日
看上去可以啊,回头看看
|