听说第一个版本还很弱智,原理是计算最大文本节点的方式来获取正文信息。(就这也好意思发布一个项目,难道欺负我朝无人吗?)
请大家前往 https://gitee.com/ld/HtmlSucker 吐槽!
Maven:[code]
String url = "https://www.oschina.net/news/92798/micro-match-1-0-1-released";
System.out.println(HtmlSucker.parse(url, 20000));
}[/code]来自:开源中国社区

