红联Linux门户
Linux帮助

HTML文档解析器 NekoHTML

发布时间:2013-09-30 09:16:44来源:红联作者:empast
NekoHTML是一个Java语言的 HTML扫描器和标签补全器(tag balancer) ,使得程序能解析HTML文档并用标准的XML接口来访问其中的信息。这个解析器能够扫描HTML文件并“修正”许多作者(人或机器)在编写HTML文档 过程中常犯的错误。

NekoHTML能增补缺失的父元素、自动用结束标签关闭相应的元素,以及不匹配的内嵌元素标签。NekoHTML的开发使用了 Xerces Native Interface (XNI),后者是Xerces2的实现基础。

官方首页:http://sourceforge.net/projects/nekohtml/

免费下载:http://sourceforge.net/projects/nekohtml/files/

来自:开源中国社区
文章评论

共有 0 条评论