要求: + 解析不规范的HTML。 + 速度要快。 + 可以使用XPath提取其中元素,或者配合其他组件可以做到这一点。 以上。Google返回一大堆结果。只验证过 http://htmlparser.sourceforge.net/ 不支持XPath。