最新文章列表

一个基于XML的可配置的HTML数据解析工具

最近做一些抓取工作,从一个行业的网站上抓取想要的信息。由于各个网站的页面各不一样,一般的实现是为某一类特定的页面编写一个解析器。如果抓取的网站少还好点,但是当网站数量多时,这就是最笨的方法了。 所以抽了点时间实现了一个基于XML的可配置的解析工具。功能只要有: 支持正则表达式抽取数据 支持SPEL运算,需要spring的相关包 支持工具类的方法调用,对抽取数据进行后续处理 xml描述 ...
bjzhkuang 评论(0) 有1443人浏览 2012-04-13 00:12

最近博客热门TAG

Java(141747) C(73651) C++(68608) SQL(64571) C#(59609) XML(59133) HTML(59043) JavaScript(54918) .net(54785) Web(54513) 工作(54116) Linux(50906) Oracle(49876) 应用服务器(43288) Spring(40812) 编程(39454) Windows(39381) JSP(37542) MySQL(37268) 数据结构(36423)

博客人气排行榜

    博客电子书下载排行

      >>浏览更多下载

      相关资讯

      相关讨论

      Global site tag (gtag.js) - Google Analytics