最新文章列表

通过commons.httpclient 自动识别网页编码

    在自动化抓取网站的时候,最讨厌的就是不同的网站有多种不同的编码,在解码时会发生错误,commons.httpclient比Httpclient要弱一些,于是自已动手写了一个对网页编码的自动识别,使用了htmlparser. 主函数 readWebHtml private String readWebHtml(String url) { String webHtml = &qu ...
heweiya 评论(0) 有2886人浏览 2012-05-29 16:43

最近博客热门TAG

Java(141747) C(73651) C++(68608) SQL(64571) C#(59609) XML(59133) HTML(59043) JavaScript(54918) .net(54785) Web(54513) 工作(54116) Linux(50906) Oracle(49876) 应用服务器(43288) Spring(40812) 编程(39454) Windows(39381) JSP(37542) MySQL(37268) 数据结构(36423)

博客人气排行榜

    博客电子书下载排行

      >>浏览更多下载

      相关资讯

      相关讨论

      Global site tag (gtag.js) - Google Analytics