最新文章列表

nutch1.2 index 详解

首先如果存在crawl/index ,crawl/indexes目录则删除 map:IndexerMapReduce      map输入目录为  所有的segment的crawl_fetch  crawl_parse parse_data parse_text , crawl/crawldb/current, crawl/linkdb/current      1 map的任务就是为了合并目 ...
chengqianl 评论(0) 有1893人浏览 2012-07-18 15:16

使用Lucene建立索引

最近在看Lucene in Action这本书的原著,第一步就是建立要建立文件索引,当然文件必须为统一的格式,Lucene不支持异构文件。 我练习了书中的listing 1.1:I ...
jkbjxy 评论(0) 有2776人浏览 2012-06-19 17:02

最近博客热门TAG

Java(141741) C(73643) C++(68602) SQL(64557) C#(59604) XML(59131) HTML(59042) JavaScript(54916) .net(54782) Web(54511) 工作(54116) Linux(50906) Oracle(49861) 应用服务器(43285) Spring(40811) 编程(39452) Windows(39380) JSP(37540) MySQL(37266) 数据结构(36420)

博客人气排行榜

    博客电子书下载排行

      >>浏览更多下载

      相关资讯

      相关讨论

      Global site tag (gtag.js) - Google Analytics