最新文章列表

hadoop 二次排序

  hadoop的工作流程: http://blackproof.iteye.com/blog/2028640   hadoop 二次排序 是在key中,排序value的实现,思路是 1.把value中需要有序的部分value-part放入key中 2.sortCompare类或key的CompareTo方法中完成对key+value-part的比较 3.GroupingComp ...
blackproof 评论(0) 有1748人浏览 2014-03-09 23:06

mapreduce的一些算法设计,优化等(2)

1. 反序(order inversion)模式         通过反序模式,我们可以控制中间结果进入reducer的顺序,从而在reducer中先计算出一些结果(根据先进入reducer的 ...
jimmee 评论(0) 有1583人浏览 2014-01-28 15:50

MapReduce的排序和二次排序

  自己学习排序和二次排序的知识整理如下。 1.Hadoop的序列化格式介绍:Writable 2.Hadoop的key排序逻辑 3.全排序 4.如何自定义自己的Writable类型 5.如何实现二次排序 1.Hadoop的序列化格式介绍:Writable 要了解和编写MR实现排序必须要知道的第一个知识点就是Writable相关的接口和类,这些是HADOOP自己的序列化 ...
hugh.wangp 评论(1) 有17759人浏览 2012-04-20 10:38

最近博客热门TAG

Java(141741) C(73643) C++(68602) SQL(64557) C#(59604) XML(59131) HTML(59042) JavaScript(54916) .net(54782) Web(54511) 工作(54116) Linux(50906) Oracle(49861) 应用服务器(43285) Spring(40811) 编程(39452) Windows(39380) JSP(37540) MySQL(37266) 数据结构(36420)

博客人气排行榜

    博客电子书下载排行

      >>浏览更多下载

      相关资讯

      相关讨论

      Global site tag (gtag.js) - Google Analytics