最新文章列表

并行处理大文本文件

集算器可以方便地用并行方式处理大文本文件,下面通过一个例子来说明使用方法。 假设有个一千万条销售记录的文本文件sales.txt,其主要字段是SellerID(销售员)、OrderDate(订单日期)、Amount(订单金额),请计算每个销售员在近四年里的大订单总金额。其中,金额在2000以上的属于大订单。 要进行并行处理,首先要能对文件进行分段,集算器提供了游标数据对象cursor及其函数, ...
datamachine 评论(0) 有1430人浏览 2015-03-31 09:21

MapReduce: Simplified Data Processing on Large Clusters(摘要翻译)

摘要原文如下: MapReduce: Simplified Data Processing on Large Clusters MapReduce is a programming model and an associ- ated implementation for processing and generating large data sets. Users ...
cruiser_31 评论(0) 有1221人浏览 2012-05-31 00:49

最近博客热门TAG

Java(141741) C(73643) C++(68602) SQL(64557) C#(59604) XML(59131) HTML(59042) JavaScript(54916) .net(54782) Web(54511) 工作(54116) Linux(50906) Oracle(49861) 应用服务器(43285) Spring(40811) 编程(39452) Windows(39380) JSP(37540) MySQL(37266) 数据结构(36420)

博客人气排行榜

    博客电子书下载排行

      >>浏览更多下载

      相关资讯

      相关讨论

      Global site tag (gtag.js) - Google Analytics