Hadoop Job Tuning

nlslzf

浏览: 1058923 次
性别:
来自: 北京

最近访客更多访客>>

wangyy

u012363178

cwfmaker

windows9834

博主相关

博客

微博

相册

留言

关于我

文章分类

社区版块

存档分类

博客分类：

Hadoop生态圈(hadoop/hbase/pig/hive/zookeeper)

Hadoop NoSQL JVM Linux 云计算

Hadoop平台已经成为了大多数公司的分布式数据处理平台，随着数据规模的越来越大，对集群的压力也越来越大，集群的每个节点负担自然就会加重，而且集群内部的网络带宽有限，数据交换吞吐量也在面临考验，由此引发了人们对大规模数据处理进行优化的思考。

本文仅从实践经验出发，针对Hadoop Job优化提出了一些观点，不包含HDFS的优化。

Job Tracker Related

严格来说，下面这个配置项，是决定HDFS文件block数量的多少(也就是文件个数)，但是它会间接的影响Job Tracker的调度和内存的占用(其实更能影响name node内存的使用)。

dfs.block.size

这个配置项定义了在HDFS上每个block的大小，它的值是以字节为单位。可以在配置文件hadoop-site.xml(Hadoop 0.20 以前版本)定义，也可以在JobConf里定义

mapred.map.tasks.speculative.execution=true

mapred.reduce.tasks.speculative.execution=true

这两个是推测执行的配置项，当然如果你从来不关心这两个选项也没关系，它们默认值是true

所谓的推测执行，就是当所有task都开始运行之后，Job Tracker会统计所有任务的平均进度，如果某个task所在的task node机器配置比较低或者CPU load很高（原因很多），导致任务执行比总体任务的平均执行要慢，此时Job Tracker会启动一个新的任务（duplicate task），原有任务和新任务哪个先执行完就把另外一个kill掉，这也是我们经常在Job Tracker页面看到任务执行成功，但是总有些任务被kill，就是这个原因。

mapred.child.java.opts

一般来说，都是reduce耗费内存比较大，这个选项正是用来设置JVM堆的最大可用内存，但是也不要设置太大，如果超过2G，应该考虑从程序设计角度去优化。

Map Related

Input Split的大小，决定了一个Job拥有多少个map，默认64M每个Split，如果输入的数据量巨大，那么默认的64M的block会有几万甚至几十万的Map Task，集群的网络传输会很大，最严重的是给Job Tracker的调度、队列、内存都会带来很大压力。

mapred.min.split.size

这个配置项决定了每个 Input Split的最小值，也间接决定了一个Job的map 数目。

mapred.compress.map.output

压缩Map的输出应该作为一个习惯，这样做有两个好处：

a) 压缩是在内存中进行，所以写入map本地磁盘的数据就会变小，大大减少了本地IO次数

b) Reduce从每个map节点copy数据，也会明显降低网络传输的时间

补充：数据序列化其实效果会更好，无论是磁盘IO还是数据大小，都会明显的降低。

io.sort.mb

以MB为单位，默认100M，通常来看，这个值太小了

这个选项定义了map输出结果在内存占用buffer的大小，当buffer达到一定阈值，会启动一个后台线程来对buffer的内容进行排序，然后写入本地磁盘(一个spill文件)

在内存中的buffer如下图：(kvstart,kvend,kvindex为hadoop源码中操作buffer的变量)

根据map输出数据量的大小，可以适当的调整buffer的大小，注意是适当的调整，不是越大越好，假设内存无限大，io.sort.mb=1024(1G), 和io.sort.mb=300 (300M)，前者未必比后者快，因为1G的数据排序一次和排序3次，每次300MB，

一定是后者快（分而治之的思想）

io.sort.spill.percent

这个值就是上述buffer的阈值，默认是0.8，既80%，当buffer中的数据达到这个阈值，后台线程会起来对buffer中已有的数据进行排序，然后写入磁盘，此时map输出的数据继续往剩余的20% buffer写数据，如果buffer的剩余20%写满，排序还没结束，map task被block等待。

如果你确认map输出的数据基本有序（很少见），排序时间很短，可以将这个阈值适当调高，更理想的，如果你的map输出是有序的数据（基本不可能吧？），那么可以把buffer设的更大，阈值设置为1.

Io.sort.factor

同时打开的文件句柄的数量，默认是10

当一个map task执行完之后，本地磁盘上(mapred.local.dir)有若干个spill文件，map task最后做的一件事就是执行merge sort，把这些spill文件合成一个文件（partition），有时候我们会自定义partition函数，就是在这个时候被调用的。

执行merge sort的时候，每次同时打开多少个spill文件，就是由io.sort.factor决定的。打开的文件越多，不一定merge sort就越快，所以也要根据数据情况适当的调整。

补充：merge排序的结果是两个文件，一个是index，另一个是数据文件，index文件记录了每个不同的key在数据文件中的偏移量（这就是partition）

Reduce Related

提高Reduce的执行效率，除了在Hadoop框架方面的优化，重点还是在代码逻辑上的优化！比如：对Reduce接受到的value可能有重复的，此时如果用Java的Set或者STL的Set来达到去重的目的，那么这个程序不是扩展良好的(non-scalable)，受到数据量的限制，当数据膨胀，内存势必会溢出？

Io.sort.mb/io.sort.factor/ io.sort.spill.percent

其作用和Map阶段的作用一样，都是控制排序时使用内存的大小、句柄数量、阈值大小

mapred.reduce.parallel.copies

Reduce copy数据的线程数量，默认值是5

Reduce到每个完成的Map Task copy数据（通过RPC调用），默认同时启动5个线程到map节点取数据。这个配置还是很关键的，如果你的map输出数据很大，有时候会发现map早就100%了，reduce一直在1% 2%。。。。。。缓慢的变化，那就是copy数据太慢了，5个线程copy 10G的数据，确实会很慢，这时就要调整这个参数了，但是调整的太大，又会事半功倍，容易造成集群拥堵，所以 Job tuning的同时，也是个权衡的过程，你要熟悉你的数据！

mapred.job.shuffle.input.buffer.percent

当指定了JVM的堆内存最大值以后，上面这个配置项就是Reduce用来存放从Map节点取过来的数据所用的内存占堆内存的比例，默认是0.7，既70%，通常这个比例是够了，但是我们讨论的还是大数据的情况，所以这个比例还是小了一些，0.8-0.9之间比较合适。（前提是你的reduce函数不会疯狂的吃掉内存）

mapred.job.shuffle.merge.percent(默认值0.66)

mapred.inmem.merge.threshold(默认值1000)

这是两个阈值的配置项，第一个指的从Map节点取数据过来，放到内存，当达到这个阈值之后，后台启动线程（通常是Linux native process）把内存中的数据merge sort，写到reduce节点的本地磁盘；

第二个指的是从map节点取过来的文件个数，当达到这个个数之后，也进行merger sort，然后写到reduce节点的本地磁盘；这两个配置项第一个优先判断，其次才判断第二个thresh-hold。

从实际经验来看，mapred.job.shuffle.merge.percent默认值确实太小了，完全可以设置到0.8左右；第二个默认值1000，完全取决于map输出数据的大小，如果map输出的数据很大，默认值1000反倒不好，应该小一些，如果map输出的数据不大（light weight），可以设置2000或者以上，都没问题。

后记

大规模数据处理是云计算平台的挑战，涉及的技术难点很多：

并行优化

海量存储（HDFS存在诸多限制）【NoSQL】

大规模数据不仅仅是用来静态的处理，怎么样动起来？比如实时查询、实时更新、状态跟踪（数据的生命周期），目前开源社区的NoSQL技术还没有做到，或者很好的达到这些要求，这也是今后海量存储系统面临的技术难点。

分享到：

扩展CDT做自己的project wizard | 如何在不重启整个hadoop集群的情况下，增加 ...

2011-02-28 15:53
浏览 833
评论(0)
分类:企业架构
查看更多

发表评论

您还没有登录,请您登录后再发表评论

相关推荐

hadoop_the_definitive_guide_3nd_edition: Tuning a Job 176 Profiling Tasks 177 MapReduce Workflows 180 Decomposing a Problem into MapReduce Jobs 180 JobControl 182 Apache Oozie 182 6. How MapReduce Works . . . . . . . . . . . . . . . . . . . ...

Big Data Made Easy - A Working Guide To The Complete Hadoop Toolset: - **Schedulers**: Fair and Capacity schedulers in Hadoop for managing job priorities. - **Oozie**: A workflow scheduler for managing Hadoop jobs and complex workflows. The chapter includes detailed ...

hive调优总结文档-hive tuning ppt: 以下是对"Hive调优总结文档-hive tuning ppt"中可能涉及的多个知识点的详细阐述： 1. **元数据优化**： - **分区策略**：根据业务需求，合理设计分区字段，减少不必要的数据扫描，例如按日期、地区等进行分区。 -...

Tripple Farm:Match 3 Combination Game Complete Project 合成小镇三消Unity合成消除游戏项目游戏插件模版C#: Tripple Farm:Match 3 Combination Game Complete Project 合成小镇三消Unity合成消除游戏项目游戏插件模版C# 支持Unity2020.3.4或更高您知道像三合镇这样的著名益智游戏，并且您想制作一个自己的游戏。就是这样。这个包正好适合您。这是一个完整的项目，您可以在零分钟内将其上传到 appstore 或 googleplay 商店。基本规则： 3个或以上相同的道具可以匹配升级为新的道具。动物如果被困住，也可以合并。羽毛： -移动（android/ios）就绪。 - 包含所有源代码。 -超过 12 座建筑/军团需要升级。 -三种特殊物品可以提供帮助。 - 三个不同的主题（场景和动物） -unity iap 支持 -Unity UI -广告位已准备好 -包含详细文档

【JAVA编程基础】针对新手的JAVA基础测试题：涵盖选择题、简答与编程实践: 内容概要：本文档是一份针对Java初学者的基础测试题，分为不定项选择题、简答题和编程题三大部分。选择题涵盖标识符、数组初始化、面向对象概念、运算符优先级、循环结构、对象行为、变量命名规则、基本

MATLAB机器人运动学、动力学及轨迹规划的建模与仿真: 内容概要：本文详细介绍了如何利用MATLAB进行机器人运动学、动力学以及轨迹规划的建模与仿真。首先，通过具体的代码实例展示了正运动学和逆运动学的实现方法，包括使用DH参数建立机械臂模型、计算末端位姿以及求解关节角度。接着，讨论了雅克比矩阵的应用及其在速度控制中的重要性，并解释了如何检测和处理奇异位形。然后，深入探讨了动力学建模的方法，如使用拉格朗日方程和符号工具箱自动生成动力学方程。此外，还介绍了多种轨迹规划技术，包括抛物线插值和五次多项式插值，确保路径平滑性和可控性。最后，提供了常见仿真问题的解决方案，强调了在实际工程项目中需要注意的关键点。适合人群：对机器人控制感兴趣的初学者、希望深入了解机器人运动学和动力学的学生及研究人员、从事机器人开发的技术人员。使用场景及目标：① 学习如何使用MATLAB进行机器人运动学、动力学建模；② 掌握不同类型的轨迹规划方法及其应用场景；③ 解决仿真过程中遇到的各种问题，提高仿真的稳定性和准确性。其他说明：文中提供的代码片段可以直接用于实验和教学，帮助读者更好地理解和掌握相关概念和技术。同时，针对实际应用中的挑战提出了实用的建议，有助于提升项目的成功率。

基于单片机的无线环境监测-仿真设计(51x2+12864+18B20+HW).#0092: 包括：源程序工程文件、Proteus仿真工程文件、配套技术手册等 1、采用51/52单片机作为主控芯片； 2、发送机：18B20测温、开关模拟灯光，发送数据； 3、接收机：接受数据、12864液晶显示；

微电网优化中风光不确定性的处理：基于机会约束与概率序列的Matlab实现: 内容概要：本文探讨了在微电网优化中如何处理风光能源的不确定性，特别是通过引入机会约束和概率序列的方法。首先介绍了风光能源的随机性和波动性带来的挑战，然后详细解释了机会约束的概念，即在一定概率水平下放松约束条件，从而提高模型灵活性。接着讨论了概率序列的应用，它通过对历史数据分析生成多个可能的风光发电场景及其概率，以此为基础构建优化模型的目标函数和约束条件。文中提供了具体的Matlab代码示例，演示了如何利用CPLEX求解器解决此类优化问题，并强调了参数选择、模型构建、约束添加以及求解过程中应注意的技术细节。此外，还提到了一些实用技巧，如通过调整MIP gap提升求解效率，使用K-means聚类减少场景数量以降低计算复杂度等。适合人群：从事电力系统研究、微电网设计与运营的专业人士，尤其是那些对风光不确定性建模感兴趣的研究者和技术人员。使用场景及目标：适用于需要评估和优化含有大量间歇性可再生能源接入的微电网系统，旨在提高系统的经济性和稳定性，确保在面对风光出力波动时仍能维持正常运作。其他说明：文中提到的方法不仅有助于学术研究，也可应用于实际工程项目中，帮助工程师们制定更为稳健的微电网调度计划。同时，文中提供的代码片段可供读者参考并应用于类似的问题情境中。

linux之用户管理教程.md: linux之用户管理教程.md

基于组态王与S7-200 PLC的六层至八层电梯控制系统设计与实现: 内容概要：本文详细介绍了如何利用组态王和西门子S7-200 PLC构建六层或八层电梯控制系统。首先进行合理的IO地址分配，明确输入输出信号的功能及其对应的物理地址。接着深入解析了PLC源代码的关键部分，涵盖初始化、呼叫处理、电梯运行逻辑和平层处理等方面。此外，提供了组态王源代码用于实现动画仿真，展示了电梯轿厢的画面创建及动画连接方法。最后附上了详细的电气原理图和布局图，帮助理解和实施整个系统架构。适合人群：从事工业自动化控制领域的工程师和技术人员，尤其是对PLC编程和人机界面开发感兴趣的从业者。使用场景及目标：适用于教学培训、工程项目实践以及研究开发等场合。旨在为相关人员提供一个完整的电梯控制系统设计方案，便于他们掌握PLC编程技巧、熟悉组态软件的应用，并能够独立完成类似项目的开发。其他说明：文中不仅包含了理论知识讲解，还分享了许多实际操作经验，如解决编码器丢脉冲的问题、优化平层停车精度的方法等。同时强调了安全性和可靠性方面的考虑，例如设置了多重保护机制以确保系统稳定运行。

基于MTF的1D-2D-CNN-LSTM-Attention时序图像多模态融合的故障识别，适合研究学习（Matlab完整源码和数据）: 在工业生产和设备运行过程中，滚动轴承故障、变压器油气故障等领域的数据分类与故障诊断至关重要。准确的数据分类与故障诊断能够及时发现设备潜在问题，避免故障恶化导致的生产事故与经济损失。LSTM能够捕获时序信息，马尔可夫场（MTF）能够一维信号转换为二维特征图，并结合CNN学习空间特征，MTF-1D-2D-CNN-LSTM-Attention模型通过将一维时序信号和二维图像融合，融合不同模态优势，并引入多头自注意力机制提高泛化能力，为数据分类与故障诊断提供了新的思路。实验结果表明，该模型在分类准确率、鲁棒性和泛化能力方面具有显著优势。多模态融合算法凭借其创新点和实验验证的有效性，在滚动轴承故障、变压器油气故障等领域展现出广阔的应用前景，有望推动相关领域故障诊断技术的进一步发展。关键词：多模态融合；故障诊断；马尔可夫场；卷积神经网络；长短期记忆神经网络适用平台：Matlab2023版本及以上。实验硬件设备配置如下：选用高性能计算机，搭载i7处理器，以确保数据处理和模型训练的高效性；配备16GB的内存，满足大规模数据加载和模型运算过程中的内存需求；使用高性能显卡，提供强大的并行计算能力，加速深度学习模型的训练过程。实验参数的选择依据多方面因素确定。

【面试模拟系统AI提示词】基于简历和岗位要求的个性化模拟面试（deepseek,豆包,kimi,chatGPT,扣子空间,manus,AI训练师）: 内容概要：本文档提供了一个面试模拟的指导框架，旨在为用户提供一个真实的面试体验。文档中的面试官名为Elian，被设定为性格温和冷静且思路清晰的形象，其主要职责是根据用户提供的简历信息和应聘岗位要求，进行一对一的模拟面试。面试官将逐一提出问题，确保每次只提一个问题，并等待候选人的回答结束后再继续下一个问题。面试官需要深入了解应聘岗位的具体要求，包括但不限于业务理解、行业知识、具体技能、专业背景以及项目经历等方面，从而全面评估候选人是否符合岗位需求。此外，文档强调了面试官应在用户主动发起提问后才开始回答，若用户未提供简历，面试官应首先邀请用户提供简历或描述应聘岗位；适用人群：即将参加面试的求职者，特别是希望提前熟悉面试流程、提升面试技巧的人士；使用场景及目标：①帮助求职者熟悉面试流程，提高应对实际面试的信心；②通过模拟面试，让求职者能够更好地展示自己的优势，发现自身不足之处并加以改进；其他说明：此文档为文本格式，用户可以根据文档内容与面试官Elian进行互动，以达到最佳的模拟效果。在整个模拟过程中，用户应尽量真实地回答每一个问题，以便获得最贴近实际情况的反馈。

招聘技巧HR必看如何进行网络招聘和电话邀约.ppt: 招聘技巧HR必看如何进行网络招聘和电话邀约.ppt

三菱PLC与组态王构建3x3书架式堆垛立体库：IO分配、梯形图编程及组态画面设计: 内容概要：本文详细介绍了利用三菱PLC（特别是FX系列）和组态王软件构建3x3书架式堆垛式立体库的方法。首先阐述了IO分配的原则，明确了输入输出信号的功能，如仓位检测、堆垛机运动控制等。接着深入解析了梯形图编程的具体实现，包括基本的左右移动控制、复杂的自动寻址逻辑，以及确保安全性的限位保护措施。还展示了接线图和原理图的作用，强调了正确的电气连接方式。最后讲解了组态王的画面设计技巧，通过图形化界面实现对立体库的操作和监控。适用人群：从事自动化仓储系统设计、安装、调试的技术人员，尤其是熟悉三菱PLC和组态王的工程师。使用场景及目标：适用于需要提高仓库空间利用率的小型仓储环境，旨在帮助技术人员掌握从硬件选型、电路设计到软件编程的全流程技能，最终实现高效稳定的自动化仓储管理。其他说明：文中提供了多个实用的编程技巧和注意事项，如避免常见错误、优化性能参数等，有助于减少实际应用中的故障率并提升系统的可靠性。

COMSOL电弧放电模型：基于磁流体方程的多物理场耦合仿真及其应用: 内容概要：本文详细探讨了利用COMSOL进行电弧放电现象的模拟，重点在于采用磁流体方程(MHD)来耦合电磁、热流体和电路等多个物理场。文中介绍了关键的数学模型如磁流体动力学方程、热传导方程以及电路方程，并讨论了求解过程中遇到的技术难题，包括参数敏感性、求解器选择、网格划分等问题。此外，作者分享了许多实践经验，比如如何处理不同物理场之间的相互作用，怎样避免数值不稳定性和提高计算效率。适用人群：适用于从事电弧放电研究的专业人士，尤其是那些希望通过数值模拟深入了解电弧行为并应用于实际工程项目的人群。使用场景及目标：①帮助研究人员更好地理解和预测电弧放电过程中的各种物理现象；②为工程师提供优化电气设备设计的方法论支持；③指导使用者正确配置COMSOL软件的相关参数以确保高效稳定的仿真结果。其他说明：尽管存在较高的计算复杂度和技术挑战，成功的电弧放电仿真能够显著提升对这一重要物理过程的认识水平，并促进相关领域的技术创新和发展。

基于粒子群优化的KELM算法在多维输入单维输出数据处理中的应用与性能提升: 内容概要：本文详细介绍了如何利用粒子群优化算法（PSO）改进极限学习机（KELM），以提升其在多维输入单维输出数据处理任务中的性能。首先简述了KELM的工作原理及其快速训练的特点，接着深入探讨了PSO算法的机制，包括粒子的速度和位置更新规则。然后展示了如何将PSO应用于优化KELM的关键参数，如输入权值和隐含层偏置，并提供了具体的Python代码实现。通过对模拟数据和实际数据集的实验对比，证明了PSO优化后的KELM在预测精度上有显著提升，尤其是在处理复杂数据时表现出色。适合人群：对机器学习尤其是深度学习有一定了解的研究人员和技术爱好者，以及从事数据分析工作的专业人士。使用场景及目标：适用于需要高效处理多维输入单维输出数据的任务，如时间序列预测、回归分析等。主要目标是通过优化模型参数，提高预测准确性并减少人工调参的时间成本。其他说明：文中不仅给出了详细的理论解释，还附上了完整的代码示例，便于读者理解和实践。此外，还讨论了一些实用技巧，如参数选择、数据预处理等，有助于解决实际应用中的常见问题。

基于粒子群算法的微网优化调度Matlab程序设计与实现: 内容概要：本文介绍了利用粒子群算法（PSO）解决微网优化调度问题的方法。主要内容涵盖微网系统的组成（风力、光伏、储能、燃气轮机、柴油机）、需求响应机制、储能SOC约束处理及粒子群算法的具体实现。文中详细描述了目标函数的设计，包括发电成本、启停成本、需求响应惩罚项和SOC连续性惩罚项的计算方法。同时，阐述了粒子群算法的核心迭代逻辑及其参数调整策略，如惯性权重的线性递减策略。此外，还讨论了代码调试过程中遇到的问题及解决方案，并展示了仿真结果，证明了模型的有效性和优越性。适合人群：从事电力系统优化、智能算法应用的研究人员和技术人员，特别是对微网调度感兴趣的读者。使用场景及目标：适用于研究和开发微网优化调度系统，旨在提高供电稳定性的同时降低成本。具体应用场景包括但不限于分布式能源管理、工业园区能源调度等。目标是通过合理的调度策略，使微网系统在满足需求响应的前提下，实现经济效益最大化。其他说明：本文提供的Matlab程序具有良好的模块化设计，便于扩展和维护。建议读者在理解和掌握基本原理的基础上，结合实际情况进行改进和创新。

【KUKA 机器人资料】：典型机器人案例分析.pdf: KUKA机器人相关资料

基于多智能体的高层建筑分阶段火灾疏散仿真及策略研究.pdf: 基于多智能体的高层建筑分阶段火灾疏散仿真及策略研究.pdf

最近访客 更多访客>>

博主相关

文章分类

社区版块

存档分类

最新评论