HadHoop分布式框架配置(二)

xiangxingchina

浏览: 532190 次
性别:
来自: 北京

最近访客更多访客>>

WoKo_Jb

lanmubai

forfelicity

linktoyl22

博主相关

博客

微博

相册

留言

关于我

文章分类

社区版块

存档分类

博客分类：

服务器集群与负载均衡

框架 Hadoop SSH Linux Debian

我们假定，你已经下载了Hadoop的一个版本，并解压完毕。

我们配置了两台服务器:

1.了让大家开发和研究的方便，现做了两台 Debian/Linux 服务器。hadoop-1: 192.168.60.41 hadoop-2: 192.168.60.42 没装图形界面，
只能通过 ssh 连入。 root:abc123 为了不互相干扰，大家用 root 进入后最好自建新的用户来做实现。
数据库集群研究，分布式应用研究， Linux 集群研究都可以使用的。
有什么需要，或需要新的服务器来做试验，可以跟我联系。
2.
/*
1.首先进入到HOME目录下将自己原来的用户和目录删除cd /home
2.删除用户deluser tuping.记得在两个服务器都要删除掉
3.然后LS，查看目录下所有的目录，然后删除rm -r tuping

*/
在linux 远程登录 155 转到 root 用户 mount -t smbfs -o user=jobcn,password=jobcn //192.168.61.155/share /mnt 然后 cd /mnt ls 就会看到所有目录

分布式计算开源框架Hadoop入门实践:
http://blog.csdn.net/cenwenchu79/archive/2008/08/29/2847529.aspx

Subject: 分布式应用框架 Hadoop 安装

> 假设现有两台装有 Debian/Linux 的电脑，它们分别命名为：
> hadoop-1.jobcn.com 简称 h1，IP为：192.168.80.101
> hadoop-2.jobcn.com 简称 h2，IP为：192.168.80.102
>
> 在 h1,h2上执行
>
/*
> #apt-get install sun-java6-jdk
> #apt-get install ssh
> #apt-get install rsync

> #nano /etc/hosts
> 增加两行：
> 192.168.80.101    hadoop-1.jobcn.com   h1
> 192.168.80.102    hadoop-2.jobcn.com   h2
>
*/
以上的注释代码都已经执行过了不用执行
3.
> #adduser hadoop
> 密码假设为：abc123
> #su hadoop--一定要记得切换用户
>
> 在 h1 上执行(在这注意在H2上只要建立一个用户就可以了)
> $cd ~
>mkdir .ssh 建立.SSH的目录
>cp hadoop-0.18.1.tar.gz /home/tuping将hadoop-0.18.1.tar.gz这个包考到自己目录的文件夹下
> $ssh-keygen -t dsa -P '' -f .ssh/id_dsa
> $cat .ssh/id_dsa.pub >> .ssh/authorized_keys
> $scp -r .ssh hadoop-2.jobcn.com:/home/tuping/
> $wget http://dev.xiaonei.com/apache-mirror/hadoop/core/hadoop-0.18.1/hadoop-0.18.1.tar.gz--no user--这句不用执行。
> $tar zxvf hadoop-0.18.1.tar.gz--将包解压
> $cd hadoop-0.18.1
>
> $nano conf/hadoop-env.sh--编辑hadoop-env.sh文件(ctrl + x保存退出)
> 增加一行： export JAVA_HOME=/usr/lib/jvm/java-6-sun
>
> $nano conf/slaves
> 修改为：
> hadoop-1.jobcn.com
> hadoop-2.jobcn.com
>
> $nano conf/hadoop-site.xml
> 修改如下：
<configuration>
<property>
    <name>fs.default.name</name>
    <value>hdfs://hadoop-1.jobcn.com:9000/</value>
</property>
<property>
    <name>mapred.job.tracker</name>
    <value>hadoop-1.jobcn.com:9001</value>
</property>
<property>
    <name>dfs.replication</name>
    <value>1</value>
</property>
<property>
    <name>hadoop.tmp.dir</name>
    <value>/home/tuping/tmp</value>
</property>
<property>
    <name>dfs.name.dir</name>
    <value>/home/tuping/dfs/name</value>
</property>
<property>
    <name>dfs.data.dir</name>
    <value>/home/tuping/dfs/data</value>
</property>
</configuration>

这些属性的有着如下的意思：

fs.default.name - 这是一个描述集群中NameNode结点的URI(包括协议、主机名称、端口号)，集群里面的每一台机器都需要知道NameNode的地址。 DataNode结点会先在NameNode上注册，这样它们的数据才可以被使用。独立的客户端程序通过这个URI跟DataNode交互，以取得文件的块列表。

dfs.data.dir - 这是DataNode结点被指定要存储数据的本地文件系统路径。DataNode结点上的这个路径没有必要完全相同，因为每台机器的环境很可能是不一样的。但如果每台机器上的这个路径都是统一配置的话，会使工作变得简单一些。默认的情况下，它的值是/temp, 这个路径只能用于测试的目的，因为，它很可能会丢失掉一些数据。所以，这个值最好还是被覆盖。

dfs.name.dir - 这是NameNode结点存储hadoop文件系统信息的本地系统路径。这个值只对NameNode有效，DataNode并不需要使用到它。上面对于/temp类型的警告，同样也适用于这里。在实际应用中，它最好被覆盖掉。

*/
>
> $scp -r ../hadoop-0.18.1 hadoop-2.jobcn.com:/home/tuping/--是链接服务器2。需要等待一段时间
> $bin/hadoop namenode -format---格式化一下我们刚刚配置的hadoop文件系统。
> $bin/start-all.sh--(或者)bin/start-dfs.sh(这只是启动两种不同的模式)

-----
> $bin/hadoop fs -put /initrd.img initrd.img
> $bin/hadoop fs -ls
>
> 查看运行情况：
> http://192.168.60.41:50070/
> http://192.168.60.41:50030/
>

----
退出：bin/stop-dfs.sh
必须位于BIN的目录才能执行stop-dfs.sh命令
> $bin/stop-all.sh

分享到：

java抓取天气预报数据 | HadHoop分布式框架简介(一)

2011-03-16 21:42
浏览 1181
评论(0)
分类:编程语言
查看更多

发表评论

您还没有登录,请您登录后再发表评论

相关推荐

Hadoop权威指南-Hadoop中文文档-第二版本: 这本书的中文版为中国的Hadoop学习者提供了便捷的语言环境，使其能更好地理解和掌握这一分布式计算框架。 Hadoop是Apache软件基金会开发的一个开源项目，其核心包括HDFS（Hadoop Distributed File System）和...

hadhoop开发学习: - **ZooKeeper**：是一个分布式的协调服务，用于维护配置信息、命名、提供分布式同步以及组服务等功能。它是Hadoop生态系统中的一个重要组件，确保了各个组件之间的协调一致。 - **Sqoop** 和 **Flume**：这两个工具...

基于hadoop的疾病信息统计平台.zip: 【描述】"人工智能-Hadoop"的结合，揭示了这个项目的核心在于通过Hadoop的分布式计算框架，实现对复杂医疗数据的人工智能处理。人工智能主要体现在对疾病模式的识别、预测和推荐系统等方面，这需要大量的数据支持...

Hadoop源代码分析（MapTask辅助类 I）: Hadoop作为一个分布式计算框架，其核心组件之一是MapReduce。MapReduce负责处理大规模数据集的并行运算任务，而MapTask作为MapReduce的核心组成部分之一，其设计与实现对于理解和优化Hadoop系统的性能至关重要。本文...

拟阵约束下最大化子模函数的模型及其算法的一种熵聚类方法.pdf: 拟阵约束下最大化子模函数的模型及其算法的一种熵聚类方法.pdf

电力市场领域中基于CVaR风险评估的省间交易商最优购电模型研究与实现: 内容概要：本文探讨了在两级电力市场环境中，针对省间交易商的最优购电模型的研究。文中提出了一个双层非线性优化模型，用于处理省内电力市场和省间电力交易的出清问题。该模型采用CVaR（条件风险价值）方法来评估和管理由新能源和负荷不确定性带来的风险。通过KKT条件和对偶理论，将复杂的双层非线性问题转化为更易求解的线性单层问题。此外，还通过实际案例验证了模型的有效性，展示了不同风险偏好设置对购电策略的影响。适合人群：从事电力系统规划、运营以及风险管理的专业人士，尤其是对电力市场机制感兴趣的学者和技术专家。使用场景及目标：适用于希望深入了解电力市场运作机制及其风险控制手段的研究人员和技术开发者。主要目标是为省间交易商提供一种科学有效的购电策略，以降低风险并提高经济效益。其他说明：文章不仅介绍了理论模型的构建过程，还包括具体的数学公式推导和Python代码示例，便于读者理解和实践。同时强调了模型在实际应用中存在的挑战，如数据精度等问题，并指出了未来改进的方向。

MATLAB/Simulink平台下四机两区系统风储联合调频技术及其高效仿真实现: 内容概要：本文探讨了在MATLAB/Simulink平台上针对四机两区系统的风储联合调频技术。首先介绍了四机两区系统作为经典的电力系统模型，在风电渗透率增加的情况下，传统一次调频方式面临挑战。接着阐述了风储联合调频技术的应用，通过引入虚拟惯性控制和下垂控制策略，提高了系统的频率稳定性。文章展示了具体的MATLAB/Simulink仿真模型，包括系统参数设置、控制算法实现以及仿真加速方法。最终结果显示，在风电渗透率为25%的情况下，通过风储联合调频，系统频率特性得到显著提升，仿真时间缩短至5秒以内。适合人群：从事电力系统研究、仿真建模的技术人员，特别是关注风电接入电网稳定性的研究人员。使用场景及目标：适用于希望深入了解风储联合调频机制及其仿真实现的研究人员和技术开发者。目标是掌握如何利用MATLAB/Simulink进行高效的电力系统仿真，尤其是针对含有高比例风电接入的复杂场景。其他说明：文中提供的具体参数配置和控制算法有助于读者快速搭建类似的仿真环境，并进行相关研究。同时强调了参考文献对于理论基础建立的重要性。

永磁同步电机无感控制：高频方波注入与滑膜观测器结合实现及其应用场景: 内容概要：本文介绍了永磁同步电机（PMSM）无感控制技术，特别是高频方波注入与滑膜观测器相结合的方法。首先解释了高频方波注入法的工作原理，即通过向电机注入高频方波电压信号，利用电机的凸极效应获取转子位置信息。接着讨论了滑膜观测器的作用，它能够根据电机的电压和电流估计转速和位置，具有较强的鲁棒性。两者结合可以提高无传感器控制系统的稳定性和精度。文中还提供了具体的Python、C语言和Matlab代码示例，展示了如何实现这两种技术。此外，简要提及了正弦波注入的相关论文资料，强调了其在不同工况下的优势。适合人群：从事电机控制系统设计的研发工程师和技术爱好者，尤其是对永磁同步电机无感控制感兴趣的读者。使用场景及目标：适用于需要减少传感器依赖、降低成本并提高系统可靠性的情况，如工业自动化设备、电动汽车等领域的电机控制。目标是掌握高频方波注入与滑膜观测器结合的具体实现方法，应用于实际工程项目中。其他说明：文中提到的高频方波注入和滑膜观测器的结合方式，不仅提高了系统的性能，还在某些特殊情况下表现出更好的适应性。同时，附带提供的代码片段有助于读者更好地理解和实践这一技术。

MATLAB中扩展卡尔曼滤波与双扩展卡尔曼滤波在电池参数辨识的应用: 内容概要：本文深入探讨了MATLAB中扩展卡尔曼滤波（EKF）和双扩展卡尔曼滤波（DEKF）在电池参数辨识中的应用。首先介绍了EKF的基本原理和代码实现，包括状态预测和更新步骤。接着讨论了DEKF的工作机制，即同时估计系统状态和参数，解决了参数和状态耦合估计的问题。文章还详细描述了电池参数辨识的具体应用场景，特别是针对电池管理系统中的荷电状态（SOC）估计。此外，提到了一些实用技巧，如雅可比矩阵的计算、参数初始值的选择、数据预处理方法等，并引用了几篇重要文献作为参考。适合人群：从事电池管理系统开发的研究人员和技术人员，尤其是对状态估计和参数辨识感兴趣的读者。使用场景及目标：适用于需要精确估计电池参数的实际项目，如电动汽车、储能系统等领域。目标是提高电池管理系统的性能，确保电池的安全性和可靠性。其他说明：文章强调了实际应用中的注意事项，如数据处理、参数选择和模型优化等方面的经验分享。同时提醒读者关注最新的研究成果和技术进展，以便更好地应用于实际工作中。

基于三菱FX3U PLC和威纶通触摸屏的分切机上下收放卷张力控制系统设计: 内容概要：本文详细介绍了在无电子凸轮功能情况下，利用三菱FX3U系列PLC和威纶通触摸屏实现分切机上下收放卷张力控制的方法。主要内容涵盖硬件连接、程序框架设计、张力检测与读取、PID控制逻辑以及触摸屏交互界面的设计。文中通过具体代码示例展示了如何初始化寄存器、读取张力传感器数据、计算张力偏差并实施PID控制，最终实现稳定的张力控制。此外，还讨论了卷径计算、速度同步控制等关键技术点，并提供了现场调试经验和优化建议。适合人群：从事自动化生产设备维护和技术支持的专业人士，尤其是熟悉PLC编程和触摸屏应用的技术人员。使用场景及目标：适用于需要对分切机进行升级改造的企业，旨在提高分切机的张力控制精度，确保材料切割质量，降低生产成本。通过本方案可以实现±3%的张力控制精度，满足基本生产需求。其他说明：本文不仅提供详细的程序代码和硬件配置指南，还分享了许多实用的调试技巧和经验，帮助技术人员更好地理解和应用相关技术。

基于S7系列PLC与组态王的三泵变频恒压供水系统设计与实现: 内容概要：本文详细介绍了一种基于西门子S7-200和S7-300 PLC以及组态王软件的三泵变频恒压供水系统。主要内容涵盖IO分配、接线图原理图、梯形图程序编写和组态画面设计四个方面。通过合理的硬件配置和精确的编程逻辑，确保系统能够在不同负载情况下保持稳定的供水压力，同时实现节能和延长设备使用寿命的目标。适合人群：从事工业自动化领域的工程师和技术人员，尤其是熟悉PLC编程和组态软件使用的专业人士。使用场景及目标：适用于需要稳定供水的各种场合，如住宅小区、工厂等。目标是通过优化控制系统，提升供水效率，减少能源消耗，并确保系统的可靠性和安全性。其他说明：文中提供了详细的实例代码和调试技巧，帮助读者更好地理解和实施该项目。此外，还分享了一些实用的经验教训，有助于避免常见的错误和陷阱。

三相三线制SVG/STATCOM的Simulink仿真建模与控制策略解析: 内容概要：本文详细介绍了三相三线制静止无功发生器（SVG/STATCOM）在Simulink中的仿真模型设计与实现。主要内容涵盖ip-iq检测法用于无功功率检测、dq坐标系下的电流解耦控制、电压电流双闭环控制系统的设计、SVPWM调制技术的应用以及具体的仿真参数设置。文中不仅提供了理论背景，还展示了具体的Matlab代码片段，帮助读者理解各个控制环节的工作原理和技术细节。此外，文章还讨论了实际调试中遇到的问题及解决方案，强调了参数调整的重要性。适合人群：从事电力系统自动化、电力电子技术研究的专业人士，特别是对SVG/STATCOM仿真感兴趣的工程师和研究人员。使用场景及目标：适用于希望深入了解SVG/STATCOM工作原理并掌握其仿真方法的研究人员和工程师。目标是在实践中能够正确搭建和优化SVG/STATCOM的仿真模型，提高无功补偿的效果。其他说明：文章提供了丰富的实例代码和调试技巧，有助于读者更好地理解和应用所学知识。同时，文中提及的一些经验和注意事项来源于实际项目，具有较高的参考价值。

基于SIMULINK的风力机发电效率建模探究.pdf: 基于SIMULINK的风力机发电效率建模探究.pdf

CarSim与Simulink联合仿真：基于MPC模型预测控制实现智能超车换道: 内容概要：本文介绍了如何将CarSim的动力学模型与Simulink的智能算法相结合，利用模型预测控制(MPC)实现车辆的智能超车换道。主要内容包括MPC控制器的设计、路径规划算法、联合仿真的配置要点以及实际应用效果。文中提供了详细的代码片段和技术细节，如权重矩阵设置、路径跟踪目标函数、安全超车条件判断等。此外，还强调了仿真过程中需要注意的关键参数配置，如仿真步长、插值设置等，以确保系统的稳定性和准确性。适合人群：从事自动驾驶研究的技术人员、汽车工程领域的研究人员、对联合仿真感兴趣的开发者。使用场景及目标：适用于需要进行自动驾驶车辆行为模拟的研究机构和企业，旨在提高超车换道的安全性和效率，为自动驾驶技术研发提供理论支持和技术验证。其他说明：随包提供的案例文件已调好所有参数，可以直接导入并运行，帮助用户快速上手。文中提到的具体参数和配置方法对于初学者非常友好，能够显著降低入门门槛。

基于MATLAB的信号与系统实验：常见信号生成、卷积积分、频域分析及Z变换详解: 内容概要：本文详细介绍了利用MATLAB进行信号与系统实验的具体步骤和技术要点。首先讲解了常见信号（如方波、sinc函数、正弦波等）的生成方法及其注意事项，强调了时间轴设置和参数调整的重要性。接着探讨了卷积积分的两种实现方式——符号运算和数值积分，指出了各自的特点和应用场景，并特别提醒了数值卷积时的时间轴重构和步长修正问题。随后深入浅出地解释了频域分析的方法，包括傅里叶变换的符号计算和快速傅里叶变换（FFT），并给出了具体的代码实例和常见错误提示。最后阐述了离散时间信号与系统的Z变换分析，展示了如何通过Z变换将差分方程转化为传递函数以及如何绘制零极点图来评估系统的稳定性。适合人群：正在学习信号与系统课程的学生，尤其是需要完成相关实验任务的人群；对MATLAB有一定基础，希望通过实践加深对该领域理解的学习者。使用场景及目标：帮助学生掌握MATLAB环境下信号生成、卷积积分、频域分析和Z变换的基本技能；提高学生解决实际问题的能力，避免常见的编程陷阱；培养学生的动手能力和科学思维习惯。其他说明：文中不仅提供了详细的代码示例，还分享了许多实用的小技巧，如如何正确保存实验结果图、如何撰写高质量的实验报告等。同时，作者以幽默风趣的语言风格贯穿全文，使得原本枯燥的技术内容变得生动有趣。

【KUKA 机器人移动编程】：mo2_motion_ptp_en.ppt: KUKA机器人相关文档

永磁同步电机(PMSM)无传感器控制：I/F启动与滑模观测器结合的技术实现及应用: 内容概要：本文详细介绍了无传感器永磁同步电机（PMSM）控制技术，特别是针对低速和中高速的不同控制策略。低速阶段采用I/F控制，通过固定电流幅值和斜坡加速的方式启动电机，确保平稳启动。中高速阶段则引入滑模观测器进行反电动势估算，从而精确控制电机转速。文中还讨论了两者之间的平滑切换逻辑，强调了参数选择和调试技巧的重要性。此外，提供了具体的伪代码示例，帮助读者更好地理解和实现这一控制方案。适合人群：从事电机控制系统设计的研发工程师和技术爱好者。使用场景及目标：适用于需要降低成本并提高可靠性的应用场景，如家用电器、工业自动化设备等。主要目标是掌握无传感器PMSM控制的基本原理及其优化方法。其他说明：文中提到的实际案例和测试数据有助于加深理解，同时提醒开发者注意硬件参数准确性以及调试过程中可能出现的问题。

智能家居与物联网培训材料.ppt: 智能家居与物联网培训材料.ppt

Matlab实现车辆路径规划：基于TSP、CVRP、CDVRP、VRPTW的四大算法解析及应用: 内容概要：本文详细介绍了使用Matlab解决车辆路径规划问题的四种经典算法：TSP（旅行商问题）、CVRP（带容量约束的车辆路径问题）、CDVRP（带容量和距离双重约束的车辆路径问题）和VRPTW（带时间窗约束的车辆路径问题）。针对每个问题，文中提供了具体的算法实现思路和关键代码片段，如遗传算法用于TSP的基础求解，贪心算法和遗传算法结合用于CVRP的路径分割，以及带有惩罚函数的时间窗约束处理方法。此外，还讨论了性能优化技巧，如矩阵运算替代循环、锦标赛选择、2-opt局部优化等。适合人群：具有一定编程基础，尤其是对物流调度、路径规划感兴趣的开发者和技术爱好者。使用场景及目标：适用于物流配送系统的路径优化，旨在提高配送效率，降低成本。具体应用场景包括但不限于外卖配送、快递运输等。目标是帮助读者掌握如何利用Matlab实现高效的路径规划算法，解决实际业务中的复杂约束条件。其他说明：文中不仅提供了详细的代码实现，还分享了许多实践经验，如参数设置、数据预处理、异常检测等。建议读者在实践中不断尝试不同的算法组合和优化策略，以应对更加复杂的实际问题。

软考网络工程师2010-2014真题及答案: 软考网络工程师2010-2014真题及答案完整版全国计算机软考适合软考中级人群

最近访客 更多访客>>

博主相关

文章分类

社区版块

存档分类

最新评论