Liunx安装hadoop集群

2024-06-06 13:58
文章标签 liunx hadoop 集群 安装

本文主要是介绍Liunx安装hadoop集群,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

一、简介

Hadoop是一个开源框架,允许使用简单的编程模型在跨计算机集群的分布式环境中存储和处理大数据。它的设计是从单个服务器扩展到数千个机器,每个都提供本地计算和存储

官网:http://hadoop.apache.org

二、准备工作

1、准备三台服务器

10.0.7.62 woniu、10.0.7.63 woniu1、10.0.7.30 woniu2

2、部署NTP服务器进行时间同步(可忽略)

https://blog.csdn.net/u011374856/article/details/103307623

3、配置主机名跟IP地址映射

https://blog.csdn.net/u011374856/article/details/103310847

4、ssh免密码登录

https://blog.csdn.net/u011374856/article/details/103311150

5、安装JDK8(三台主机都安装)

https://blog.csdn.net/u011374856/article/details/103309826

三、Hadoop下载

下载地址:http://archive.cloudera.com/cdh5/cdh/5/hadoop-2.6.0-cdh5.15.1.tar.gz

注:其他大数据组件也可在 http://archive.cloudera.com/cdh5/cdh/5 版本库中找到

四、Hadoop安装

1、集群结构

 NameNodeSecondaryNameNodeDataNodeNodeManagerResourceManager
woniu  
woniu1 
woniu2   

2、解压压缩包

tar -zxvf hadoop-2.6.0-cdh5.15.1.tar.gz

3、创建以下目录

/home/data/hadoop/dfs/data/home/data/hadoop/dfs/name/home/data/hadoop/temp

4、配置环境变量 

#配置当前用户环境变量
vi ~/.bash_profile#在文件中添加如下命令,记得切换自己文件路径
export HADOOP_HOME=/home/app/hadoop-2.6.0-cdh5.15.1
export PATH=$HADOOP_HOME/bin:$PATH#立即生效
source ~/.bash_profile

5、进入hadoop配置文件目录

cd /home/app/hadoop-2.6.0-cdh5.15.1/etc/hadoop

6、配置hadoop命令环境变量

#编辑hadoop-env.sh
vi hadoop-env.sh#编辑yarn-env.sh
vi yarn-env.sh#编辑mapred-env.sh
vi mapred-env.sh#三个文件都添加JAVA_HOME
export JAVA_HOME=/home/app/jdk1.8.0_231

7、 编辑core-site.xml

#编辑core-site.xml
vi core-site.xml#在文件中添加如下命令
<configuration><!-- 指定HDFS中NameNode的地址 --><property><name>fs.defaultFS</name><value>hdfs://woniu:6001</value></property><!-- 指定hadoop运行时产生文件的存储目录 --><property><name>hadoop.tmp.dir</name><value>/home/data/hadoop/temp</value></property>
</configuration>

 

8、编辑hdfs-site.xml

#编辑hdfs-site.xml
vi hdfs-site.xml#在文件中添加如下命令
<configuration><!-- 设置dfs副本数 --><property><name>dfs.replication</name><value>3</value></property><!-- 设置secondname的端口 --><property><name>dfs.namenode.secondary.http-address</name><value>woniu1:6002</value></property><!-- name目录 --><property><name>dfs.namenode.name.dir</name><value>/home/data/hadoop/dfs/name</value></property><!-- data目录 --><property><name>dfs.namenode.data.dir</name><value>/home/data/hadoop/dfs/data</value></property>
</configuration>

9、编辑mapred-site.xml

#拷贝一份mapred-site.xml
cp mapred-site.xml.template mapred-site.xml#编辑mapred-site.xml
vi mapred-site.xml#在文件中添加如下命令
<configuration><!-- 指定mr运行在yarn上 --><property><name>mapreduce.framework.name</name><value>yarn</value></property>
</configuration>

 

10、编辑yarn-site.xml 

#编辑yarn-site.xml
vi yarn-site.xml#在文件中添加如下命令
<configuration><!-- reducer获取数据的方式 --><property><name>yarn.nodemanager.aux-services</name><value>mapreduce_shuffle</value></property><!-- 指定YARN的ResourceManager的地址 --><property><name>yarn.resourcemanager.hostname</name><value>woniu1</value></property><!-- 该节点上YARN可使用的物理内存总量,默认是8192(MB)--><!-- 注意,如果你的节点内存资源不够8GB,则需要调减小这个值 --><property><name>yarn.nodemanager.resource.memory-mb</name><value>6144</value></property><!-- 单个任务可申请最少内存,默认1024MB --><property><name>yarn.scheduler.minimum-allocation-mb</name><value>1024</value></property><!-- 单个任务可申请最大内存,默认8192MB --><property><name>yarn.scheduler.maximum-allocation-mb</name><value>6144</value></property>
</configuration>

11、编辑slaves

#编辑slaves
vi slaves#在文件中删除
删除localhost#在文件中添加如下
woniu
woniu1
woniu2

12、 复制hadoop文件夹到另一台主机,注意:在拷贝目录下(例如:/home/app/)执行

#复制到woniu1主机
scp -r hadoop-2.6.0-cdh5.15.1/ root@woniu1:/home/app/#复制到woniu2主机
scp -r hadoop-2.6.0-cdh5.15.1/ root@woniu2:/home/app/

 五、Hadoop启动

1、第一次启动需要格式化(注意:只有第一次需要

hadoop namenode -format

2、启动&停止hdfs

#启动hdfs
./start-dfs.sh#停止hdfs
./stop-dfs.sh

3、启动&停止yarn

注意:Namenode和ResourceManger,不是同一台机器,不能在NameNode上启动 yarn,应该在ResouceManager所在的机器上启动yarn

#启动yarn
./start-yarn.sh#停止yarn
./stop-yarn.sh

4、查看进程

jps

六、可视化平台

1、hdfs平台

http://10.0.7.62:50070

2、yarn平台

http://10.0.7.63:8088

七、部署成功 

 

这篇关于Liunx安装hadoop集群的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1036302

相关文章

ESP32 esp-idf esp-adf环境安装及.a库创建与编译

简介 ESP32 功能丰富的 Wi-Fi & 蓝牙 MCU, 适用于多样的物联网应用。使用freertos操作系统。 ESP-IDF 官方物联网开发框架。 ESP-ADF 官方音频开发框架。 文档参照 https://espressif-docs.readthedocs-hosted.com/projects/esp-adf/zh-cn/latest/get-started/index

Linux 安装、配置Tomcat 的HTTPS

Linux 安装 、配置Tomcat的HTTPS 安装Tomcat 这里选择的是 tomcat 10.X ,需要Java 11及更高版本 Binary Distributions ->Core->选择 tar.gz包 下载、上传到内网服务器 /opt 目录tar -xzf 解压将解压的根目录改名为 tomat-10 并移动到 /opt 下, 形成个人习惯的路径 /opt/tomcat-10

VMware9.0详细安装

双击VMware-workstation-full-9.0.0-812388.exe文件: 直接点Next; 这里,我选择了Typical(标准安装)。 因为服务器上只要C盘,所以我选择安装在C盘下的vmware文件夹下面,然后点击Next; 这里我把√取消了,每次启动不检查更新。然后Next; 点击Next; 创建快捷方式等,点击Next; 继续Cont

vcpkg安装opencv中的特殊问题记录(无法找到opencv_corexd.dll)

我是按照网上的vcpkg安装opencv方法进行的(比如这篇:从0开始在visual studio上安装opencv(超详细,针对小白)),但是中间出现了一些别人没有遇到的问题,虽然原因没有找到,但是本人给出一些暂时的解决办法: 问题1: 我在安装库命令行使用的是 .\vcpkg.exe install opencv 我的电脑是x64,vcpkg在这条命令后默认下载的也是opencv2:x6

【服务器运维】CentOS6 minimal 离线安装MySQL5.7

1.准备安装包(版本因人而异,所以下面的命令中版本省略,实际操作中用Tab自动补全就好了) cloog-ppl-0.15.7-1.2.el6.x86_64.rpmcpp-4.4.7-23.el6.x86_64.rpmgcc-4.4.7-23.el6.x86_64.rpmgcc-c++-4.4.7-23.el6.x86_64.rpmglibc-2.12-1.212.el6.x86_64.r

【服务器运维】CentOS7 minimal 离线安装 gcc perl vmware-tools

0. 本机在有网的情况下,下载CentOS镜像 https://www.centos.org/download/ 1. 取出rpm 有的情况可能不需要net-tools,但是如果出现跟ifconfig相关的错误,就把它安装上。另外如果不想升级内核版本的话,就找对应内核版本的rpm版本安装 perl-Time-Local-1.2300-2.el7.noarch.rpmperl-Tim

Windows/macOS/Linux 安装 Redis 和 Redis Desktop Manager 可视化工具

本文所有安装都在macOS High Sierra 10.13.4进行,Windows安装相对容易些,Linux安装与macOS类似,文中会做区分讲解 1. Redis安装 1.下载Redis https://redis.io/download 把下载的源码更名为redis-4.0.9-source,我喜欢跟maven、Tomcat放在一起,就放到/Users/zhan/Documents

Ubuntu20.04离线安装Docker

1.下载3个docker离线安装包,下载网址: https://download.docker.com/linux/ubuntu/dists/xenial/pool/stable/amd64/ 2.把3个离线安装包拷贝到ubuntu本地执行以下命令 sudo dpkg -i containerd.io_1.4.6-1_amd64.deb sudo dpkg -i docker-ce-c

Windows中,.net framework 3.5安装

安装.net framework,目前已知2种方法,如下: 一、在MSDN下载对应的安装包,安装,这种可能无法安装成功,概率很大,不成功使用第二种方法,基本上没问题。 二、win8/8.1/10 下安装 .net framework 3.5.1: 1. 打开 win8/8.1/10 安装盘(这里指系统安装镜像文件),提取 sources\sxs 文件夹到 X:\sources\sxs (X代

MySQL理解-下载-安装

MySQL理解: mysql:是一种关系型数据库管理系统。 下载: 进入官网MySQLhttps://www.mysql.com/  找到download 滑动到最下方:有一个开源社区版的链接地址: 然后就下载完成了 安装: 双击: 一直next 一直next这一步: 一直next到这里: 等待加载完成: 一直下一步到这里