环境准备
- 三个节点
hadoop102 192.168.110.12
hadoop103 192.168.110.13
hadoop104 192.168.110.14
注意:每个节点的基础环境都要先配置好,先把ip、hostname、fifirewalld、ssh免密码登录、JDK
这些基础环境配置好
安装Hadoop
解压
tar -zxvf hadoop-3.2.0.tar.gz -C /opt/module
修改相关配置
- 进入配置文件所在目录:hadoop-3.2.0/etc/hadoop/
修改hadoop-env.sh,在文件末尾增加环境变量
export JAVA_HOME=/opt/module/jdk1.8.0_212export HADOOP_LOG_DIR=/data/hadoop_repo/logs/hadoop
修改core-site.xml,注意fs.defaultFS属性中的主机名需要与主节点的主机名保持一致
<configuration><property><name>fs.defaultFS</name><value>hdfs://hadoop102:9000</value></property><property><name>hadoop.tmp.dir</name><value>/data/hadoop_repo</value></property></configuration>
修改hdfs-site.xml,hdfs文件副本数量设置为2,secondaryNameNode进场所在的节点信息
<configuration><property><name>dfs.replication</name><value>2</value></property><property><name>dfs.namenode.secondary.http-address</name><value>hadoop102:50090</value></property></configuration>
修改mapred-site.xml,设置mapreduce适用的资源调度框架
<configuration><property><name>mapreduce.framework.name</name><value>yarn</value></property></configuration>
修改yarn-site.xml,yarn上支持运行的服务和环境变量白名单
<configuration><property><name>yarn.nodemanager.aux-services</name><value>mapreduce_shuffle</value></property><property><name>yarn.nodemanager.env-whitelist</name><value>JAVA_HOME,HADOOP_COMMON_HOME,HADOOP_HDFS_HOME,HADOOP_CONF_DIR,CLASSPATH_PREPEND_DISTCACHE,HADOOP_YARN_HOME,HADOOP_MAPRED_HOME</value></property><property><name>yarn.resourcemanager.hostname</name><value>hadoop102</value></property></configuration>
修改从节点 ```bash vim workers
hadoop103 hadoop104
- 修改启动脚本修改 start-dfs.sh , stop-dfs.sh 这两个脚本文件,在文件前面增加如下内容```bashHDFS_DATANODE_USER=rootHDFS_DATANODE_SECURE_USER=hdfsHDFS_NAMENODE_USER=rootHDFS_SECONDARYNAMENODE_USER=root
修改 start-yarn.sh , stop-yarn.sh 这两个脚本文件,在文件前面增加如下内容
YARN_RESOURCEMANAGER_USER=root
HADOOP_SECURE_DN_USER=yarn
YARN_NODEMANAGER_USER=root
同步配置到其他子节点
scp -rq hadoop-3.2.0 hadoop103:/opt/module
scp -rq hadoop-3.2.0 hadoop104:/opt/module
格式化HDFS
./bin/hdfs namenode -format
启动集群
./sbin/start-all.sh
验证集群
jps查看启动节点进程
