Hadoop 部署与启动教程
·
一、前期环境搭建
(一)JDK 安装与配置
要顺利运行 Hadoop,首先得安装 JDK,推荐选择 JDK 8 或者 11 版本。安装完成后,还需要配置 JAVA_HOME 环境变量。以 Linux 系统为例,可在 /etc/profile 文件(或者用户的 .bashrc 文件)中添加如下内容:
export JAVA_HOME=/实际的/jdk安装路径
export PATH=$JAVA_HOME/bin:$PATH
添加完成后,执行 source /etc/profile(或者 source ~/.bashrc)使配置生效。
(二)Hadoop 下载与解压
下载 Hadoop 二进制包,像 3.x 版本就很合适。下载完成后,将其解压到指定的目录,比如 /usr/local/hadoop,可使用以下命令:
tar -zxvf hadoop-<版本号>.tar.gz -C /usr/local/
mv /usr/local/hadoop-<版本号> /usr/local/hadoop
二、核心配置文件修改
进入 Hadoop 的配置目录(即 $HADOOP_HOME/etc/hadoop),对以下文件进行修改:
(一)hadoop-env.sh
该文件用于设置 Java 环境变量,在文件中添加(或修改):
export JAVA_HOME=/实际的/jdk路径
export HADOOP_HOME=/实际的/hadoop路径
(二)core-site.xml
此文件主要配置 HDFS 的默认地址以及临时目录,内容如下:
<configuration>
<property>
<name>fs.defaultFS</name>
<value>hdfs://localhost:9000</value>
</property>
<property>
<name>hadoop.tmp.dir</name>
<value>/实际的/tmp路径</value>
</property>
</configuration>
(三)hdfs-site.xml
该文件用于设置副本数和数据存储路径,配置如下:
<configuration>
<property>
<name>dfs.replication</name>
<value>1</value>
</property>
<property>
<name>dfs.namenode.name.dir</name>
<value>/实际的/namenode路径</value>
</property>
</configuration>
(四)mapred-site.xml
此文件用于配置 MapReduce 框架,内容为:
<configuration>
<property>
<name>mapreduce.framework.name</name>
<value>yarn</value>
</property>
</configuration>
(五)yarn-site.xml
该文件用于配置 YARN 资源管理器,配置如下:
<configuration>
<property>
<name>yarn.nodemanager.aux-services</name>
<value>mapreduce_shuffle</value>
</property>
</configuration>
三、Hadoop 初始化与启动
(一)格式化 HDFS(首次运行前执行)
执行以下命令,对 HDFS 进行格式化:
hdfs namenode -format
(二)启动 HDFS
使用以下命令启动 HDFS 相关服务:
hdfs namenode -format
(三)启动 YARN
执行如下命令启动 YARN 相关服务:
start-yarn.sh
(四)验证服务
- 检查进程:使用
jps命令,应该能看到NameNode、DataNode、ResourceManager等进程。 - 访问 Web UI:
- HDFS:
http://localhost:9870 - YARN:
http://localhost:8088
- HDFS:
四、服务关闭
stop-yarn.sh
stop-dfs.sh
更多推荐


所有评论(0)