配置 /启动Hadoop
·
好的,配置和启动 Hadoop 需要以下步骤:
一、前置条件
- 安装 Java:确保已安装 JDK 1.8 或更高版本,并设置
$JAVA_HOME环境变量。 - SSH 免密登录:确保主节点能通过 SSH 免密登录到所有节点(包括自身)。
- 主机名解析:在
/etc/hosts文件中配置所有节点的 IP 和主机名映射。
二、核心配置文件(位于 $HADOOP_HOME/etc/hadoop/)
core-site.xml(集群核心参数):<configuration> <property> <name>fs.defaultFS</name> <value>hdfs://主节点主机名:9000</value> <!-- 如 hdfs://master:9000 --> </property> </configuration>hdfs-site.xml(HDFS 配置):<configuration> <property> <name>dfs.replication</name> <value>3</value> <!-- 数据副本数 --> </property> <property> <name>dfs.namenode.name.dir</name> <value>file:///path/to/namenode/data</value> <!-- NameNode 元数据存储路径 --> </property> <property> <name>dfs.datanode.data.dir</name> <value>file:///path/to/datanode/data</value> <!-- DataNode 数据存储路径 --> </property> </configuration>mapred-site.xml(MapReduce 配置):<configuration> <property> <name>mapreduce.framework.name</name> <value>yarn</value> <!-- 使用 YARN 作为资源管理器 --> </property> </configuration>yarn-site.xml(YARN 配置):<configuration> <property> <name>yarn.resourcemanager.hostname</name> <value>主节点主机名</value> <!-- 如 master --> </property> <property> <name>yarn.nodemanager.aux-services</name> <value>mapreduce_shuffle</value> </property> </configuration>workers(从节点列表):worker1 worker2 worker3
三、启动 Hadoop
-
初始化 HDFS (仅在首次启动时执行):
hdfs namenode -format
⚠️ 注意:此操作会格式化 NameNode,清除所有 HDFS 数据!
-
启动 HDFS:
start-dfs.sh
-
启动 YARN:
start-yarn.sh -
验证进程:
- 主节点:应有
NameNode,ResourceManager进程。 - 从节点:应有
DataNode,NodeManager进程。
jps # 查看 Java 进程 - 主节点:应有
-
访问 Web UI:
- HDFS:
http://主节点IP:9870
- YARN:
http://主节点IP:8088
- HDFS:
四、停止 Hadoop
stop-yarn.sh
stop-dfs.sh
请根据您的集群实际情况修改主机名、路径和副本数等参数。
更多推荐


所有评论(0)