Hadoop下载,配置/启动以及操作(CentOS 8)
·
一、环境准备
在开始安装 Hadoop 之前,确保 CentOS 8 系统已完成以下配置:
- 更新系统:

- 关闭防火墙:

- 禁用 SELinux:
二、下载 Hadoop
访问 Apache Hadoop 官方网站,选择适合的版本进行下载,也可以使用以下命令下载 Hadoop 3.3.4 版本:
解压下载的安装包到/opt目录:
- 创建软链接方便访问:
三、配置 Hadoop
- 设置环境变量:编辑
~/.bashrc文件,添加以下内容:
- 创建 Hadoop 用户组和用户:
export HADOOP_HOME=/opt/hadoop export PATH=$PATH:$HADOOP_HOME/bin:$HADOOP_HOME/sbin export JAVA_HOME=/usr/lib/jvm/java-11-openjdk # 需提前安装JDK加载环境变量:
source ~/.bashrc配置Hadoop
-
修改
$HADOOP_HOME/etc/hadoop/hadoop-env.sh
设置JAVA_HOME路径:
核心配置文件(export JAVA_HOME=/usr/lib/jvm/java-11-openjdkcore-site.xml)
添加以下内容:<configuration> <property> <name>fs.defaultFS</name> <value>hdfs://localhost:9000</value> </property> </configuration>HDFS配置文件(
hdfs-site.xml)
配置副本数和数据存储路径:
<configuration> <property> <name>dfs.replication</name> <value>1</value> </property> <property> <name>dfs.namenode.name.dir</name> <value>/opt/hadoop_data/namenode</value> </property> <property> <name>dfs.datanode.data.dir</name> <value>/opt/hadoop_data/datanode</value> </property> </configuration>YARN配置(
yarn-site.xml)
<configuration> <property> <name>yarn.nodemanager.aux-services</name> <value>mapreduce_shuffle</value> </property> </configuration>MapReduce配置(
mapred-site.xml)
<configuration> <property> <name>mapreduce.framework.name</name> <value>yarn</value> </property> </configuration>启动Hadoop
-
格式化HDFS
首次启动需格式化NameNode:
启动HDFS和YARNhdfs namenode -formatstart-dfs.sh start-yarn.sh验证服务
检查进程是否运行:
jps预期输出包含:
NameNode、DataNode、ResourceManager、NodeManager。
基本操作示例
-
创建HDFS目录
上传文件到HDFShdfs dfs -mkdir /inputhdfs dfs -put /path/to/local/file /input运行MapReduce任务
使用Hadoop自带的WordCount示例:
hadoop jar $HADOOP_HOME/share/hadoop/mapreduce/hadoop-mapreduce-examples-3.3.6.jar wordcount /input /output查看结果
hdfs dfs -cat /output/*注意事项
- 确保SSH免密登录已配置(
ssh localhost测试)。 - 防火墙需开放端口(9870、8088等)。
- 存储路径需提前创建并赋予权限:
mkdir -p /opt/hadoop_data/{namenode,datanode} chown -R $USER:$USER /opt/hadoop_data
更多推荐


所有评论(0)