栏目分类:
子分类:
返回
名师互学网用户登录
快速导航关闭
当前搜索
当前分类
子分类
实用工具
热门搜索
名师互学网 > IT > 前沿技术 > 大数据 > 大数据系统

hadoop安装配置(hadoop的安装与配置详细过程)

hadoop安装配置(hadoop的安装与配置详细过程)

文章目录

一、集群配置

1、集群部署规划2、配置文件分类

默认配置文件自定义配置文件 3、配置集群

3.1 core-site.xml 核心配置文件3.2 hdfs-site.xml hdfs配置文件3.3 yarn-site.xml yarn配置文件3.4 mapred-site.xml mapreduce配置文件3.5 配置worker3.6 启动

一、集群配置 1、集群部署规划

NameNode、SecondaryNameNode、ResourceManager不要安装在同一台服务器,很消耗内存;

node1node2node3
HDFSNameNode、DataNodeDataNodeSecondaryNameNode、DataNode
YARNNodeManagerResourceManager、NodeManagerNodeManager
2、配置文件分类

默认配置文件和自定义配置文件,只有用户想修改某一默认配置值时,才需要修改自定义配置文件,更改相应属性值;

默认配置文件
要获取的默认文件文件存放在Hadoop的jar包中的位置
core-default.xmlhadoop-common-3.1.3.jar/core-default.xml
hdfs-default.xmlhadoop-hdfs-3.1.3.jar/hdfs-default.xml
yarn-default.xmlhadoop-yarn-common-3.1.3.jar/yarn-default.xml
mapred-default.xmlhadoop-mapreduce-client-core-3.1.3.jar/mapred-default.xml
自定义配置文件

core-site.xml、hdfs-site.xml、yarn-site.xml、mapred-site.xml四个配置文件存放在$HADOOP_HOME/etc/hadoop这个路径上,用户可以根据项目需求重新进行修改配置;

3、配置集群 3.1 core-site.xml 核心配置文件
/usr/local/hadoop-2.10.1/etc/hadoop





    
    
        fs.defaultFS
        hdfs://结点名称:端口号
    

    
    
        hadoop.tmp.dir
        /usr/local/hadoop-2.10.1/data
    

    
    
        hadoop.http.staticuser.user
        atguigu
    

3.2 hdfs-site.xml hdfs配置文件




	
	
        dfs.namenode.http-address
        namenode的结点名称:端口号
    
	
    
        dfs.namenode.secondary.http-address
        结点名称:端口号
    

3.3 yarn-site.xml yarn配置文件




    
    
        yarn.nodemanager.aux-services
        mapreduce_shuffle
    

    
    
        yarn.resourcemanager.hostname
        结点名称
    

    
    
        yarn.nodemanager.env-whitelist
        JAVA_HOME,HADOOP_COMMON_HOME,HADOOP_HDFS_HOME,HADOOP_CONF_DIR,CLASSPATH_PREPEND_DISTCACHE,HADOOP_YARN_HOME,HADOOP_MAPRED_HOME
    

3.4 mapred-site.xml mapreduce配置文件




	
    
        mapreduce.framework.name
        yarn
    

# 配置成功后分发配置文件:
xsync /usr/local/hadoop-2.10.1/etc/hadoop
3.5 配置worker
# 配置worker
/usr/local/hadoop-2.10.1/etc/hadoop/worker
# 主机名不能又空格,且不能有空行

3.6 启动

第一次启动

- 需要在格式化NameNode
【注意】:格式化NameNode,会产生新的集群id,导致NameNode和DataNode的集群id不一致,集群找不到已往数据。如果集群在运行过程中报错,需要新
格式化NameNode的话,一定要先停止namenode和datanode进程,并且要删除所有机器的data和logs目录,然后再进行格式化;

> hdfs namenode -format

# 启动hdfs
sbin/start-dfs.sh

# 在配置了ResourceManager的节点启动YARN
sbin/start-yarn.sh

# 查看hdfs的NameNode
http://node01:配置的端口号

# 查看YARN的ResourceManager
http://node02:配置的端口号
转载请注明:文章转载自 www.mshxw.com
本文地址:https://www.mshxw.com/it/771662.html
我们一直用心在做
关于我们 文章归档 网站地图 联系我们

版权所有 (c)2021-2022 MSHXW.COM

ICP备案号:晋ICP备2021003244-6号