之前博客中有讲怎么配置hadoop的HA,在工作中,我因要进行数据治理组件的探究,所以需要部署一个测试集群来测试一下数据治理相关组件的集成,可能是因为测试集群比生产环境的配置要低,所以遇到了之前没有遇到的问题,比如HA配置后,NN一直频繁切换
自动故障转移配置vim $HADOOP_HOME/etc/hadoop/hdfs-site.xml频繁切换问题解决dfs.ha.automatic-failover.enabled true ha.zookeeper.quorum hadoop01:2181,hadoop02:2181,hadoop03:2181
vim $HADOOP_HOME/etc/hadoop/core-site.xml频繁切换的原因ha.health-monitor.rpc-timeout.ms 120000
可能是集群配置较低,使用默认配置时,ZKFC的健康检查超时时长不足以支撑NN的正常启动,此时NN被ZKFC认为没有正常启动,因此会采用自动故障转移来启动另外一台NN,从而引起自动切换active NN
总结开发中所有东西都不是一成不变,需要我们仔细探究原因



