[英]Automatic Failover not working in Hadoop
我正在嘗試構建3個節點的群集(2個Namenode(nn1,nn2)和1個datanode(dn1))。使用Namenode WEBUI,我可以看到nn1是活動的,而nn2是備用的。 但是,當我殺死活動nn1時,備用nn2不會活動。 請幫助我我做錯了什么或需要修改什么
nn1 / etc / hosts
127.0.0.1 localhost
192.168.10.153 nn1
192.168.10.154 dn1
192.168.10.155 nn2
nn2 / etc / hosts
127.0.0.1 localhost nn2
127.0.1.1 ubuntu
# The following lines are desirable for IPv6 capable hosts
::1 ip6-localhost ip6-loopback
fe00::0 ip6-localnet
ff00::0 ip6-mcastprefix
ff02::1 ip6-allnodes
ff02::2 ip6-allrouters
core-site.xml(nn1,nn2)
<configuration>
<property>
<name>fs.defaultFS</name>
<value>hdfs://192.168.10.153:8020</value>
</property>
<property>
<name>dfs.journalnode.edits.dir</name>
<value>/usr/local/hadoop/hdfs/data/jn</value>
</property>
<property>
<name>ha.zookeeper.quorum</name>
<value>192.168.10.153:2181,192.168.10.155:2181,192.168.10.154:2181</value>
</property>
</configuration>
HDFS-site.xml中(NN1,NN2,DN1)
<property>
<name>dfs.replication</name>
<value>1</value>
</property>
<property>
<name>dfs.permissions</name>
<value>false</value>
</property>
<property>
<name>dfs.nameservices</name>
<value>ha-cluster</value>
</property>
<property>
<name>dfs.ha.namenodes.ha-cluster</name>
<value>nn1,nn2</value>
</property>
<property>
<name>dfs.namenode.rpc-address.ha-cluster.nn1</name>
<value>192.168.10.153:9000</value>
</property>
<property>
<name>dfs.namenode.rpc-address.ha-cluster.nn2</name>
<value>192.168.10.155:9000</value>
</property>
<property>/usr/local/hadoop/hdfs/datanode</value>
<name>dfs.namenode.http-address.ha-cluster.nn1</name>
<value>192.168.10.153:50070</value>
</property>
<property>
<name>dfs.namenode.http-address.ha-cluster.nn2</name>
<value>192.168.10.155:50070</value>
</property>
<property>
<name>dfs.namenode.shared.edits.dir</name>
<value>qjournal://192.168.10.153:8485;192.168.10.155:8485;192.168.10.154:8485/ha-cluster</value>
</property>
<property>
<name>dfs.client.failover.proxy.provider.ha-cluster</name>
<value>org.apache.hadoop.hdfs.server.namenode.ha.ConfiguredFailoverProxyProvider</value>
</property>
<property>
<name>dfs.ha.automatic-failover.enabled</name>
<value>true</value>
</property>
<property>
<name>ha.zookeeper.quorum</name>
<value>192.168.10.153:2181,192.168.10.155:2181,192.168.10.154:2181</value>
</property>
<property>
<name>dfs.ha.fencing.methods</name>
<value>sshfence</value>
</property>
<property>
<name>dfs.ha.fencing.ssh.private-key-files</name>
<value>/home/ci/.ssh/id_rsa</value></property></configuration>
日志:(zkfc nn1,nn2)(namenode nn1,nn2)在停止nn1(活動節點)時https://pastebin.com/bWvfnanQ
您在HA群集的core-site.xml中 fs.defaultFS
<IP>:<port>
。 因此,當關閉活動的名稱節點時,它不知道重定向到哪里。
選擇名稱服務的邏輯名稱,例如“ mycluster”。
然后也更改hdfs-site.xml,即dfs.namenode.http-address.[nameservice ID].[name node ID]
-每個NameNode監聽的標准HTTP地址
就您而言,您必須付出
核心的site.xml
<property>
<name>fs.defaultFS</name>
<value>hdfs://myCluster</value>
</property>
HDFS-site.xml中
<property>
<name>dfs.namenode.rpc-address.myCluster.nn1</name>
<value>192.168.10.153:9000</value>
</property>
希望這會幫助你。
聲明:本站的技術帖子網頁,遵循CC BY-SA 4.0協議,如果您需要轉載,請注明本站網址或者原文地址。任何問題請咨詢:yoyou2525@163.com.