hadoop環境配置

轉自:http://blog.csdn.net/dr_guo/article/details/50975851

1.集羣規劃:

 主機名        IP                安裝的軟件                            運行的進程
drguo1  192.168.80.149 jdk、hadoop                         NameNode、DFSZKFailoverController(zkfc)、ResourceManager
drguo2 192.168.80.150  jdk、hadoop                         NameNode、DFSZKFailoverController(zkfc)、ResourceManager
drguo3  192.168.80.151  jdk、hadoop、zookeeper     DataNode、NodeManager、JournalNode、QuorumPeerMain
drguo4  192.168.80.152  jdk、hadoop、zookeeper     DataNode、NodeManager、JournalNode、QuorumPeerMain

drguo5 192.168.80.153  jdk、Hadoop、zookeeper     DataNode、NodeManager、JournalNode、QuorumPeerMain

排的好好的,顯示出來就亂了!!!

2.前期準備:

準備五臺機器,修改靜態IP、主機名、主機名與IP的映射,關閉防火牆,安裝JDK並配置環境變量(不會請看這http://blog.csdn.net/dr_guo/article/details/50886667),創建用戶:用戶組,SSH免密碼登錄SSH免密碼登錄(報錯請看這http://blog.csdn.net/dr_guo/article/details/50967442)。


注意:要把127.0.1.1那一行註釋掉,要不然會出現jps顯示有datanode,但網頁顯示live nodes爲0;


註釋之後就正常了,好像有人沒註釋也正常,我也不知道爲什麼0.0


3.搭建zookeeper集羣(drguo3/drguo4/drguo5)

見:ZooKeeper完全分佈式集羣搭建

4.正式開始搭建Hadoop HA集羣

去官網下最新的Hadoop(http://apache.opencas.org/hadoop/common/stable/),目前最新的是2.7.2,下載完之後把它放到/opt/Hadoop下

[plain] view plain copy
  1. guo@guo:~/下載$ mv ./hadoop-2.7.2.tar.gz /opt/Hadoop/  
  2. mv: 無法創建普通文件"/opt/Hadoop/hadoop-2.7.2.tar.gz": 權限不夠  
  3. guo@guo:~/下載$ su root   
  4. 密碼:   
  5. root@guo:/home/guo/下載# mv ./hadoop-2.7.2.tar.gz /opt/Hadoop/  
解壓
[plain] view plain copy
  1. guo@guo:/opt/Hadoop$ sudo tar -zxf hadoop-2.7.2.tar.gz   
  2. [sudo] guo 的密碼:  
解壓jdk的時候我用的是tar -zxvf,其中的v呢就是看一下解壓的過程,不想看你可以不寫。

修改opt目錄所有者(用戶:用戶組)直接把opt目錄的所有者/組換成了guo。具體情況在ZooKeeper完全分佈式集羣搭建說過。

[plain] view plain copy
  1. root@guo:/opt/Hadoop# chown -R guo:guo /opt  

設置環境變量

[plain] view plain copy
  1. guo@guo:/opt/Hadoop$ sudo gedit /etc/profile  
在最後加上(這樣設置在執行bin/sbin目錄下的腳本時就不用進入該目錄用了)
[plain] view plain copy
  1. #hadoop  
  2. export HADOOP_HOME=/opt/Hadoop/hadoop-2.7.2  
  3. export PATH=$PATH:$HADOOP_HOME/sbin  
  4. export PATH=$PATH:$HADOOP_HOME/bin  
然後更新配置
[plain] view plain copy
  1. guo@guo:/opt/Hadoop$ source /etc/profile  

修改/opt/Hadoop/hadoop-2.7.2/etc/hadoop下的hadoop-env.sh

[plain] view plain copy
  1. guo@guo:/opt/Hadoop$ cd hadoop-2.7.2  
  2. guo@guo:/opt/Hadoop/hadoop-2.7.2$ cd etc/hadoop/  
  3. guo@guo:/opt/Hadoop/hadoop-2.7.2/etc/hadoop$ sudo gedit ./hadoop-env.sh  
進入文件後
[plain] view plain copy
  1. export JAVA_HOME=${JAVA_HOME}#將這個改成JDK路徑,如下  
  2. export JAVA_HOME=/opt/Java/jdk1.8.0_73  
然後更新文件配置
[plain] view plain copy
  1. guo@guo:/opt/Hadoop/hadoop-2.7.2/etc/hadoop$ source ./hadoop-env.sh 
前面配置和單機模式一樣,我就直接複製了。
注意:漢語註釋是給你看的,複製粘貼的時候都刪了!!!
修改core-site.xml
[html] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. <configuration>  
  2. <!-- 指定hdfs的nameservice爲ns1 -->  
  3. <property>  
  4. <name>fs.defaultFS</name>  
  5. <value>hdfs://ns1/</value>  
  6. </property>  
  7. <!-- 指定hadoop臨時目錄 -->  
  8. <property>  
  9. <name>hadoop.tmp.dir</name>  
  10. <value>/opt/Hadoop/hadoop-2.7.2/tmp</value>  
  11. </property>  
  12. <!-- 指定zookeeper地址 -->  
  13. <property>  
  14. <name>ha.zookeeper.quorum</name>  
  15. <value>drguo3:2181,drguo4:2181,drguo5:2181</value>  
  16. </property>  
  17. </configuration>  
修改hdfs-site.xml
[html] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. <configuration>  
  2.     <!--指定hdfs的nameservice爲ns1,需要和core-site.xml中的保持一致 -->  
  3.     <property>  
  4.         <name>dfs.nameservices</name>  
  5.         <value>ns1</value>  
  6.     </property>  
  7.     <!-- ns1下面有兩個NameNode,分別是nn1,nn2 -->  
  8.     <property>  
  9.         <name>dfs.ha.namenodes.ns1</name>  
  10.         <value>nn1,nn2</value>  
  11.     </property>  
  12.     <!-- nn1的RPC通信地址 -->  
  13.     <property>  
  14.         <name>dfs.namenode.rpc-address.ns1.nn1</name>  
  15.         <value>drguo1:9000</value>  
  16.     </property>  
  17.     <!-- nn1的http通信地址 -->  
  18.     <property>  
  19.         <name>dfs.namenode.http-address.ns1.nn1</name>  
  20.         <value>drguo1:50070</value>  
  21.     </property>  
  22.     <!-- nn2的RPC通信地址 -->  
  23.     <property>  
  24.         <name>dfs.namenode.rpc-address.ns1.nn2</name>  
  25.         <value>drguo2:9000</value>  
  26.     </property>  
  27.     <!-- nn2的http通信地址 -->  
  28.     <property>  
  29.         <name>dfs.namenode.http-address.ns1.nn2</name>  
  30.         <value>drguo2:50070</value>  
  31.     </property>  
  32.     <!-- 指定NameNode的元數據在JournalNode上的存放位置 -->  
  33.     <property>  
  34.         <name>dfs.namenode.shared.edits.dir</name>  
  35.         <value>qjournal://drguo3:8485;drguo4:8485;drguo5:8485/ns1</value>  
  36.     </property>  
  37.     <!-- 指定JournalNode在本地磁盤存放數據的位置 -->  
  38.     <property>  
  39.         <name>dfs.journalnode.edits.dir</name>  
  40.         <value>/opt/Hadoop/hadoop-2.7.2/journaldata</value>  
  41.     </property>  
  42.     <!-- 開啓NameNode失敗自動切換 -->  
  43.     <property>  
  44.         <name>dfs.ha.automatic-failover.enabled</name>  
  45.         <value>true</value>  
  46.     </property>  
  47.     <!-- 配置失敗自動切換實現方式 -->  
  48.     <property>  
  49.         <name>dfs.client.failover.proxy.provider.ns1</name>  
  50.         <value>org.apache.hadoop.hdfs.server.namenode.ha.ConfiguredFailoverProxyProvider</value>  
  51.     </property>  
  52.     <!-- 配置隔離機制方法,多個機制用換行分割,即每個機制暫用一行-->  
  53.     <property>  
  54.         <name>dfs.ha.fencing.methods</name>  
  55.         <value>  
  56.             sshfence  
  57.             shell(/bin/true)  
  58.         </value>  
  59.     </property>  
  60.     <!-- 使用sshfence隔離機制時需要ssh免登陸 -->  
  61.     <property>  
  62.         <name>dfs.ha.fencing.ssh.private-key-files</name>  
  63.         <value>/home/guo/.ssh/id_rsa</value>  
  64.     </property>  
  65.     <!-- 配置sshfence隔離機制超時時間 -->  
  66.     <property>  
  67.         <name>dfs.ha.fencing.ssh.connect-timeout</name>  
  68.         <value>30000</value>  
  69.     </property>  
  70. </configuration>  
先將mapred-site.xml.template改名爲mapred-site.xml然後修改mapred-site.xml
[html] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. <configuration>  
  2.     <!-- 指定mr框架爲yarn方式 -->  
  3.     <property>  
  4.         <name>mapreduce.framework.name</name>  
  5.         <value>yarn</value>  
  6.     </property>  
  7. </configuration>  
修改yarn-site.xml
[html] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. <configuration>  
  2.     <!-- 開啓RM高可用 -->  
  3.     <property>  
  4.        <name>yarn.resourcemanager.ha.enabled</name>  
  5.        <value>true</value>  
  6.     </property>  
  7.     <!-- 指定RM的cluster id -->  
  8.     <property>  
  9.        <name>yarn.resourcemanager.cluster-id</name>  
  10.        <value>yrc</value>  
  11.     </property>  
  12.     <!-- 指定RM的名字 -->  
  13.     <property>  
  14.        <name>yarn.resourcemanager.ha.rm-ids</name>  
  15.        <value>rm1,rm2</value>  
  16.     </property>  
  17.     <!-- 分別指定RM的地址 -->  
  18.     <property>  
  19.        <name>yarn.resourcemanager.hostname.rm1</name>  
  20.        <value>drguo1</value>  
  21.     </property>  
  22.     <property>  
  23.        <name>yarn.resourcemanager.hostname.rm2</name>  
  24.        <value>drguo2</value>  
  25.     </property>  
  26.     <!-- 指定zk集羣地址 -->  
  27.     <property>  
  28.        <name>yarn.resourcemanager.zk-address</name>  
  29.        <value>drguo3:2181,drguo4:2181,drguo5:2181</value>  
  30.     </property>  
  31.     <property>  
  32.        <name>yarn.nodemanager.aux-services</name>  
  33.        <value>mapreduce_shuffle</value>  
  34.     </property>  
  35. </configuration>  
修改slaves
[html] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. drguo3  
  2. drguo4  
  3. drguo5  
把Hadoop整個目錄拷貝到drguo2/3/4/5,拷之前把share下doc刪了(文檔不用拷),這樣會快點。
5.啓動zookeeper集羣(分別在drguo3、drguo4、drguo5上啓動zookeeper)
[plain] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. guo@drguo3:~$ zkServer.sh start  
  2. ZooKeeper JMX enabled by default  
  3. Using config: /opt/zookeeper-3.4.8/bin/../conf/zoo.cfg  
  4. Starting zookeeper ... STARTED  
  5. guo@drguo3:~$ jps  
  6. 2005 Jps  
  7. 1994 QuorumPeerMain  
  8. guo@drguo3:~$ ssh drguo4  
  9. Welcome to Ubuntu 15.10 (GNU/Linux 4.2.0-16-generic x86_64)  
  10.   
  11.  * Documentation:  https://help.ubuntu.com/  
  12.   
  13. Last login: Fri Mar 25 14:04:43 2016 from 192.168.80.151  
  14. guo@drguo4:~$ zkServer.sh start  
  15. ZooKeeper JMX enabled by default  
  16. Using config: /opt/zookeeper-3.4.8/bin/../conf/zoo.cfg  
  17. Starting zookeeper ... STARTED  
  18. guo@drguo4:~$ jps  
  19. 1977 Jps  
  20. 1966 QuorumPeerMain  
  21. guo@drguo4:~$ exit  
  22. 註銷  
  23. Connection to drguo4 closed.  
  24. guo@drguo3:~$ ssh drguo5  
  25. Welcome to Ubuntu 15.10 (GNU/Linux 4.2.0-16-generic x86_64)  
  26.   
  27.  * Documentation:  https://help.ubuntu.com/  
  28.   
  29. Last login: Fri Mar 25 14:04:56 2016 from 192.168.80.151  
  30. guo@drguo5:~$ zkServer.sh start  
  31. ZooKeeper JMX enabled by default  
  32. Using config: /opt/zookeeper-3.4.8/bin/../conf/zoo.cfg  
  33. Starting zookeeper ... STARTED  
  34. guo@drguo5:~$ jps  
  35. 2041 Jps  
  36. 2030 QuorumPeerMain  
  37. guo@drguo5:~$ exit  
  38. 註銷  
  39. Connection to drguo5 closed.  
  40. guo@drguo3:~$ zkServer.sh status  
  41. ZooKeeper JMX enabled by default  
  42. Using config: /opt/zookeeper-3.4.8/bin/../conf/zoo.cfg  
  43. Mode: leader  
6.啓動journalnode(分別在drguo3、drguo4、drguo5上啓動journalnode)注意只有第一次需要這麼啓動,之後啓動hdfs會包含journalnode。
[plain] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. guo@drguo3:~$ hadoop-daemon.sh start journalnode  
  2. starting journalnode, logging to /opt/Hadoop/hadoop-2.7.2/logs/hadoop-guo-journalnode-drguo3.out  
  3. guo@drguo3:~$ jps  
  4. 2052 Jps  
  5. 2020 JournalNode  
  6. 1963 QuorumPeerMain  
  7. guo@drguo3:~$ ssh drguo4  
  8. Welcome to Ubuntu 15.10 (GNU/Linux 4.2.0-16-generic x86_64)  
  9.   
  10.  * Documentation:  https://help.ubuntu.com/  
  11.   
  12. Last login: Fri Mar 25 00:09:08 2016 from 192.168.80.149  
  13. guo@drguo4:~$ hadoop-daemon.sh start journalnode  
  14. starting journalnode, logging to /opt/Hadoop/hadoop-2.7.2/logs/hadoop-guo-journalnode-drguo4.out  
  15. guo@drguo4:~$ jps  
  16. 2103 Jps  
  17. 2071 JournalNode  
  18. 1928 QuorumPeerMain  
  19. guo@drguo4:~$ exit  
  20. 註銷  
  21. Connection to drguo4 closed.  
  22. guo@drguo3:~$ ssh drguo5  
  23. Welcome to Ubuntu 15.10 (GNU/Linux 4.2.0-16-generic x86_64)  
  24.   
  25.  * Documentation:  https://help.ubuntu.com/  
  26.   
  27. Last login: Thu Mar 24 23:52:17 2016 from 192.168.80.152  
  28. guo@drguo5:~$ hadoop-daemon.sh start journalnode  
  29. starting journalnode, logging to /opt/Hadoop/hadoop-2.7.2/logs/hadoop-guo-journalnode-drguo5.out  
  30. guo@drguo5:~$ jps  
  31. 2276 JournalNode  
  32. 2308 Jps  
  33. 1959 QuorumPeerMain  
  34. guo@drguo5:~$ exit  
  35. 註銷  
  36. Connection to drguo5 closed.  
在drguo4/5啓動時發現了問題,沒有journalnode,查看日誌發現是因爲漢語註釋造成的,drguo4/5全刪了問題解決。drguo4/5的拼音輸入法也不能用,我很蛋疼。。鏡像都是複製的,咋還變異了呢。
7.格式化HDFS(在drguo1上執行)
[plain] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. guo@drguo1:/opt$ hdfs namenode -format  
這回又出問題了,還是漢語註釋鬧得,drguo1/2/3也全刪了,問題解決。
注意:格式化之後需要把tmp目錄拷給drguo2(不然drguo2的namenode起不來)
[plain] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. guo@drguo1:/opt/Hadoop/hadoop-2.7.2$ scp -r tmp/ drguo2:/opt/Hadoop/hadoop-2.7.2/  
8.格式化ZKFC(在drguo1上執行)
[plain] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. guo@drguo1:/opt$ hdfs zkfc -formatZK  
9.啓動HDFS(在drguo1上執行)
[plain] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. guo@drguo1:/opt$ start-dfs.sh   
10.啓動YARN(在drguo1上執行)
[plain] view plain copy
 在CODE上查看代碼片派生到我的代碼片
  1. guo@drguo1:/opt$ start-yarn.sh   
PS:
1.drguo2的resourcemanager需要手動單獨啓動:
yarn-daemon.sh start resourcemanager
2.namenode、datanode也可以單獨啓動:
hadoop-daemon.sh start namenode
hadoop-daemon.sh start datanode
3.NN 由standby轉化成active
hdfs haadmin -transitionToActive nn1 --forcemanual
大功告成!!!
是不是和之前規劃的一樣0.0

發表評論
所有評論
還沒有人評論,想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.
相關文章