Kuidas installida Hadoopi samm-sammult konfiguratsiooniga Linuxis Ubuntu
Selles รตpetuses juhendame teid samm-sammult Apache Hadoopi installimiseks Linuxi kasti (Ubuntu). See on 2 osaline protsess
On 2 Eeldused
- Sul peab olema Ubuntu paigaldatud ja jooksmine
- Sul peab olema Java Paigaldatud.
Osa 1) Laadige alla ja installige Hadoop
Step 1) Lisage Hadoopi sรผsteemi kasutaja, kasutades allolevat kรคsku
sudo addgroup hadoop_
sudo adduser --ingroup hadoop_ hduser_
Sisestage oma parool, nimi ja muud andmed.
MรRKUS: Selles seadistus- ja installiprotsessis vรตib tekkida allpool nimetatud tรตrge.
"hduser ei ole sudoersi failis. Sellest juhtumist teatatakse."
Selle vea saab lahendada juurkasutajana sisse logides
Kรคivitage kรคsk
sudo adduser hduser_ sudo
Re-login as hduser_
Step 2) Seadistage SSH
Klastris olevate sรตlmede haldamiseks vajab Hadoop juurdepรครคsu SSH-le
Esmalt vahetage kasutajat ja sisestage jรคrgmine kรคsk
su - hduser_
See kรคsk loob uue vรตtme.
ssh-keygen -t rsa -P ""
Lubage selle klahvi abil SSH-juurdepรครคs kohalikule masinale.
cat $HOME/.ssh/id_rsa.pub >> $HOME/.ssh/authorized_keys
Nรผรผd testige SSH seadistust, luues รผhenduse kohaliku hostiga kui "hduser" kasutaja.
ssh localhost
Mรคrge: Pange tรคhele, et kui nรคete allpool tรตrketeadet vastuseks 'ssh localhostile', siis on vรตimalik, et SSH pole selles sรผsteemis saadaval.
Selle lahendamiseks โ
Puhastage SSH, kasutades
sudo apt-get purge openssh-server
Hea tava on puhastada enne paigaldamise algust
Installige SSH, kasutades kรคsku-
sudo apt-get install openssh-server
Step 3) Jรคrgmine samm on Laadige alla Hadoop
Valige Stabiilne
Valige fail tar.gz (mitte src-ga fail)
Kui allalaadimine on lรตppenud, liikuge tar-faili sisaldavasse kataloogi
sisesta,
sudo tar xzf hadoop-2.2.0.tar.gz
Nรผรผd nimetage hadoop-2.2.0 รผmber hadoopiks
sudo mv hadoop-2.2.0 hadoop
sudo chown -R hduser_:hadoop_ hadoop
2. osa) Hadoopi konfigureerimine
Step 1) muutma ~ / .bashrc fail
Lisage faili lรตppu jรคrgmised read ~ / .bashrc
#Set HADOOP_HOME export HADOOP_HOME=<Installation Directory of Hadoop> #Set JAVA_HOME export JAVA_HOME=<Installation Directory of Java> # Add bin/ directory of Hadoop to PATH export PATH=$PATH:$HADOOP_HOME/bin
Nรผรผd hankige see keskkonna konfiguratsioon alloleva kรคsu abil
. ~/.bashrc
Step 2) HDFS-iga seotud konfiguratsioonid
komplekt JAVA_HOME faili sees $HADOOP_HOME/etc/hadoop/hadoop-env.sh
koos
Sees on kaks parameetrit $HADOOP_HOME/etc/hadoop/core-site.xml mis tuleb seadistada -
1. โhadoop.tmp.dirโ โ Kasutatakse kataloogi mรครคramiseks, mida Hadoop kasutab oma andmefailide salvestamiseks.
2. 'fs.default.name' โ See mรครคrab vaikefailisรผsteemi.
Nende parameetrite mรครคramiseks avage core-site.xml
sudo gedit $HADOOP_HOME/etc/hadoop/core-site.xml
Kopeerige allpool rida siltide vahele
<property> <name>hadoop.tmp.dir</name> <value>/app/hadoop/tmp</value> <description>Parent directory for other temporary directories.</description> </property> <property> <name>fs.defaultFS </name> <value>hdfs://localhost:54310</value> <description>The name of the default file system. </description> </property>
Liikuge kataloogi $HADOOP_HOME/etc/Hadoop
Nรผรผd looge failis core-site.xml mainitud kataloog
sudo mkdir -p <Path of Directory used in above setting>
Andke kataloogile รตigused
sudo chown -R hduser_:Hadoop_ <Path of Directory created in above step>
sudo chmod 750 <Path of Directory created in above step>
Step 3) Kaardi konfiguratsiooni vรคhendamine
Enne nende konfiguratsioonidega alustamist mรครคrake HADOOP_HOME tee
sudo gedit /etc/profile.d/hadoop.sh
Ja Sisestage
export HADOOP_HOME=/home/guru99/Downloads/Hadoop
Jรคrgmisena sisestage
sudo chmod +x /etc/profile.d/hadoop.sh
Vรคljuge terminalist ja taaskรคivitage uuesti
Tippige echo $HADOOP_HOME. Tee kontrollimiseks
Nรผรผd kopeerige failid
sudo cp $HADOOP_HOME/etc/hadoop/mapred-site.xml.template $HADOOP_HOME/etc/hadoop/mapred-site.xml
avage mapred-site.xml fail
sudo gedit $HADOOP_HOME/etc/hadoop/mapred-site.xml
Lisage mรคrgendite vahele allpool seadistusread ja
<property> <name>mapreduce.jobtracker.address</name> <value>localhost:54311</value> <description>MapReduce job tracker runs at this host and port. </description> </property>
avatud $HADOOP_HOME/etc/hadoop/hdfs-site.xml nagu allpool,
sudo gedit $HADOOP_HOME/etc/hadoop/hdfs-site.xml
Lisage mรคrgendite vahele allpool seadistusread ja
<property> <name>dfs.replication</name> <value>1</value> <description>Default block replication.</description> </property> <property> <name>dfs.datanode.data.dir</name> <value>/home/hduser_/hdfs</value> </property>
Looge รผlaltoodud seadistuses mรครคratud kataloog -
sudo mkdir -p <Path of Directory used in above setting>
sudo mkdir -p /home/hduser_/hdfs
sudo chown -R hduser_:hadoop_ <Path of Directory created in above step>
sudo chown -R hduser_:hadoop_ /home/hduser_/hdfs
sudo chmod 750 <Path of Directory created in above step>
sudo chmod 750 /home/hduser_/hdfs
Step 4) Enne Hadoopi esmakordset kรคivitamist vormindage HDFS alloleva kรคsu abil
$HADOOP_HOME/bin/hdfs namenode -format
Step 5) Kรคivitage Hadoopi รผhe sรตlme klaster, kasutades allolevat kรคsku
$HADOOP_HOME/sbin/start-dfs.sh
รlaltoodud kรคsu vรคljund
$HADOOP_HOME/sbin/start-yarn.sh
Kasutamine 'jps' tรถรถriist/kรคsk, kontrollige, kas kรตik Hadoopiga seotud protsessid tรถรถtavad vรตi mitte.
Kui Hadoop on edukalt kรคivitunud, peaks jps-i vรคljund nรคitama NameNode, NodeManager, ResourceManager, SecondaryNameNode, DataNode.
Step 6) Peatusping hadoop
$HADOOP_HOME/sbin/stop-dfs.sh
$HADOOP_HOME/sbin/stop-yarn.sh





























