Kako instalirati Hadoop na UbuntuKoraci za preuzimanje i postavljanje
โก Pametni saลพetak
Instaliranje Apache Hadoop-a na Ubuntu potrebna su dva prolaza: raspakiranje izdanja pod namjenskim sistemskim raฤunom s SSH-om bez lozinke, zatim ureฤivanje ฤetiri XML datoteke prije formatiranja HDFS-a i pokretanja klastera s jednim ฤvorom.
U ovom vodiฤu, provest ฤemo vas kroz korak-po-korak postupak instalacije Apache Hadoop-a na Linux raฤunalo (Ubuntu). Ovo je dvodjelni postupak: prvo preuzmite i instalirajte izdanje, a zatim ga konfigurirajte.
Postoje dva preduvjeta:
- Morate imati Ubuntu instaliran i trฤanje.
- Morate imati Java instaliran.
Napomene o verziji Hadoop 3.x za ovu postavku
Snimke zaslona u ovom vodiฤu snimljene su na Hadoopu 2.2.0. Slijed koraka nije se promijenio u trenutnim izdanjima, ali je nekoliko naziva i zadanih postavki premjeลกteno. Provjerite tablicu u nastavku prije doslovnog kopiranja bilo koje naredbe.
| Postavka ili korak | U ovom tutorijalu (Hadoop 2.x) | Trenutni Hadoop 3.x |
|---|---|---|
| Arhiva izdanja | hadoop-2.2.0.tar.gz |
hadoop-3.5.0.tar.gz, prvo stabilno izdanje 3.5, objavljeno 2. travnja 2026. |
| Zadano svojstvo datoteฤnog sustava | fs.default.name u prozi, fs.defaultFS u XML-u |
fs.defaultFS samo; fs.default.name je zastario |
| Svojstvo MapReduce | mapreduce.jobtracker.address |
mapreduce.framework.name postavljen na yarnPosaoTracker viลกe ne postoji nakon ลกto YARN zakaลพe rad |
| mapred-site.xml | Kopirano iz mapred-site.xml.template |
Brodovi ulaze etc/hadoop veฤ, tako da je korak kopiranja nepotreban |
| Port web korisniฤkog suฤelja NameNode | 50070 | 9870 |
| Java | Java 6 ili Java 7 | Java 8 ili Java 11 |
Sve ostalo u ovom vodiฤu ponaลกa se na isti naฤin na Hadoopu 3: namjenski raฤun, SSH kljuฤ, ฤetiri konfiguracijske datoteke te skripte za pokretanje i zaustavljanje.
Dio 1) Preuzmite i instalirajte Hadoop
Korak 1) Dodajte korisnika Hadoop sustava
Dodajte korisnika Hadoop sustava pomoฤu donje naredbe.
sudo addgroup hadoop_
sudo adduser --ingroup hadoop_ hduser_
Unesite svoju lozinku, ime i ostale podatke.
NAPOMENA: Postoji moguฤnost dolje navedene pogreลกke u ovom postupku postavljanja i instalacije.
โhduser nije u datoteci sudoers. Ovaj incident ฤe biti prijavljen.โ
Ovu greลกku moลพete rijeลกiti prijavom kao root korisnik.
Izvrลกite naredbu
sudo adduser hduser_ sudo
Re-login as hduser_
Korak 2) Konfigurirajte SSH
Za upravljanje ฤvorovima u klasteru, Hadoopu je potreban SSH pristup.
Prvo promijenite korisnika, unesite sljedeฤu naredbu
su - hduser_
Ova naredba ฤe stvoriti novi kljuฤ.
ssh-keygen -t rsa -P ""
Omoguฤite SSH pristup lokalnom raฤunalu pomoฤu ovog kljuฤa.
cat $HOME/.ssh/id_rsa.pub >> $HOME/.ssh/authorized_keys
Sada testirajte SSH postavke povezivanjem na localhost kao korisnik 'hduser_'.
ssh localhost
Biljeลกka: Ako vidite greลกku ispod kao odgovor na 'ssh localhost', tada postoji moguฤnost da SSH nije dostupan na ovom sustavu.
Da biste to rijeลกili โ
Oฤisti SSH pomoฤu,
sudo apt-get purge openssh-server
Dobra je praksa proฤistiti prije poฤetka instalacije.
Instalirajte SSH pomoฤu naredbe-
sudo apt-get install openssh-server
Korak 3) Preuzmite Hadoop
Sljedeฤi korak je preuzimanje Hadoop-a s Stranica s izdanjima Apache Hadoop-a.
Odaberite Stabilno
Odaberite datoteku tar.gz (ne datoteku koja zavrลกava na src).
Nakon ลกto je preuzimanje zavrลกeno, idite do direktorija koji sadrลพi tar datoteku.
Ulaz,
sudo tar xzf hadoop-2.2.0.tar.gz
Sada preimenujte hadoop-2.2.0 u hadoop.
sudo mv hadoop-2.2.0 hadoop
Na kraju, predajte mapu novom raฤunu.
sudo chown -R hduser_:hadoop_ hadoop
Zamijenite verziju koju ste zapravo preuzeli hadoop-2.2.0 u tri gore navedene naredbe.
Dio 2) Konfigurirajte Hadoop
Korak 1) Izmijenite datoteku ~/.bashrc
Dodajte sljedeฤe retke na kraj datoteke ~/.bashrc.
#Set HADOOP_HOME export HADOOP_HOME=<Installation Directory of Hadoop> #Set JAVA_HOME export JAVA_HOME=<Installation Directory of Java> # Add bin/ directory of Hadoop to PATH export PATH=$PATH:$HADOOP_HOME/bin
Sada, pronaฤite ovu konfiguraciju okruลพenja pomoฤu naredbe u nastavku.
. ~/.bashrc
Korak 2) Konfiguracije povezane s HDFS-om
Postavite JAVA_HOME unutar datoteke $HADOOP_HOME/etc/hadoop/hadoop-env.sh, prikazane dolje.
Kontakt
U $HADOOP_HOME/etc/hadoop/core-site.xml postoje dva parametra koja je potrebno postaviti -
1. 'hadoop.tmp.dir' โ Koristi se za odreฤivanje direktorija koji ฤe Hadoop koristiti za pohranu svojih podatkovnih datoteka.
2. 'fs.defaultFS' โ Ovo odreฤuje zadani datoteฤni sustav. Stariji naziv za isto svojstvo, 'fs.default.name', je zastario.
Za postavljanje ovih parametara otvorite core-site.xml
sudo gedit $HADOOP_HOME/etc/hadoop/core-site.xml
Kopirajte donje retke izmeฤu oznake.
<property> <name>hadoop.tmp.dir</name> <value>/app/hadoop/tmp</value> <description>Parent directory for other temporary directories.</description> </property> <property> <name>fs.defaultFS </name> <value>hdfs://localhost:54310</value> <description>The name of the default file system. </description> </property>
Idite do direktorija $HADOOP_HOME/etc/hadoop.
Sada stvorite direktorij naveden u core-site.xml.
sudo mkdir -p <Path of Directory used in above setting>
Dodijelite dozvole direktoriju.
sudo chown -R hduser_:Hadoop_ <Path of Directory created in above step>
sudo chmod 750 <Path of Directory created in above step>
Korak 3) Konfiguracija MapReducea
Prije nego ลกto zapoฤnemo s ovim konfiguracijama, postavimo putanju HADOOP_HOME.
sudo gedit /etc/profile.d/hadoop.sh
I Enter
export HADOOP_HOME=/home/guru99/Downloads/Hadoop
Zatim unesite
sudo chmod +x /etc/profile.d/hadoop.sh
Izaฤite iz Terminala i ponovno pokrenite.
Upiลกite echo $HADOOP_HOME za provjeru putanje.
Sada kopirajte datoteke
sudo cp $HADOOP_HOME/etc/hadoop/mapred-site.xml.template $HADOOP_HOME/etc/hadoop/mapred-site.xml
Otvorite datoteku mapred-site.xml
sudo gedit $HADOOP_HOME/etc/hadoop/mapred-site.xml
Dodajte postavke u nastavku izmeฤu i oznake.
<property> <name>mapreduce.jobtracker.address</name> <value>localhost:54311</value> <description>MapReduce job tracker runs at this host and port. </description> </property>
Otvorite $HADOOP_HOME/etc/hadoop/hdfs-site.xml kao ลกto je prikazano u nastavku,
sudo gedit $HADOOP_HOME/etc/hadoop/hdfs-site.xml
Dodajte postavke u nastavku izmeฤu i oznake.
<property> <name>dfs.replication</name> <value>1</value> <description>Default block replication.</description> </property> <property> <name>dfs.datanode.data.dir</name> <value>/home/hduser_/hdfs</value> </property>
Stvorite direktorij naveden u gornjoj postavci.
sudo mkdir -p <Path of Directory used in above setting>
sudo mkdir -p /home/hduser_/hdfs
Zatim dodijelite vlasniลกtvo i dozvole za njega.
sudo chown -R hduser_:hadoop_ <Path of Directory created in above step>
sudo chown -R hduser_:hadoop_ /home/hduser_/hdfs
sudo chmod 750 <Path of Directory created in above step>
sudo chmod 750 /home/hduser_/hdfs
Korak 4) Formatiranje HDFS-a
Prije nego ลกto prvi put pokrenemo Hadoop, formatirajte HDFS pomoฤu naredbe u nastavku.
$HADOOP_HOME/bin/hdfs namenode -format
Korak 5) Pokretanje Hadoop klastera s jednim ฤvorom
Pokrenite Hadoop klaster s jednim ฤvorom pomoฤu donje naredbe.
$HADOOP_HOME/sbin/start-dfs.sh
Izlaz gornje naredbe prikazan je u nastavku.
Zatim pokrenite YARN daemone.
$HADOOP_HOME/sbin/start-yarn.sh
Pomoฤu alata 'jps' provjerite jesu li pokrenuti svi procesi povezani s Hadoopom.
Ako je Hadoop uspjeลกno pokrenut, jps izlaz bi trebao navesti NameNode, NodeManager, ResourceManager, SecondaryNameNode i DataNode.
Korak 6) Zaustaviteping Hadoop
Iskljuฤite klaster obrnutim redoslijedom.
$HADOOP_HOME/sbin/stop-dfs.sh
$HADOOP_HOME/sbin/stop-yarn.sh
Kako provjeriti radi li Hadoop i ispraviti uobiฤajene pogreลกke
Izlaz jps-a potvrฤuje da su procesi pokrenuti, ali ne i da je klaster upotrebljiv. ฤetiri dodatne provjere rjeลกavaju to pitanje.
- Otvorite web suฤelje NameNode na
http://localhost:9870(port 50070 na Hadoopu 2.x) i potvrdite saลพetak izvjeลกฤa o jednom aktivnom ฤvoru. - Otvorite suฤelje ResourceManagera na
http://localhost:8088kako bi se potvrdilo da je YARN prihvatio NodeManager. - trฤanje
hdfs dfsadmin -reportza kapacitet, aktivne podatkovne ฤvorove i sve nedovoljno replicirane blokove. - Napiลกi neลกto:
hdfs dfs -mkdir /testnakon ฤega slijedihdfs dfs -ls /dokazuje da imenski prostor prihvaฤa promjene.
Veฤina neuspjeha u prvom pokuลกaju spada u jednu od pet kategorija.
| Simptom | Izazvati | Popraviti |
|---|---|---|
| JAVA_HOME nije postavljen i nije pronaฤen | Varijabla se izvozi u .bashrc, ali ne i u hadoop-env.sh | Takoฤer postavite apsolutnu JDK putanju unutar hadoop-env.sh |
| Dozvola odbijena (javni kljuฤ, lozinka) na ssh localhostu | authorized_keys nedostaje ili je previลกe permisivan | Ponovno dodajte id_rsa.pub, a zatim pokrenite chmod 600 na ~/.ssh/authorized_keys |
| Veza odbijena na portu 22 | openssh-server nije instaliran ili ne radi | Instalirajte openssh-server i pokrenite ssh servis |
| DataNode nedostaje iz jps-a nakon ponovnog formatiranja | Cluster Neusklaฤenost ID-a izmeฤu formatiranog NameNode-a i starog direktorija DataNode | Ispraznite mapu dfs.datanode.data.dir, a zatim je ponovno formatirajte |
| start-dfs.sh: naredba nije pronaฤena | HADOOP_HOME i PATH nikada nisu bili preuzeti u trenutnoj ljusci | Pokrenite . ~/.bashrc ili otvorite novi terminal |





























