Top 60 pitanja i odgovora na Hadoop intervjuu (2026.)
Ovdje su Hadoop MapReduce pitanja za intervjue i odgovori za svjeลพije kao i iskusne kandidate da dobiju posao iz snova.
Pitanja za intervju za Hadoop MapReduce
1) ล to je Hadoop Map Reduce?
Za paralelnu obradu velikih skupova podataka u Hadoop klasteru koristi se okvir Hadoop MapReduce. Analiza podataka koristi mapu u dva koraka i proces smanjenja.
2) Kako radi Hadoop MapReduce?
U MapReduceu, tijekom faze karte, broji rijeฤi u svakom dokumentu, dok u fazi redukcije prikuplja podatke prema dokumentu koji obuhvaฤa cijelu zbirku. Tijekom faze mapiranja, ulazni podaci podijeljeni su u dijelove za analizu pomoฤu zadataka mapiranja koji se izvode paralelno u Hadoop okviru.
๐ Besplatno preuzimanje PDF-a: Hadoop & MapReduce Interview Questions & Answers
3) Objasnite ลกto je mijeลกanje u MapReduce?
Proces kojim sustav izvodi sortiranje i prenosi izlaze karte u reduktor kao ulaze poznat je kao mijeลกanje
4) Objasnite ลกto je distribuirana predmemorija u MapReduce Frameworku?
Distribuirana predmemorija vaลพna je znaฤajka koju pruลพa okvir MapReduce. Kada ลพelite podijeliti neke datoteke na svim ฤvorovima u Hadoopu Cluster, Koristi se distribuirana predmemorija. Datoteke mogu biti izvrลกne jar datoteke ili jednostavna datoteka svojstava.

5) Objasnite ลกto je NameNode u Hadoopu?
NameNode u Hadoopu je ฤvor u kojem Hadoop pohranjuje sve podatke o lokaciji datoteke HDFS (Hadoop distribuirani datoteฤni sustav)Drugim rijeฤima, NameNode je srediลกnji dio HDFS datoteฤnog sustava. ฤuva zapise svih datoteka u datoteฤnom sustavu i tracks datoteke podataka na cijelom klasteru ili viลกe raฤunala
6) Objasnite ลกto je JobTracker u Hadoopu? Koje radnje slijedi Hadoop?
In Hadoop za podnoลกenje i tracposlovi kralja MapReduce, PosaoTracker se koristi. Posao tracker se pokreฤe na vlastitom JVM procesu
Posao Tracker izvodi sljedeฤe radnje u Hadoopu
- Klijentska aplikacija ลกalje poslove na posao tracker
- PosaoTracker komunicira s naฤinom rada Name kako bi odredio lokaciju podataka
- Blizu podataka ili s dostupnim terminima za posaoTracker locira zadatakTracker ฤvorovi
- Na odabranom zadatkuTracker ฤvorovi, ลกalje rad
- Kad zadatak ne uspije, Job tracker obavjeลกtava i odluฤuje ลกto ฤe tada uฤiniti.
- ZadatakTracker ฤvorove nadzire JobTracker
7) Objasnite ลกto je otkucaj srca u HDFS-u?
Otkucaj srca se odnosi na signal koji se koristi izmeฤu podatkovnog ฤvora i ฤvora imena te izmeฤu ฤvora zadatka tracker i posao tracker, ako je ฤvor Name ili posao tracker ne reagira na signal, smatra se da postoje neki problemi s podatkovnim ฤvorom ili zadatkom tracker
8) Objasnite ลกto su kombinatori i kada biste trebali koristiti kombinator u MapReduce Jobu?
Za poveฤanje uฤinkovitosti Program MapReduce, Koriste se kombinatori. Koliฤina podataka moลพe se smanjiti uz pomoฤ kombinatora koji se trebaju prenijeti preko reduktora. Ako je izvedena operacija komutativna i asocijativna, svoj kod reduktora moลพete koristiti kao kombiniraฤ. Izvrลกenje combiner-a nije zajamฤeno u Hadoopu
9) ล to se dogaฤa kada podatkovni ฤvor zakaลพe?
Kada podatkovni ฤvor zakaลพe
- Posaotracker i namenode otkrivaju kvar
- Na neuspjeลกnom ฤvoru svi su zadaci ponovno rasporeฤeni
- Namenode replicira korisniฤke podatke na drugi ฤvor
10) Objasnite ลกto je ลกpekulativno izvrลกenje?
U Hadoopu tijekom spekulativnog izvrลกavanja pokreฤe se odreฤeni broj dupliciranih zadataka. Na drugom podreฤenom ฤvoru, viลกestruke kopije istog zadatka mapiranja ili smanjenja mogu se izvrลกiti pomoฤu Spekulativnog izvrลกenja. Jednostavnim rijeฤima, ako odreฤenom pogonu treba dugo da dovrลกi zadatak, Hadoop ฤe stvoriti duplikat zadatka na drugom disku. Disk koji prvi zavrลกi zadatak se zadrลพava, a diskovi koji ne zavrลกe prvi se uniลกtavaju.
11) Objasnite koji su osnovni parametri Mappera?
Osnovni parametri Mappera su
- Moguฤnost dugog pisanja i teksta
- Tekst i IntWritable
12) Objasnite koja je funkcija MapReduce particionera?
Funkcija MapReduce particionera je osigurati da sva vrijednost jednog kljuฤa ide u isti reduktor, ลกto na kraju pomaลพe ravnomjernoj distribuciji izlaza mape preko reduktora
13) Objasnite koja je razlika izmeฤu Input Split i HDFS bloka?
Logiฤka podjela podataka poznata je kao Split, dok je fiziฤka podjela podataka poznata kao HDFS blok
14) Objasnite ลกto se dogaฤa u formatu teksta?
U formatu unosa teksta, svaki redak u tekstualnoj datoteci je zapis. Vrijednost je sadrลพaj retka dok je kljuฤ pomak u bajtu retka. Na primjer, Kljuฤ: longWritable, Vrijednost: tekst
15) Navedite koji su glavni konfiguracijski parametri koje korisnik treba navesti da bi pokrenuo MapReduce Job?
Korisnik okvira MapReduce treba navesti
- Ulazne lokacije posla u distribuiranom datoteฤnom sustavu
- Izlazna lokacija posla u distribuiranom datoteฤnom sustavu
- Ulazni format
- Izlazni format
- Klasa koja sadrลพi funkciju karte
- Klasa koja sadrลพi funkciju reduciranja
- JAR datoteka koja sadrลพi klase mapera, reduktora i pogona
16) Objasnite ลกto je WebDAV u Hadoopu?
Za podrลกku ureฤivanja i aลพuriranja datoteka WebDAV je skup proลกirenja za HTTP. Na veฤini operativnih sustava WebDAV dijeljenja mogu se montirati kao datoteฤni sustavi, tako da je moguฤe pristupiti HDFS-u kao standardnom datoteฤnom sustavu izlaganjem HDFS-a preko WebDAV-a.
17) Objasnite ลกto je Sqoop u Hadoopu?
Za prijenos podataka izmeฤu Upravljanje relacijskom bazom podataka (RDBMS) i Hadoop HDFS koristi se alat poznat kao Sqoop. Koriลกtenjem Sqoopa podaci se mogu prenijeti iz RDMS-a poput MySQL or Oracle u HDFS kao i izvoz podataka iz HDFS datoteke u RDBMS
18) Objasnite kako je JobTracker zakazuje zadatak?
Zadatak tracker ลกalje Jobu poruke otkucaja srcatracker obiฤno svakih nekoliko minuta kako bi se uvjerio da JobTracker je aktivan i funkcionira. Poruka takoฤer obavjeลกtava JobaTracker o broju dostupnih mjesta, pa je PosaoTracker moลพe ostati u tijeku s ฤime se rad klastera moลพe delegirati
19) Objasnite ลกto je Sequencefileinputformat?
Sequencefileinputformat se koristi za ฤitanje datoteka u nizu. To je specifiฤni komprimirani binarni format datoteke koji je optimiziran za prijenos podataka izmeฤu izlaza jednog MapReduce posla na ulaz nekog drugog MapReduce posla.
20) Objasnite ลกto radi klasa conf.setMapper?
Conf.setMapperclass postavlja klasu mapera i sve stvari vezane uz posao mapiranja kao ลกto je ฤitanje podataka i generiranje para kljuฤ-vrijednost iz mapera
21) Objasnite ลกto je Hadoop?
To je softverski okvir otvorenog koda za pohranu podataka i pokretanje aplikacija na klasterima standardnog hardvera. Omoguฤuje ogromnu snagu obrade i veliku pohranu za sve vrste podataka.
22) Navedite koja je razlika izmeฤu RDBMS-a i Hadoopa?
| RDBMS | Hadoop |
|---|---|
| RDBMS je sustav za upravljanje relacijskim bazama podataka | Hadoop je ravna struktura temeljena na ฤvoru |
| Koristio se za OLTP obradu dok je Hadoop | Trenutno se koristi za analitiฤku i za BIG DATA obradu |
| U RDBMS-u, klaster baze podataka koristi iste podatkovne datoteke pohranjene u zajedniฤkoj pohrani | U Hadoopu se podaci za pohranu mogu pohraniti neovisno u svakom ฤvoru obrade. |
| Morate prethodno obraditi podatke prije pohranjivanja | ne morate prethodno obraditi podatke prije pohranjivanja |
23) Spominjete Hadoop osnovne komponente?
Hadoop osnovne komponente ukljuฤuju,
- HDFS
- MapReduce
24) ล to je NameNode u Hadoopu?
NameNode u Hadoopu je mjesto gdje Hadoop pohranjuje sve informacije o lokaciji datoteka u HDFS-u. To je glavni ฤvor na kojem se nalazi zadatak. tracker se pokreฤe i sastoji se od metapodataka.
25) Navedite koje su komponente podataka koje koristi Hadoop?
Komponente podataka koje koristi Hadoop su
26) Navedite koju komponentu za pohranu podataka koristi Hadoop?
Komponenta za pohranu podataka koju koristi Hadoop je HBase.
27) Navedite koji su najฤeลกฤi formati unosa definirani u Hadoopu?
Najฤeลกฤi ulazni formati definirani u Hadoopu su;
- TextInputFormat
- KeyValueInputFormat
- SequenceFileInputFormat
28) ล to je InputSplit u Hadoopu?
Dijeli ulazne datoteke u dijelove i svaku podjelu dodjeljuje kartografu za obradu.
29) Za Hadoop posao, kako ฤete napisati prilagoฤeni program particioniranja?
Napiลกete prilagoฤeni program za particioniranje za Hadoop posao, slijedite sljedeฤi put
- Stvorite novu klasu koja proลกiruje klasu Partitioner
- Nadjaฤaj metodu getPartition
- U omotu koji pokreฤe MapReduce
- Dodajte prilagoฤeni particionar u posao pomoฤu skupa metoda Partitioner Class ili โ dodajte prilagoฤeni particionar u posao kao konfiguracijsku datoteku
30) Za posao u Hadoopu, je li moguฤe promijeniti broj mappera koji ฤe se izraditi?
Ne, nije moguฤe promijeniti broj mappera koji ฤe se izraditi. Broj mapera odreฤen je brojem ulaznih podjela.
31) Objasnite ลกto je sekvencijska datoteka u Hadoopu?
Za pohranu binarnih parova kljuฤ/vrijednost koristi se sekvencijska datoteka. Za razliku od obiฤne komprimirane datoteke, sekvencijska datoteka podrลพava razdvajanje ฤak i kada su podaci unutar datoteke komprimirani.
32) ล to se dogaฤa s poslom kada Namenode ne radi? tracker?
Namenode je jedina toฤka kvara u HDFS-u, tako da kada Namenode ne radi, vaลก ฤe se klaster pokrenuti.
33) Objasnite kako se vrลกi indeksiranje u HDFS-u?
Hadoop ima jedinstven naฤin indeksiranja. Nakon ลกto su podaci pohranjeni prema veliฤini bloka, HDFS ฤe nastaviti pohranjivati โโposljednji dio podataka koji govori gdje ฤe biti sljedeฤi dio podataka.
34) Objasnite je li moguฤe traลพiti datoteke pomoฤu zamjenskih znakova?
Da, moguฤe je pretraลพivati โโdatoteke pomoฤu zamjenskih znakova.
35) Navedite Hadoopove tri konfiguracijske datoteke?
Tri konfiguracijske datoteke su
- core-site.xml
- mapred-site.xml
- hdfs-site.xml
36) Objasnite kako moลพete provjeriti radi li Namenode uz koriลกtenje jps naredbe?
Osim koriลกtenja jps naredbe, za provjeru radi li Namenode takoฤer moลพete koristiti
/etc/init.d/hadoop-0.20-namenode status.
37) Objasnite ลกto je "map", a ลกto "reducer" u Hadoopu?
U Hadoopu je mapa faza u rjeลกavanju HDFS upita. Karta ฤita podatke s ulazne lokacije i ispisuje par kljuฤeva vrijednosti prema vrsti unosa.
U Hadoopu reduktor prikuplja izlaz koji je generirao maper, obraฤuje ga i stvara vlastiti konaฤni izlaz.
38) U Hadoopu, koja datoteka kontrolira izvjeลกฤivanje u Hadoopu?
U Hadoopu, datoteka hadoop-metrics.properties kontrolira izvjeลกฤivanje.
39) Navedite mreลพne zahtjeve za koriลกtenje Hadoopa?
Za koriลกtenje Hadoopa popis mreลพnih zahtjeva je:
- SSH veza bez lozinke
- Secure Shell (SSH) za pokretanje posluลพiteljskih procesa
40) Navedite ลกto je rack awareness?
Svijest o stalku je naฤin na koji namenode odreฤuje kako postaviti blokove na temelju definicija stalka.
41) Objasnite ลกto je zadatak Tracker u Hadoopu?
Zadatak Tracker u Hadoopu je demon podreฤenog ฤvora u klasteru koji prihvaฤa zadatke iz Joba.Tracker. Takoฤer ลกalje poruke otkucaja srca JobuTracker, svakih nekoliko minuta, kako bi potvrdio da je PosaoTracker je joลก uvijek ลพiv.
42) Navedite koji se demoni pokreฤu na glavnom i podreฤenim ฤvorovima?
- Demon koji se izvodi na glavnom ฤvoru je "NameNode"
- Daemoni koji se izvrลกavaju na svakom podreฤenom ฤvoru su "Zadatak Trackerโ i โPodaciโ
43) Objasnite kako moลพete debugirati Hadoop kod?
Popularne metode za otklanjanje pogreลกaka Hadoop koda su:
- Koriลกtenjem web suฤelja koje pruลพa Hadoop framework
- Koriลกtenjem brojaฤa
44) Objasnite ลกto su ฤvorovi za pohranu i raฤunanje?
- ฤvor za pohranu je stroj ili raฤunalo na kojem se nalazi vaลก datoteฤni sustav za pohranjivanje podataka za obradu
- Raฤunalni ฤvor je raฤunalo ili stroj na kojem ฤe se izvrลกavati vaลกa stvarna poslovna logika.
45) Navedite ฤemu sluลพi Context Object?
Kontekstni objekt omoguฤuje maperu interakciju s ostatkom Hadoopa
sustav. Ukljuฤuje konfiguracijske podatke za posao, kao i suฤelja koja mu omoguฤuju emitiranje izlaza.
46) Navedite koji je sljedeฤi korak nakon Mappera ili MapTaska?
Sljedeฤi korak nakon Mappera ili MapTaska je sortiranje izlaza Mappera i kreiranje particija za izlaz.
47) Navedite koji je broj zadanog particionera u Hadoopu?
U Hadoopu, zadani particioner je "Hash" particioner.
48) Objasnite koja je svrha RecordReader-a u Hadoopu?
U Hadoopu, RecordReader uฤitava podatke iz svog izvora i pretvara ih u (kljuฤ, vrijednost) parove prikladne za ฤitanje od strane Mappera.
49) Objasnite kako se podaci particioniraju prije nego ลกto se poลกalju reduktoru ako u Hadoopu nije definiran prilagoฤeni particionar?
Ako u Hadoopu nije definiran prilagoฤeni particionar, tada zadani particionar izraฤunava hash vrijednost za kljuฤ i dodjeljuje particiju na temelju rezultata.
50) Objasnite ลกto se dogaฤa kada Hadoop stvori 50 zadataka za posao i jedan od zadataka ne uspije?
Ponovno ฤe pokrenuti zadatak na nekom drugom zadatkuTracker ako zadatak ne uspije viลกe od definiranog ograniฤenja.
51) Navedite koji je najbolji naฤin za kopiranje datoteka izmeฤu HDFS klastera?
Najbolji naฤin za kopiranje datoteka izmeฤu HDFS klastera je koriลกtenje viลกestrukih ฤvorova i naredbe distcp, tako da se radno optereฤenje dijeli.
52) Navedite koja je razlika izmeฤu HDFS-a i NAS-a?
HDFS podatkovni blokovi rasporeฤeni su po lokalnim diskovima svih strojeva u klasteru, dok su NAS podaci pohranjeni na namjenskom hardveru.
53) Navedite po ฤemu se Hadoop razlikuje od ostalih alata za obradu podataka?
U Hadoopu moลพete poveฤati ili smanjiti broj mapera bez brige o koliฤini podataka koje treba obraditi.
54) Navedite koji posao obavlja klasa conf?
Job conf class odvaja razliฤite poslove koji se izvode na istom klasteru. Obavlja postavke razine posla kao ลกto je deklariranje posla u stvarnom okruลพenju.
55) Navedite ลกto su Hadoop MapReduce API-ji?tract za klasu kljuฤa i vrijednosti?
Za klasu kljuฤa i vrijednosti postoje dva Hadoop MapReduce API-ja.tract
- Vrijednost mora definirati org.apache.hadoop.io.Writable suฤelje
- Kljuฤ mora definirati suฤelje org.apache.hadoop.io.WritableComparable
56) Navedite koja su tri naฤina u kojima se Hadoop moลพe pokrenuti?
Tri naฤina rada u kojima se Hadoop moลพe pokrenuti su
- Pseudo distribuirani naฤin rada
- Samostalni (lokalni) naฤin rada
- Potpuno distribuirani naฤin rada
57) Navedite ลกto radi format unosa teksta?
Format unosa teksta stvorit ฤe linijski objekt koji je heksadecimalni broj. Vrijednost se smatra cijelim redom teksta, dok se kljuฤ smatra objektom retka. Maper ฤe primiti vrijednost kao parametar 'tekst', a kljuฤ kao parametar 'longwriteable'.
58) Navedite koliko InputSplitova napravi Hadoop Framework?
Hadoop ฤe napraviti 5 podjela
- 1 podjela za 64 K datoteke
- 2 podijeljena za datoteke od 65 MB
- 2 podjele za datoteke od 127mb
59) Spomenite ลกto je distribuirana predmemorija u Hadoopu?
Distribuirana predmemorija u Hadoopu moguฤnost je koju pruลพa okvir MapReduce. U vrijeme izvrลกavanja posla, koristi se za predmemoriju datoteke. Framework kopira potrebne datoteke u podreฤeni ฤvor prije izvrลกenja bilo kojeg zadatka na tom ฤvoru.
60) Objasnite kako Hadoop Classpath igra vitalnu ulogu u zaustavljanjuping ili pokretanje u Hadoop daemonima?
Classpath ฤe se sastojati od popisa direktorija koji sadrลพe jar datoteke za zaustavljanje ili pokretanje demona.
Ova pitanja za intervju takoฤer ฤe vam pomoฤi u vaลกem ลพivotu
