शीर्ष 60 Hadoop साक्षात्कार प्रश्न और उत्तर (2026)

यहां नए और अनुभवी उम्मीदवारों के लिए अपने सपनों की नौकरी पाने के लिए Hadoop MapReduce साक्षात्कार प्रश्न और उत्तर दिए गए हैं।

Hadoop MapReduce साक्षात्कार प्रश्न

1) हाडोप मैप रिड्यूस क्या है?

Hadoop क्लस्टर में समानांतर रूप से बड़े डेटा सेट को प्रोसेस करने के लिए, Hadoop MapReduce फ्रेमवर्क का उपयोग किया जाता है। डेटा विश्लेषण दो-चरणीय मैप और रिड्यूस प्रक्रिया का उपयोग करता है।


2) हाडोप मैपरेड्यूस कैसे काम करता है?

मैपरिड्यूस में, मैप चरण के दौरान, यह प्रत्येक दस्तावेज़ में शब्दों की गणना करता है, जबकि रिड्यूस चरण में यह संपूर्ण संग्रह में फैले दस्तावेज़ के अनुसार डेटा को एकत्रित करता है। मैप चरण के दौरान, इनपुट डेटा को Hadoop फ्रेमवर्क में समानांतर रूप से चलने वाले मैप कार्यों द्वारा विश्लेषण के लिए विभाजित किया जाता है।

👉 निःशुल्क पीडीएफ डाउनलोड: Hadoop और MapReduce साक्षात्कार प्रश्न और उत्तर


3) बताएं कि मैपरेड्यूस में शफलिंग क्या है?

वह प्रक्रिया जिसके द्वारा सिस्टम सॉर्ट करता है और मैप आउटपुट को इनपुट के रूप में रिड्यूसर में स्थानांतरित करता है, उसे शफल के रूप में जाना जाता है


4) मैपरेड्यूस फ्रेमवर्क में वितरित कैश क्या है, समझाइए?

वितरित कैश MapReduce फ्रेमवर्क द्वारा प्रदान की गई एक महत्वपूर्ण सुविधा है। जब आप Hadoop में सभी नोड्स में कुछ फ़ाइलें साझा करना चाहते हैं Cluster, वितरित कैश का उपयोग किया जाता है। फ़ाइलें एक निष्पादन योग्य जार फ़ाइल या सरल गुण फ़ाइल हो सकती हैं।

Hadoop MapReduce साक्षात्कार प्रश्न
Hadoop MapReduce साक्षात्कार प्रश्न

5) बताएं कि Hadoop में NameNode क्या है?

Hadoop में NameNode वह नोड है, जहां Hadoop सभी फ़ाइल स्थान की जानकारी संग्रहीत करता है. एचडीएफएस (हडूप डिस्ट्रिब्यूटेड फाइल सिस्टम)दूसरे शब्दों में, नेमनोड एचडीएफएस फाइल सिस्टम का केंद्रबिंदु है। यह फाइल सिस्टम में मौजूद सभी फाइलों का रिकॉर्ड रखता है और tracयह फ़ाइल डेटा को क्लस्टर या कई मशीनों में वितरित करता है।


6) जॉब क्या है, समझाइए।TracHadoop में ker का क्या अर्थ है? Hadoop द्वारा कौन-कौन सी क्रियाएँ की जाती हैं?

In Hadoop प्रस्तुत करने के लिए और tracकिंग मैप रिड्यूस जॉब्स, जॉबTracकेर का उपयोग किया जाता है। नौकरी tracker अपने स्वयं के JVM प्रोसेस पर चलता है

काम Tracker हैडूप में निम्नलिखित क्रियाएं करता है।

  • क्लाइंट एप्लिकेशन जॉब सबमिट करते हैं tracकेर
  • कामTracडेटा स्थान निर्धारित करने के लिए ker नाम मोड से संचार करता है।
  • डेटा के पास या उपलब्ध स्लॉट के साथ नौकरीTracकेर टास्क का पता लगाता हैTracकेर नोड्स
  • चयनित कार्य परTracकेर नोड्स, यह काम प्रस्तुत करता है
  • जब कोई कार्य विफल हो जाता है, तो जॉब tracकेर सूचित करता है और फिर तय करता है कि आगे क्या करना है।
  • टास्कTracकेआर नोड्स की निगरानी जॉब द्वारा की जाती हैTracकेर

7) बताएं कि एचडीएफएस में हार्टबीट क्या है?

हार्टबीट एक सिग्नल को संदर्भित करता है जिसका उपयोग डेटा नोड और नेम नोड के बीच, और टास्क के बीच किया जाता है। tracकेर और नौकरी tracकेर, यदि नाम नोड या नौकरी tracयदि केर सिग्नल का जवाब नहीं देता है, तो यह माना जाता है कि डेटा नोड या टास्क में कुछ समस्या है। tracकेर


8) बताएं कि कंबाइनर्स क्या हैं और आपको मैपरेड्यूस जॉब में कंबाइनर का उपयोग कब करना चाहिए?

की कार्यकुशलता बढ़ाने के लिए मैपरिड्यूस प्रोग्राम, कॉम्बिनर का उपयोग किया जाता है। कॉम्बिनर की मदद से डेटा की मात्रा को कम किया जा सकता है जिसे रिड्यूसर में स्थानांतरित करने की आवश्यकता होती है। यदि निष्पादित ऑपरेशन कम्यूटेटिव और एसोसिएटिव है तो आप अपने रिड्यूसर कोड को कॉम्बिनर के रूप में उपयोग कर सकते हैं। Hadoop में कॉम्बिनर के निष्पादन की गारंटी नहीं है


9) जब कोई डेटा नोड विफल हो जाता है तो क्या होता है?

जब कोई डेटा नोड विफल हो जाता है

  • कामtracकेर और नेमनोड विफलता का पता लगाते हैं।
  • असफल नोड पर सभी कार्यों को पुनः निर्धारित किया जाता है
  • नामनोड उपयोगकर्ता के डेटा को दूसरे नोड पर दोहराता है

10) बताएं कि सट्टा निष्पादन क्या है?

हडूप में स्पेकुलेटिव एक्जीक्यूशन के दौरान, एक निश्चित संख्या में डुप्लिकेट टास्क लॉन्च किए जाते हैं। एक अलग स्लेव नोड पर, एक ही मैप या रिड्यूस टास्क की कई प्रतियाँ स्पेकुलेटिव एक्जीक्यूशन का उपयोग करके निष्पादित की जा सकती हैं। सरल शब्दों में, यदि कोई विशेष ड्राइव किसी कार्य को पूरा करने में लंबा समय ले रही है, तो हडूप किसी अन्य डिस्क पर एक डुप्लिकेट टास्क बनाएगा। जो डिस्क पहले कार्य पूरा करती है उसे बनाए रखा जाता है और जो डिस्क पहले पूरा नहीं करती हैं उन्हें मार दिया जाता है।


11) बताएं कि मैपर के मूल पैरामीटर क्या हैं?

मैपर के मूल पैरामीटर हैं

  • लम्बा लिखने योग्य और पाठ्य
  • पाठ्य और लिखने योग्य

12) बताएं कि मैपरिड्यूस पार्टीशनर का कार्य क्या है?

मैपरिड्यूस पार्टीशनर का कार्य यह सुनिश्चित करना है कि एक ही कुंजी का पूरा मान एक ही रिड्यूसर में जाए, जिससे अंततः रिड्यूसर पर मैप आउटपुट का समान वितरण हो सके।


13) बताएं कि इनपुट स्प्लिट और एचडीएफएस ब्लॉक के बीच क्या अंतर है?

डेटा के तार्किक विभाजन को स्प्लिट के रूप में जाना जाता है जबकि डेटा के भौतिक विभाजन को एचडीएफएस ब्लॉक के रूप में जाना जाता है


14) बताएं कि टेक्स्ट फॉर्मेट में क्या होता है?

टेक्स्ट इनपुट फ़ॉर्मेट में, टेक्स्ट फ़ाइल में प्रत्येक पंक्ति एक रिकॉर्ड होती है। Value लाइन की सामग्री है जबकि Key लाइन का बाइट ऑफ़सेट है। उदाहरण के लिए, Key: longWritable, Value: text


15) बताएं कि मुख्य कॉन्फ़िगरेशन पैरामीटर क्या हैं जिन्हें उपयोगकर्ता को मैपरिड्यूस जॉब चलाने के लिए निर्दिष्ट करने की आवश्यकता है?

मैपरिड्यूस फ्रेमवर्क के उपयोगकर्ता को निर्दिष्ट करने की आवश्यकता है

  • वितरित फ़ाइल सिस्टम में जॉब के इनपुट स्थान
  • वितरित फ़ाइल सिस्टम में जॉब का आउटपुट स्थान
  • इनपुट प्रारूप
  • आउटपुट स्वरूप
  • मानचित्र फ़ंक्शन युक्त वर्ग
  • कम करने वाले फ़ंक्शन वाला वर्ग
  • JAR फ़ाइल जिसमें मैपर, रिड्यूसर और ड्राइवर वर्ग शामिल हैं

16) बताएं कि Hadoop में WebDAV क्या है?

फ़ाइलों को संपादित करने और अपडेट करने में सहायता के लिए WebDAV HTTP के एक्सटेंशन का एक सेट है। अधिकांश ऑपरेटिंग सिस्टम पर WebDAV शेयर को फ़ाइल सिस्टम के रूप में माउंट किया जा सकता है, इसलिए WebDAV पर HDFS को एक्सपोज़ करके HDFS को एक मानक फ़ाइल सिस्टम के रूप में एक्सेस करना संभव है।


17) बताएं कि Hadoop में Sqoop क्या है?

के बीच डेटा स्थानांतरित करने के लिए रिलेशनल डेटाबेस प्रबंधन (RDBMS) और Hadoop HDFS Sqoop नामक टूल का उपयोग किया जाता है। Sqoop का उपयोग करके RDMS से डेटा को इस प्रकार स्थानांतरित किया जा सकता है MySQL or Oracle HDFS में और साथ ही HDFS फ़ाइल से RDBMS में डेटा निर्यात करना


18) समझाइए कि अय्यूबTracक्या केर किसी कार्य को निर्धारित करता है?

कार्य tracकेर जॉब को दिल की धड़कन के संदेश भेजता हैtracवह आमतौर पर हर कुछ मिनटों में यह सुनिश्चित करने के लिए काम करता है कि जॉबTracकेर सक्रिय और कार्यरत है। यह संदेश जॉब को भी सूचित करता है।Tracउपलब्ध स्लॉट की संख्या के बारे में, इसलिए नौकरीTracकेर इस बात से अवगत रह सकता है कि क्लस्टर के काम को कहाँ सौंपा जा सकता है।


19) बताएं कि सीक्वेंसफाइलइनपुटफॉर्मेट क्या है?

Sequencefileinputformat का उपयोग अनुक्रम में फ़ाइलों को पढ़ने के लिए किया जाता है। यह एक विशिष्ट संपीड़ित बाइनरी फ़ाइल प्रारूप है जो एक MapReduce जॉब के आउटपुट से किसी अन्य MapReduce जॉब के इनपुट के बीच डेटा पास करने के लिए अनुकूलित है।


20) बताएं कि conf.setMapper क्लास क्या करता है?

Conf.setMapperclass मैपर क्लास और मैप जॉब से संबंधित सभी चीजों को सेट करता है जैसे कि डेटा पढ़ना और मैपर से कुंजी-मूल्य जोड़ी उत्पन्न करना

21) बताएं कि Hadoop क्या है?

यह कमोडिटी हार्डवेयर के क्लस्टर पर डेटा संग्रहीत करने और एप्लिकेशन चलाने के लिए एक ओपन-सोर्स सॉफ़्टवेयर फ्रेमवर्क है। यह किसी भी प्रकार के डेटा के लिए बहुत अधिक प्रोसेसिंग पावर और विशाल स्टोरेज प्रदान करता है।


22) RDBMS और Hadoop में क्या अंतर है?

आरडीबीएमएस Hadoop
आरडीबीएमएस एक रिलेशनल डेटाबेस प्रबंधन प्रणाली है हाडोप एक नोड आधारित फ्लैट संरचना है
इसका उपयोग OLTP प्रसंस्करण के लिए किया जाता है जबकि Hadoop इसका उपयोग वर्तमान में विश्लेषणात्मक और बड़े डेटा प्रसंस्करण के लिए किया जाता है
RDBMS में, डेटाबेस क्लस्टर साझा स्टोरेज में संग्रहीत समान डेटा फ़ाइलों का उपयोग करता है हाडोप में, भंडारण डेटा को प्रत्येक प्रसंस्करण नोड में स्वतंत्र रूप से संग्रहीत किया जा सकता है।
आपको डेटा को संग्रहीत करने से पहले उसे प्रीप्रोसेस करना होगा आपको डेटा संग्रहीत करने से पहले उसे प्रीप्रोसेस करने की आवश्यकता नहीं है

23) Hadoop के मुख्य घटकों का उल्लेख करें?

हाडोप के मुख्य घटकों में शामिल हैं,

  • एचडीएफएस
  • मानचित्र छोटा करना

24) हाडोप में नेमनोड क्या है?

Hadoop में NameNode वह स्थान है जहाँ Hadoop HDFS में सभी फ़ाइल स्थान की जानकारी संग्रहीत करता है। यह मास्टर नोड है जिस पर जॉब्स चलती हैं। tracकेर रन करता है और इसमें मेटाडेटा शामिल होता है।


25) बताइये कि Hadoop द्वारा कौन से डेटा घटकों का उपयोग किया जाता है?

Hadoop द्वारा उपयोग किये जाने वाले डेटा घटक हैं


26) बताइये कि Hadoop द्वारा उपयोग किया जाने वाला डेटा संग्रहण घटक क्या है?

Hadoop द्वारा प्रयुक्त डेटा संग्रहण घटक HBase है।


27) Hadoop में परिभाषित सबसे सामान्य इनपुट प्रारूप क्या हैं?

Hadoop में परिभाषित सबसे आम इनपुट प्रारूप हैं;

  • टेक्स्टइनपुटफॉर्मेट
  • कुंजीवैल्यूइनपुटफ़ॉर्मेट
  • अनुक्रमफ़ाइलइनपुटफ़ॉर्मेट

28) हाडोप में इनपुटस्प्लिट क्या है?

यह इनपुट फ़ाइलों को टुकड़ों में विभाजित करता है और प्रत्येक टुकड़े को प्रसंस्करण के लिए मैपर को सौंपता है।


29) हाडोप जॉब के लिए आप कस्टम पार्टीशनर कैसे लिखेंगे?

आप किसी Hadoop जॉब के लिए कस्टम पार्टीशनर लिखते हैं, तो आप निम्न पथ का अनुसरण करते हैं

  • एक नया वर्ग बनाएं जो Partitioner Class का विस्तार करता है
  • getPartition विधि ओवरराइड करें
  • MapReduce चलाने वाले रैपर में
  • विधि सेट पार्टिशनर क्लास का उपयोग करके कस्टम पार्टीशनर को जॉब में जोड़ें या – कस्टम पार्टीशनर को कॉन्फ़िगरेशन फ़ाइल के रूप में जॉब में जोड़ें

30) क्या Hadoop में किसी जॉब के लिए बनाए जाने वाले मैपर्स की संख्या को बदलना संभव है?

नहीं, बनाए जाने वाले मैपर्स की संख्या को बदलना संभव नहीं है। मैपर्स की संख्या इनपुट स्प्लिट्स की संख्या से निर्धारित होती है।


31) बताएं कि Hadoop में अनुक्रम फ़ाइल क्या है?

बाइनरी कुंजी/मूल्य जोड़े को संग्रहीत करने के लिए, अनुक्रम फ़ाइल का उपयोग किया जाता है। नियमित संपीड़ित फ़ाइल के विपरीत, अनुक्रम फ़ाइल विभाजन का समर्थन करती है, भले ही फ़ाइल के अंदर डेटा संपीड़ित हो।


32) नेम नोड के बंद होने पर जॉब का क्या होता है? tracकेर?

नामनोड एचडीएफएस में विफलता का एकल बिंदु है, इसलिए जब नामनोड डाउन होता है तो आपका क्लस्टर बंद हो जाएगा।


33) बताएं कि एचडीएफएस में इंडेक्सिंग कैसे की जाती है?

Hadoop में इंडेक्सिंग का एक अनूठा तरीका है। एक बार जब डेटा ब्लॉक आकार के अनुसार संग्रहीत हो जाता है, तो HDFS डेटा के अंतिम भाग को संग्रहीत करना जारी रखेगा, जो बताता है कि डेटा का अगला भाग कहाँ होगा।


34) बताएं कि क्या वाइल्डकार्ड का उपयोग करके फ़ाइलों की खोज करना संभव है?

हां, वाइल्डकार्ड का उपयोग करके फ़ाइलों को खोजना संभव है।


35) Hadoop की तीन कॉन्फ़िगरेशन फ़ाइलों की सूची बनाएं?

तीन कॉन्फ़िगरेशन फ़ाइलें हैं

  • कोर-साइट.xml
  • mapred-साइट.xml
  • hdfs-साइट.xml

36) बताएं कि आप jps कमांड का उपयोग करके कैसे जांच सकते हैं कि नामनोड काम कर रहा है या नहीं?

Jps कमांड का उपयोग करने के अलावा, यह जांचने के लिए कि क्या नामनोड काम कर रहा है, आप इसका भी उपयोग कर सकते हैं

/etc/init.d/hadoop-0.20-namenode स्थिति.


37) बताएं कि Hadoop में “मैप” क्या है और “रिड्यूसर” क्या है?

Hadoop में, मैप HDFS क्वेरी सॉल्विंग का एक चरण है। मैप इनपुट लोकेशन से डेटा पढ़ता है, और इनपुट प्रकार के अनुसार एक कुंजी मान जोड़ी आउटपुट करता है।

हाडोप में, रिड्यूसर मैपर द्वारा उत्पन्न आउटपुट को एकत्रित करता है, उसे संसाधित करता है, तथा अपना स्वयं का अंतिम आउटपुट बनाता है।


38) Hadoop में कौन सी फ़ाइल रिपोर्टिंग को नियंत्रित करती है?

Hadoop में, hadoop-metrics.properties फ़ाइल रिपोर्टिंग को नियंत्रित करती है।


39) Hadoop का उपयोग करने के लिए नेटवर्क आवश्यकताओं की सूची बनाएं?

Hadoop का उपयोग करने के लिए नेटवर्क आवश्यकताओं की सूची इस प्रकार है:

  • पासवर्ड रहित SSH कनेक्शन
  • सर्वर प्रक्रियाओं को लॉन्च करने के लिए सिक्योर शेल (SSH)

40) रैक जागरूकता क्या है?

रैक जागरूकता वह तरीका है जिसमें नामनोड यह निर्धारित करता है कि रैक परिभाषाओं के आधार पर ब्लॉकों को कैसे रखा जाए।


41) कार्य क्या होता है, समझाइए। TracHadoop में ker?

एक कार्य TracHadoop में ker क्लस्टर में एक स्लेव नोड डेमन है जो जॉब से टास्क स्वीकार करता है।Tracयह जॉब को हार्टबीट संदेश भी भेजता है।Tracहर कुछ मिनटों में, यह पुष्टि करने के लिए कि काम हो गया हैTracकेर अभी भी जीवित है।


42) बताएं कि मास्टर नोड और स्लेव नोड पर कौन से डेमॉन चलते हैं?

  • मास्टर नोड पर चलने वाला डेमॉन “नेमनोड” है
  • प्रत्येक स्लेव नोड पर चलने वाले डेमन "टास्क" हैं Tracकेर” और “डेटा”

43) बताएं कि आप Hadoop कोड को कैसे डीबग कर सकते हैं?

Hadoop कोड को डीबग करने के लोकप्रिय तरीके हैं:

  • Hadoop फ्रेमवर्क द्वारा प्रदान किए गए वेब इंटरफ़ेस का उपयोग करके
  • काउंटरों का उपयोग करके

44) स्टोरेज और कंप्यूट नोड्स क्या है बताएं?

  • स्टोरेज नोड वह मशीन या कंप्यूटर है जहां आपका फ़ाइल सिस्टम प्रोसेसिंग डेटा को संग्रहीत करने के लिए रहता है
  • कंप्यूट नोड वह कंप्यूटर या मशीन है जहां आपका वास्तविक व्यावसायिक तर्क निष्पादित किया जाएगा।

45) बताइये कि संदर्भ ऑब्जेक्ट का उपयोग क्या है?

संदर्भ ऑब्जेक्ट मैपर को बाकी Hadoop के साथ इंटरैक्ट करने में सक्षम बनाता है

सिस्टम। इसमें जॉब के लिए कॉन्फ़िगरेशन डेटा, साथ ही इंटरफेस शामिल हैं जो इसे आउटपुट उत्सर्जित करने की अनुमति देते हैं।


46) बताइये मैपर या मैपटास्क के बाद अगला कदम क्या है?

मैपर या मैपटास्क के बाद अगला चरण यह है कि मैपर के आउटपुट को क्रमबद्ध किया जाएगा, और आउटपुट के लिए विभाजन बनाए जाएंगे।


47) बताइये Hadoop में डिफ़ॉल्ट पार्टीशनर की संख्या कितनी है?

Hadoop में, डिफ़ॉल्ट विभाजनकर्ता एक "हैश" विभाजनकर्ता है।


48) बताएं कि Hadoop में RecordReader का उद्देश्य क्या है?

हाडोप में, रिकॉर्ड रीडर डेटा को उसके स्रोत से लोड करता है और उसे मैपर द्वारा पढ़ने के लिए उपयुक्त (कुंजी, मान) युग्मों में परिवर्तित करता है।


49) बताएं कि यदि Hadoop में कोई कस्टम पार्टीशनर परिभाषित नहीं है, तो रिड्यूसर को भेजे जाने से पहले डेटा का विभाजन कैसे किया जाता है?

यदि Hadoop में कोई कस्टम पार्टीशनर परिभाषित नहीं है, तो एक डिफ़ॉल्ट पार्टीशनर कुंजी के लिए हैश मान की गणना करता है और परिणाम के आधार पर विभाजन निर्दिष्ट करता है।


50) बताएं कि क्या होता है जब हाडोप ने किसी कार्य के लिए 50 कार्य उत्पन्न किए और उनमें से एक कार्य विफल हो गया?

यह किसी अन्य कार्य पर कार्य को पुनः आरंभ करेगा।Tracयदि कार्य निर्धारित सीमा से अधिक बार विफल होता है तो ker।


51) एचडीएफएस क्लस्टरों के बीच फ़ाइलों की प्रतिलिपि बनाने का सबसे अच्छा तरीका क्या है?

एचडीएफएस क्लस्टरों के बीच फ़ाइलों की प्रतिलिपि बनाने का सबसे अच्छा तरीका एकाधिक नोड्स और distcp कमांड का उपयोग करना है, ताकि कार्यभार साझा किया जा सके।


52) एचडीएफएस और एनएएस में क्या अंतर है?

HDFS डेटा ब्लॉक क्लस्टर में सभी मशीनों के स्थानीय ड्राइवों में वितरित किए जाते हैं, जबकि NAS डेटा समर्पित हार्डवेयर पर संग्रहीत किया जाता है।


53) बताइये कि Hadoop अन्य डेटा प्रोसेसिंग टूल्स से किस प्रकार भिन्न है?

हाडोप में, आप संसाधित किए जाने वाले डेटा की मात्रा की चिंता किए बिना मैपर्स की संख्या बढ़ा या घटा सकते हैं।


54) बताइये कॉन्फ क्लास क्या काम करता है?

जॉब कॉन्फ़ क्लास एक ही क्लस्टर पर चल रहे अलग-अलग जॉब को अलग करता है। यह जॉब लेवल सेटिंग करता है जैसे कि वास्तविक वातावरण में जॉब घोषित करना।


55) हैडूप मैप रिड्यूस एपीआई का उपयोग क्या है, इसका उल्लेख करें।tracकुंजी और मान वर्ग के लिए t?

की और वैल्यू क्लास के लिए, दो हैडूप मैप रिड्यूस एपीआई उपलब्ध हैं।tract

  • मान org.apache.hadoop.io.Writable इंटरफ़ेस को परिभाषित करना चाहिए
  • कुंजी को org.apache.hadoop.io.WritableComparable इंटरफ़ेस को परिभाषित करना होगा

56) बताइये कि Hadoop को किन तीन तरीकों से चलाया जा सकता है?

हाडोप को चलाने के तीन तरीके हैं

  • छद्म वितरित मोड
  • स्टैंडअलोन (स्थानीय) मोड
  • पूर्णतया वितरित मोड

57) बताइये कि टेक्स्ट इनपुट फॉर्मेट क्या करता है?

टेक्स्ट इनपुट प्रारूप एक लाइन ऑब्जेक्ट बनाएगा जो एक हेक्साडेसिमल संख्या है। मान को एक पूरी लाइन टेक्स्ट के रूप में माना जाता है जबकि कुंजी को एक लाइन ऑब्जेक्ट के रूप में माना जाता है। मैपर को मान 'टेक्स्ट' पैरामीटर के रूप में प्राप्त होगा जबकि कुंजी 'लॉन्गराइटेबल' पैरामीटर के रूप में।


58) बताइये कि Hadoop फ्रेमवर्क द्वारा कितने InputSplits बनाए जाते हैं?

हाडोप 5 विभाजन करेगा

  • 1K फ़ाइलों के लिए 64 विभाजन
  • 2mb फ़ाइलों के लिए 65 विभाजन
  • 2mb फ़ाइलों के लिए 127 विभाजन

59) बताइये कि Hadoop में वितरित कैश क्या है?

Hadoop में वितरित कैश MapReduce फ्रेमवर्क द्वारा प्रदान की गई एक सुविधा है। जॉब के निष्पादन के समय, इसका उपयोग फ़ाइल को कैश करने के लिए किया जाता है। फ्रेमवर्क उस नोड पर किसी भी कार्य के निष्पादन से पहले स्लेव नोड पर आवश्यक फ़ाइलों की प्रतिलिपि बनाता है।


60) समझाइए कि हैडूप क्लासपाथ किस प्रकार एक महत्वपूर्ण भूमिका निभाता हैping या Hadoop डेमन्स में शुरू हो रहा है?

क्लासपथ में डेमॉन को रोकने या शुरू करने के लिए jar फ़ाइलों वाली निर्देशिकाओं की सूची शामिल होगी।

ये साक्षात्कार प्रश्न आपके मौखिक (मौखिक) में भी मदद करेंगे

इस पोस्ट को संक्षेप में इस प्रकार लिखें: