उदाहरण के साथ Informatica में रैंक परिवर्तन

⚡ स्मार्ट सारांश

इनफॉर्मेटिका में रैंक ट्रांसफॉर्मेशन एक सक्रिय, कनेक्टेड ऑब्जेक्ट है जो प्रत्येक समूह की केवल शीर्ष या नीचे की N पंक्तियों को रखता है, और प्रत्येक शेष पंक्ति को अपने स्वचालित RANKINDEX आउटपुट पोर्ट के माध्यम से एक स्थिति प्रदान करता है।

  • 🥇 शीर्ष या नीचे N: टॉप/बॉटम प्रॉपर्टी और नंबर ऑफ रैंक्स प्रॉपर्टी मिलकर यह तय करती हैं कि फिल्टर से कौन सी पंक्तियाँ बचेंगी।
  • समूहवार रैंकिंग: पोर्ट के आधार पर समूह बनाने से प्रत्येक समूह के लिए रैंकिंग फिर से शुरू हो जाती है, जिससे प्रत्येक विभाग अपने शीर्ष तीन परिणाम दे सकता है।
  • 🔢 रैंक पोर्ट: केवल एक पोर्ट पर R फ्लैग लगा होता है, और उसी एक कॉलम के आधार पर रैंकिंग की गणना की जाती है।
  • 📍 रैंक सूचकांक: डिजाइनर प्रत्येक पंक्ति की स्थिति को उसके समूह के भीतर रखने के लिए इस आउटपुट-ओनली पोर्ट को स्वचालित रूप से जोड़ता है।
  • 🧪 उदाहरण सहित: आठ मानचित्रping डिज़ाइनर चरण प्रत्येक विभाग के तीन सबसे अधिक वेतन पाने वाले कर्मचारियों को EMP_TARGET में लोड करते हैं।
  • 💾 कैश किया गया और सक्रिय: समूह मान और पंक्ति डेटा एक इंडेक्स और एक डेटा कैश में संग्रहीत होते हैं, और पंक्तियों की संख्या बदलती रहती है।

इन्फॉर्मेटिका में रैंक परिवर्तन

रैंक परिवर्तन क्या है?

रैंक रूपांतरण एक सक्रिय और परस्पर जुड़ा रूपांतरण है जो समूह और रैंक के आधार पर डेटा को फ़िल्टर करता है। उदाहरण के लिए, यदि आप सबसे अधिक वेतन पाने वाले कर्मचारियों के दस रिकॉर्ड प्राप्त करना चाहते हैं, तो इस प्रकार की फ़िल्टरिंग रैंक रूपांतरण द्वारा की जा सकती है।

रैंक रूपांतरण समूहों के आधार पर रैंकिंग करने की सुविधा भी प्रदान करता है। उदाहरण के लिए, यदि आप विभागवार शीर्ष दस सबसे अधिक वेतन पाने वाले कर्मचारियों को प्राप्त करना चाहते हैं, तो वह समूहping इस रूपांतरण से यह किया जा सकता है।

रैंक रूपांतरण एक सक्रिय रूपांतरण है, क्योंकि यह आउटपुट पंक्तियों की संख्या को प्रभावित करता है।

रैंक ट्रांसफॉर्मेशन में एक आउटपुट पोर्ट होता है जिसके द्वारा यह पंक्तियों को रैंक प्रदान करता है। उस पोर्ट का नाम RANKINDEX है, और डिज़ाइनर ट्रांसफॉर्मेशन को जोड़ते ही इसे स्वचालित रूप से बना देता है। नक्शाping.

क्योंकि रैंकिंग को विजेता का निर्णय लेने से पहले समूह की प्रत्येक पंक्ति की तुलना करनी होती है, इसलिए इंटीग्रेशन सर्विस आने वाले डेटा को कैश में स्टोर करती है। समूह के मान इंडेक्स कैश में जाते हैं और शेष पंक्ति डेटा डेटा कैश में जाता है, ठीक उसी तरह जैसे कैश किया गया डेटा। जॉइनर परिवर्तन इसमें इसकी मास्टर पाइपलाइन है।

रैंक परिवर्तन में बंदरगाह

उदाहरण को समझने से पहले, यह जानना उपयोगी होगा कि पोर्ट्स टैब पर प्रत्येक पोर्ट फ्लैग वास्तव में क्या करता है, क्योंकि उनमें से दो इस रूपांतरण का वास्तविक कार्य करते हैं।

पोर्ट प्रकार यह क्या करता है
इनपुट (I) अपस्ट्रीम ट्रांसफॉर्मेशन से एक कॉलम प्राप्त करता है। रैंक ट्रांसफॉर्मेशन से जुड़ा प्रत्येक कॉलम एक इनपुट पोर्ट होता है।
आउटपुट (O) यह कॉलम को अगले रूपांतरण या लक्ष्य तक पहुंचाता है।
चर (V) यह रूपांतरण के भीतर एक स्थानीय गणना को समाहित करता है, ठीक उसी तरह जैसे एक एक्सप्रेशन रूपांतरण में होता है।
रैंक (आर) यह उस कॉलम को दर्शाता है जिसके आधार पर रैंकिंग की गणना की जाती है। रूपांतरण में केवल एक ही पोर्ट इस चिह्न को धारण कर सकता है।
समूह द्वारा यह प्रत्येक विशिष्ट मान के लिए रैंकिंग को पुनः आरंभ करता है, इसलिए शीर्ष तीन फ़िल्टर कुल मिलाकर तीन पंक्तियों के बजाय प्रति समूह तीन पंक्तियाँ लौटाता है।
रैंकइंडेक्स डिजाइनर द्वारा बनाया गया एक आउटपुट पोर्ट। यह अपने समूह के भीतर प्रत्येक पंक्ति की रैंकिंग स्थिति को संग्रहीत करता है और इसे बिना कनेक्ट किए भी छोड़ा जा सकता है।

रैंकिंग केवल एक ही पोर्ट पर की जा सकती है, इसलिए "उच्चतम वेतन, फिर सबसे लंबी सेवा" जैसी आवश्यकता के लिए टाई-ब्रेकिंग मूल्य को दूसरे रैंक पोर्ट के बजाय पहले से तैयार करने की आवश्यकता होती है।

इनफॉर्मेटिका में रैंक ट्रांसफॉर्मेशन का उपयोग कैसे करें

हमारी आवश्यकता प्रत्येक विभाग के शीर्ष 3 सबसे अधिक वेतन पाने वाले कर्मचारियों को सूचीबद्ध करना है; हम इसे रैंक रूपांतरण का उपयोग करके लागू करेंगे। कृपया मानचित्र में नीचे दिए गए आठ चरणों का पालन करें।ping डिजाइनर।

चरण 1) मानचित्र बनाएँping स्रोत EMP और लक्ष्य EMP_TARGET हैं। दोनों परिभाषाएँ अब कैनवास पर मौजूद हैं, जैसा कि नीचे दिखाया गया है।

नक्शाping डिजाइनर EMP स्रोत परिभाषा और EMP_TARGET लक्ष्य परिभाषा को दर्शाता है।

चरण 2) फिर मानचित्र मेंping

  1. परिवर्तन मेनू चुनें
  2. बनाएँ विकल्प चुनें

इसके बाद क्रिएट विकल्प के साथ ट्रांसफॉर्मेशन मेनू दिखाया गया है।

मैप में ट्रांसफॉर्मेशन मेनू खुल गया।ping क्रिएट विकल्प को हाइलाइट करते हुए डिज़ाइनर

चरण 3) परिवर्तन निर्माण विंडो में

  1. रैंक परिवर्तन चुनें
  2. परिवर्तन नाम “rnk_salary” दर्ज करें
  3. बनाएँ बटन चुनें

चयनित रैंक और rnk_salary नाम के साथ एक ट्रांसफॉर्मेशन विंडो बनाएं।

चरण 4) मानचित्र में रैंक परिवर्तन बनाया जाएगाpingविंडो में मौजूद 'हो गया' बटन को चुनें। अब कैनवास पर खाली rnk_salary ऑब्जेक्ट दिखाई देगा।

रैंक रूपांतरण rnk_salary बनाया गया और मानचित्र पर रखा गयाping कैनवास

चरण 5) सभी पोर्ट्स को कनेक्ट करें स्रोत क्वालिफायर रैंक रूपांतरण के लिए, ताकि प्रत्येक कर्मचारी कॉलम रैंकिंग के लिए उपलब्ध हो।

सभी सोर्स क्वालिफायर पोर्ट rnk_salary रैंक रूपांतरण से जुड़े हुए हैं

चरण 6) Double रैंक ट्रांसफॉर्मेशन पर क्लिक करें, इससे "ट्रांसफॉर्मेशन संपादित करें" विंडो खुल जाएगी। इस विंडो में

  1. गुण मेनू चुनें
  2. शीर्ष/नीचे प्रॉपर्टी से “शीर्ष” विकल्प चुनें
  3. रैंक की संख्या में 3 दर्ज करें

अब प्रॉपर्टीज़ टैब में तीन रैंक के साथ 'टॉप' लिखा हुआ है, जैसा कि स्क्रीनशॉट में दिखाया गया है।

रैंक रूपांतरण के प्रॉपर्टी टैब में, शीर्ष का चयन करें और रैंकों की संख्या के रूप में तीन दर्ज करें।

चरण 7) “परिवर्तन संपादित करें” विंडो में पुनः

  1. पोर्ट टैब चुनें
  2. विभाग संख्या कॉलम के लिए विकल्प द्वारा समूह का चयन करें
  3. वेतन कॉलम में रैंक चुनें
  4. ओके बटन का चयन करें

पोर्ट्स टैब में अब विभाग संख्या पर समूह ध्वज और वेतन पर R ध्वज प्रदर्शित होता है।

रैंक रूपांतरण के पोर्ट टैब में विभाग संख्या पर ग्रुप बाय और वेतन कॉलम पर रैंक सेट किया गया है।

चरण 8) रैंक रूपांतरण से लक्ष्य तालिका तक पोर्ट कनेक्ट करें। मानचित्रping अब यह EMP से rnk_salary के माध्यम से EMP_TARGET में जाता है।

रैंक किए गए पोर्ट rnk_salary रैंक रूपांतरण से EMP_TARGET तालिका से जुड़े हुए हैं

अब, मानचित्र को सहेजें।ping और इसे बनाने के बाद निष्पादित करें सत्र और वर्कफ़्लोसोर्स क्वालिफायर सभी रिकॉर्ड प्राप्त करेगा, लेकिन रैंक ट्रांसफॉर्मेशन प्रत्येक विभाग के लिए केवल तीन उच्चतम वेतन वाले रिकॉर्ड ही पास करेगा।

रैंक रूपांतरण गुण

चरण 6 में उपयोग किए गए प्रॉपर्टीज़ टैब में उदाहरण में किए गए दो बदलावों से कहीं अधिक सेटिंग्स होती हैं। नीचे दी गई सेटिंग्स यह नियंत्रित करती हैं कि कितनी पंक्तियाँ सुरक्षित रहेंगी, स्ट्रिंग्स की तुलना कैसे की जाएगी और कैश फ़ाइलें कहाँ लिखी जाएंगी।

संपत्ति यह क्या नियंत्रित करता है?
ऊपर से नीचे रैंक किए गए कॉलम के लिए उच्चतम या निम्नतम मान रखे जाते हैं या नहीं। उदाहरण में 'शीर्ष' का उपयोग किया गया है।
रैंकों की संख्या प्रति समूह कितनी पंक्तियाँ लौटाई जाती हैं? उदाहरण में 3 का उपयोग किया गया है, इसलिए प्रत्येक विभाग तीन कर्मचारियों को लौटाता है।
केस-संवेदनशील स्ट्रिंग तुलना क्या रैंकिंग करते समय स्ट्रिंग तुलनाओं में अक्षर के केस का ध्यान रखा जाता है? यह केवल तभी मायने रखता है जब रैंक पोर्ट में टेक्स्ट हो।
कैश निर्देशिका वह निर्देशिका जिसमें इंडेक्स और डेटा कैश फाइलें बनाई जाती हैं। डिफ़ॉल्ट मान $PMCacheDir प्रोसेस वेरिएबल है।
रैंक डेटा कैश आकार पंक्ति डेटा को रखने वाले डेटा कैश का आकार। डिफ़ॉल्ट मान ऑटो है, जिससे इंटीग्रेशन सर्विस इसे निर्धारित कर सकती है।
रैंक इंडेक्स कैश आकार समूह मानों को रखने वाले इंडेक्स कैश का आकार। डिफ़ॉल्ट मान ऑटो है।
परिवर्तन का दायरा यह रैंकिंग प्रत्येक लेनदेन या सभी आने वाले डेटा पर लागू होती है।
Tracइंग स्तर सेशन लॉग में लिखी जाने वाली जानकारी की मात्रा: संक्षिप्त, सामान्य, विस्तृत आरंभीकरण या विस्तृत डेटा।

बड़े स्रोतों पर कैश साइजिंग सेटिंग पर दोबारा विचार करना ज़रूरी है। जब कैश बहुत छोटा होता है, तो इंटीग्रेशन सर्विस डिस्क पर पेजिंग करती है, जो कि सबसे पहले जाँची जाने वाली चीज़ों में से एक है। प्रदर्शन सुधारना मानचित्र काping.

रैंक रूपांतरण बनाम एग्रीगेटर रूपांतरण

दोनों रूपांतरण सक्रिय हैं, दोनों अपने इनपुट को कैश करते हैं और दोनों ग्रुप बाय पोर्ट प्रदान करते हैं, इसलिए गलत रूपांतरण का चयन करना आसान है। अंतर केवल उनसे प्राप्त होने वाले परिणाम में है।

तुलना का बिंदु रैंक परिवर्तन एग्रीगेटर रूपांतरण
उद्देश्य यह प्रत्येक समूह की शीर्ष या नीचे की N पूर्ण पंक्तियों को लौटाता है। यह योग जैसे परिकलित मान लौटाता है। AVGप्रति समूह अधिकतम या न्यूनतम
पंक्तियाँ वापस आ गईं प्रत्येक समूह में रैंकों की संख्या तक, उनके सभी स्तंभों को बरकरार रखते हुए। सामान्यतः प्रति समूह एक सारांश पंक्ति
अतिरिक्त पोर्ट जोड़ा गया RANKINDEX, जो प्रत्येक पंक्ति की स्थिति को दर्शाता है कोई नहीं
रैंक किया गया या एकत्रित स्तंभ एक बंदरगाह को रैंक पोर्ट के रूप में चिह्नित किया गया है एग्रीगेट एक्सप्रेशन ले जाने वाले किसी भी संख्या के पोर्ट

सीधे शब्दों में कहें तो, ए एग्रीगेटर रूपांतरण यह प्रश्न पूछता है कि "इस विभाग में सबसे अधिक वेतन कितना है", जबकि रैंक रूपांतरण यह उत्तर देता है कि "कौन से कर्मचारी इसे कमाते हैं"। जब केवल पंक्तियों के एक उपसमूह को एक सरल शर्त पर हटाया जाना होता है और कोई क्रम शामिल नहीं होता है, तो एक फ़िल्टर रूपांतरण यह सस्ता विकल्प है, क्योंकि इसमें किसी भी प्रकार की कैशिंग की आवश्यकता नहीं होती है।

अक्सर पूछे जाने वाले प्रश्न

नहीं। रैंक केवल कनेक्टेड होता है, इसलिए इसे दो ऑब्जेक्ट्स के बीच डेटा प्रवाह में शामिल होना पड़ता है। RANKINDEX पोर्ट को डिस्कनेक्टेड छोड़ा जा सकता है, लेकिन ट्रांसफॉर्मेशन को उस तरह से कॉल नहीं किया जा सकता जिस तरह से डिस्कनेक्टेड लुकअप को कॉल किया जाता है।

समान रैंक वाली पंक्तियों को रैंक इंडेक्स में समान मान प्राप्त होता है और रूपांतरण अगले मान को छोड़ देता है। इसलिए, दूसरे स्थान पर रहने वाले दो कर्मचारियों को 2 दिखाया जाता है, और अगली पंक्ति में 3 के बजाय 4 दिखाया जाता है।

पूरे स्रोत को एक समूह के रूप में माना जाता है, इसलिए रूपांतरण केवल कुल रैंकों की संख्या लौटाता है। समूह पोर्ट के बिना तीन रैंक सेट करने से कंपनी भर में तीन सबसे अधिक वेतन पाने वाले कर्मचारी मिलते हैं, न कि प्रति विभाग।

जी हां। न्यूमेरिक, स्ट्रिंग और दिनांक/समय पोर्ट को रैंक पोर्ट के रूप में चिह्नित किया जा सकता है। टेक्स्ट के लिए, केस-सेंसिटिव स्ट्रिंग कम्पेरिजन प्रॉपर्टी यह तय करती है कि अक्षरों का केस क्रम को प्रभावित करता है या नहीं, इसलिए सेशन शुरू होने से पहले इसकी जांच कर लें।

गारंटी नहीं है। यह रूपांतरण यह तय करता है कि कौन सी पंक्तियाँ शेष रहेंगी, यह उनके लक्ष्य तक पहुँचने के क्रम की गारंटी नहीं देता है। यदि लोड क्रम महत्वपूर्ण है, तो RANKINDEX पोर्ट पर Sorter रूपांतरण जोड़ें।

A एसक्यूएल विंडो फ़ंक्शन प्रत्येक पंक्ति को लेबल करता है और फ़िल्टरिंग का काम बाहरी क्वेरी पर छोड़ देता है। इन्फॉर्मेटिका ट्रांसफ़ॉर्मेशन एक ही बार में लेबलिंग और फ़िल्टरिंग करता है, और यह फ़्लैट फ़ाइलों और अन्य गैर-संबंधी स्रोतों पर काम करता है जहाँ कोई डेटाबेस इंजन उपलब्ध नहीं होता है।

मशीन लर्निंग मॉडल, सदस्यों के सेवा छोड़ने, धोखाधड़ी या रूपांतरण की संभावना के आधार पर रिकॉर्ड को स्कोर देते हैं, और यही स्कोर रैंक किए गए कॉलम का आधार बनता है। एआई सलाहकार समूह के आकार का भी विश्लेषण करते हैं, इसलिए कैश सेटिंग्स और रैंक की संख्या अनुमान के बजाय वास्तविक डेटा से चुनी जाती है।

कोपायलट समतुल्य विंडो-फ़ंक्शन क्वेरी का मसौदा तैयार करता है या Python यह ग्रुपबाई विधि का उपयोग करके परिणामों को जल्दी से सत्यापित कर सकता है। यह आपके मानचित्र को नहीं पढ़ सकता।pingइसलिए, प्रत्येक सुझाव को एक ड्राफ्ट के रूप में मानें और सत्र लॉग के विरुद्ध पंक्ति गणना की तुलना करें।

इस पोस्ट को संक्षेप में इस प्रकार लिखें: