Осигуряване на ДАННИ и репликация в SAP ХАНА

⚡ Умно обобщение

Предоставяне на данни в SAP HANA зарежда данни от изходните системи, преди който и да е front-end инструмент да може да ги достигне. Напримерtracт, трансформиране и зареждане от процеса, доставени чрез вградени опции или външни инструменти като SLT, Data Services и DXC.

  • 🔄 Основен процес: Осигуряването създава, подготвя и позволява на мрежата да предоставя данни на своите потребители чрез extract, трансформация и зареждане.
  • Вградени опции: Плосък файл, интелигентно поточно предаване на данни, интелигентен достъп до данни, управление на корпоративна информация и отдалечени данни.
  • 🔌 Външни инструменти: SAP Трансформация на ландшафта, Услуги за данни за бизнес обекти, Директно изключванеtracTor връзка и Sybase Replication Server.
  • Сила на SLT: Репликация в реално време и по график от двете SAP и не-SAP изходни системи.
  • Услуги за данни: Графична платформа за проектиране на ETL процеси в хетерогенни източници.
  • 📦 DXC Природа: Директно изключванеtracTor Connection е пакетно управляван ETL маршрут, използващ повторно съществуваща BW extracтори.
  • 🔗 Предварителни изисквания за SLT: RFC или връзка към база данни с източника и връзка към база данни с SAP ХАНА.

Осигуряване и репликация на данни в SAP ХАНА

Какво е DATA Provisioning?

Предоставянето на ДАННИ е процес на създаване, подготовка и активиране на мрежата да предоставя данни на своя потребител. Данните трябва да бъдат заредени до SAP HANA, преди данните да достигнат до потребителя чрез инструмент отпред.

Всички тези процеси се наричат ETL (Примерtract, трансформация и зареждане), а подробностите са както следва -

  • Extracт - Това е първата и понякога най-трудната част от ETL, в която данните се предават.tracполучени от различната изходна система.
  • трансформация – В частта за трансформация се дефинира серия от правила или функции за данните, напримерtracизтеглени от изходната система, за зареждане на данни в целевата система.
  • Заредете – Фазата на зареждане зарежда данните в целевата система.

защото SAP HANA съхранява данни в паметта и често се използва за отчитане в реално време. Изборът на метод за предоставяне на данни има пряк ефект върху това колко актуални са данните в отчета. Този избор се разглежда след изброяване на наличните инструменти.

Репликация в SAP ХАНА

SAP HANA поддържа два вида инструменти за осигуряване –

  1. SAP HANA вграден инструмент за осигуряване
    1. Плосък файл
    2. Интелигентно поточно предаване на данни
    3. Интелигентен достъп до данни (SDA)
    4. Управление на корпоративната информация (EIM)
    5. Дистанционни данни
  2. Външен инструмент, поддържан от SAP ХАНА
    1. SAP Пейзажна трансформация
    2. SAP Услуги за данни на бизнес обекти
    3. SAP Директно изключванеtracвръзка с Tor
    4. Сървър за репликация на Sybase

Понастоящем има основни методи за предоставяне на данни за SAP HANA, това са –

Методи за предоставяне на данни Descriptйон
SLT SLT ( "SAP Landscape Transformation Replication Server”), работещ на SAP Платформа Net Weaver. SLT е идеално решение за репликация в реално време и по график за SAP и не-SAP изходна система.
SAP DATA Услуги SAP DATA Услуги е платформа за проектиране на ETL процеси с графичен потребителски интерфейс.
DXC DXC означава Direct ExtracTor Connect е ETL инструмент, управляван от пакети.
Качване на плосък файл Тази опция се използва за качване на данни (.csv, .xls, .xlsx) в SAP ХАНА.

SAP Пътна карта на HANA SLT

SAP Пътната карта на HANA SLT е следната – Предоставянето на ДАННИ чрез SLT изисква RFC/DB връзка към SAP/Не-SAP Изходна система и DB връзка за SAP HANA база данни. включено SAP SLT сървър, ние дефинираме Картаping и трансформация. По-долу е дадена пътна карта за предоставяне на данни чрез SLT.

SAP Пътна карта на HANA SLT
SAP Пътна карта на HANA SLT

Сравняване на SLT, услуги за данни, DXC и плосък файл

Четирите основни метода не са взаимозаменяеми. Всеки е проектиран за различно изискване за латентност и различен вид източник, което таблицата ясно показва.

Параметър SLT SAP Услуги за данни DXC Плосък файл
латентност В реално време или по график Партида, планирана Партида, планирана Ръчно, еднократно
Изходни системи SAP и не-SAP бази данни Почти всеки източник, включително файлове и уеб услуги SAP Само бизнес апартамент CSV, XLS, XLSX
Трансформация Просто, базирано на правила по време на репликация Богати графични трансформации Прилага се от съществуващия бившtracTor None
Семантиката е запазена Само на ниво таблица Както е проектирано в заданието Да, бизнес семантика на бившияtracTor None
Усилие за настройка Среден, изисква SLT сървър Високо, изисква ландшафт за услуги за данни Ниско, където ехtracсъществуват Много ниско
Типична употреба Operaционално отчитане на реални транзакции Консолидиране на хетерогенни източници Повторно използване на съществуващ BW extracлогика на Тор Прототиping и малки таблици за търсене

Всеки има специален урок: SLT, SAP Услуги за данни, DXC, и качване на плосък файл.

Интелигентен достъп до данни и интелигентна интеграция на данни

Вграденият списък по-горе включва две опции, които се държат различно от останалите, защото те могат да избегнат копирането на данни изобщо.

Интелигентен достъп до данни (SDA). SDA създава виртуална таблица в SAP HANA, която сочи към таблица в отдалечена система. Не се репликират данни. Когато заявка докосне виртуалната таблица, HANA прехвърля колкото е възможно повече от работата към отдалечената база данни и извлича само резултата. Предимството е, че разходите за съхранение са нулеви и данните са винаги актуални. Ограничението е, че скоростта на заявката вече зависи от отдалечената система, така че бавен източник прави бързия HANA отчет бавен.

Интелигентна интеграция на данни (SDI). SDI разширява идеята с адаптери, които могат също да репликират, или на партиди, или чрез заснемане на промени в данните, и да прилагат трансформации по пътя. Всъщност, това внася голяма част от това, което Data Services предлага, в самата HANA, премахвайки необходимостта от отделен ETL пейзаж за по-малки проекти.

Изборът между трите семейства се свежда до три въпроса:

  • Колко актуални трябва да бъдат данните? Точките в реално време при SLT или SDI променят заснемането на данни; нощта е достатъчна за услуги за данни или DXC.
  • Необходимо ли е изобщо да се копират данните? Ако рядко се запитва и се намира в подходяща база данни, SDA избягва дублирането изцяло.
  • Колко трансформация е необходима? Простото филтриране е подходящо за SLT; сложното почистване, дедупликацията и търсенето са подходящи за Data Services.

След като данните са получени, те се отчитат чрез информационните изгледи, описани в SAP HANA моделиране настойнически.

Въпроси и Отговори

Репликацията копира редове в HANA, така че заявките са бързи и се изразходва място за съхранение. Виртуализацията чрез SDA оставя данните в източника и ги чете при поискване, като скоростта се търгува за валута.

Да, и повечето ландшафти го правят. SLT обикновено обработва активни транзакционни таблици, докато Data Services консолидира външни източници за една нощ, като всеки записва в различни схеми.

Изкуственият интелект профилира данните от източника преди зареждане, откривайки дубликати, несъответстващи формати и липсващи ключове, така че проблемите се коригират при източника, вместо да се появяват в отчет седмици по-късно.

Да. Откриването на аномалии в броя на редовете и времето за зареждане сигнализира за репликация, която е спряла или се е забавила, което често е невидимо, докато отчет не покаже данните от вчера.

За прототипping, малки справочни таблици и еднократни зареждания. Изпълнява се ръчно и е неповторимо, така че никога не трябва да се намира в производствен поток от данни, който трябва да се изпълнява по график.

Обобщете тази публикация с: