Aprovizionarea și replicarea datelor în SAP HANA

⚡ Rezumat inteligent

Furnizarea de date în SAP HANA încarcă datele din sistemele sursă înainte ca orice instrument front-end să le poată accesa. De exemplutract, transforma și încărca din proces, livrate prin opțiuni încorporate sau instrumente externe precum SLT, Data Services și DXC.

  • 🔄 Proces de bază: Provisioning-ul creează, pregătește și permite unei rețele să furnizeze date utilizatorilor săi prin intermediul unor extract, transformare și încărcare.
  • ⚙️ Opțiuni încorporate: Fișier plat, streaming inteligent de date, acces inteligent la date, gestionarea informațiilor la nivel de întreprindere și date la distanță.
  • 🔌 Instrumente externe: SAP Transformarea peisajului, Servicii de date Business Objects, Direct ExtracConexiune tor și serverul de replicare Sybase.
  • ⏱️ Puterea SLT: Replicare în timp real și programată din ambele SAP și non-SAP sisteme sursă.
  • 🖼️ Servicii de date: O platformă grafică pentru proiectarea proceselor ETL în surse eterogene.
  • 📦 DXC Nature: Expediere directătracConexiunea tor este o rută ETL condusă de batch, reutilizând exemplele BW existente.tractors.
  • 🔗 Cerințe preliminare SLT: O conexiune RFC sau la baza de date către sursă și o conexiune la baza de date către SAP HANA.

Furnizarea și replicarea datelor în SAP HANA

Ce este DATA Provisioning?

Aprovizionarea DATE este un proces de creare, pregătire și activare a unei rețele pentru a furniza date utilizatorului său. Datele trebuie încărcate în SAP HANA înainte ca datele să ajungă la utilizator printr-un instrument front-end.

Toate aceste procese sunt denumite ETL (Extract, Transformare și Încărcare), iar detaliile sunt prezentate mai jos -

  • Extract - Aceasta este prima și uneori cea mai dificilă parte a ETL, în care datele sunt exprimate.tracprovenite din sisteme sursă diferite.
  • Transformă - În partea de transformare, se definește o serie de reguli sau funcții pentru datele ex.tracpreluate din sistemul sursă, pentru încărcarea datelor în sistemul țintă.
  • Sarcină - Faza de încărcare încarcă datele în sistemul țintă.

pentru că SAP HANA păstrează datele în memorie și este frecvent utilizat pentru raportare în timp real, alegerea metodei de furnizare având un efect direct asupra actualității datelor dintr-un raport. Această alegere este examinată după ce sunt listate instrumentele disponibile.

Replicare în SAP HANA

SAP HANA acceptă două tipuri de instrumente de aprovizionare –

  1. SAP Instrument de aprovizionare HANA încorporat
    1. Fișier plat
    2. Streaming inteligent de date
    3. Acces inteligent la date (SDA)
    4. Managementul informațiilor întreprinderii (EIM)
    5. Date de la distanță
  2. Instrument extern susținut de SAP HANA
    1. SAP Transformarea peisajului
    2. SAP Servicii de date Business Objects
    3. SAP Expediere directătracConexiune tor
    4. Sybase Replication Server

În prezent, există metode principale de furnizare a datelor pentru SAP HANA, acestea sunt...

Metode de furnizare a datelor Descriere
SLT SLT ( „SAP Landscape Transformation Replication Server”) care rulează pe SAP Platforma Net Weaver. SLT este o soluție ideală pentru replicarea în timp real și programată pentru SAP și non-SAP sistem sursă.
SAP Servicii DATE SAP Servicii DATE este o platformă pentru proiectarea proceselor ETL cu o interfață grafică cu utilizatorul.
DXC DXC înseamnă Direct Extractor Connect este un instrument ETL bazat pe procesare în loturi.
Încărcare fișier plat Această opțiune este folosită pentru a încărca date (.csv, .xls, .xlsx) în SAP HANA.

SAP Harta rutieră HANA SLT

SAP HANA SLT Road Map este ca mai jos – Aprovizionarea DATE prin SLT necesită o conexiune RFC/DB la SAP/Non-SAP Sistem sursă și o conexiune DB pentru SAP Baza de date HANA. Pe SAP Server SLT, definim Hartaping și Transformare. Mai jos este o foaie de parcurs pentru furnizarea de date prin SLT.

SAP Harta rutieră HANA SLT
SAP Harta rutieră HANA SLT

Compararea SLT, Serviciilor de Date, DXC și Fișierului Plat

Cele patru metode principale nu sunt interschimbabile. Fiecare a fost concepută pentru o cerință de latență diferită și un tip diferit de sursă, lucru clarificat din tabel.

Parametru SLT SAP Servicii de date DXC Fișier plat
Latență În timp real sau programat Lot, programat Lot, programat Manual, o singură dată
Sisteme sursă SAP și non-SAP baze de date Aproape orice sursă, inclusiv fișiere și servicii web SAP Numai Suită Business CSV, XLS, XLSX
Transformare Simplu, bazat pe reguli în timpul replicării Transformări grafice bogate Aplicat de fostul existenttracTdR Nici unul
Semantica păstrată Numai la nivel de tabel Conform proiectului Da, semantica comercială a fostuluitracTdR Nici unul
Efort de configurare Mediu, necesită un server SLT Ridicat, necesită un peisaj de Servicii de Date Scăzut unde extracexistă tori Foarte jos
Utilizare tipică Operaraportare națională privind tranzacțiile în timp real Consolidarea surselor eterogene Reutilizarea ex-urilor BW existentetraclogica tor Prototyping și tabele de căutare mici

Fiecare are un tutorial dedicat: SLT, SAP Servicii de date, DXC și încărcare fișier plat.

Acces inteligent la date și integrare inteligentă a datelor

Lista încorporată de mai sus include două opțiuni care se comportă diferit de celelalte, deoarece pot evita complet copierea datelor.

Acces inteligent la date (SDA). SDA creează un tabel virtual în SAP HANA care indică un tabel dintr-un sistem la distanță. Nu se reproduc date. Când o interogare atinge tabelul virtual, HANA împinge cât mai mult din lucru posibil în baza de date la distanță și preia doar rezultatul. Avantajul este că costul de stocare este zero, iar datele sunt întotdeauna actuale. Limitarea este că viteza interogării depinde acum de sistemul la distanță, astfel încât o sursă lentă face ca un raport HANA rapid să fie lent.

Integrare inteligentă a datelor (SDI). SDI extinde ideea cu adaptoare care se pot replica, fie în lot, fie prin capturarea datelor modificate, și pot aplica transformări pe parcurs. Practic, aduce o mare parte din ceea ce oferă Data Services în interiorul HANA, eliminând necesitatea unui peisaj ETL separat pentru proiectele mai mici.

Alegerea între cele trei familii se reduce la trei întrebări:

  • Cât de actuale trebuie să fie datele? Capturarea datelor privind modificările în timp real la SLT sau SDI; peste noapte este suficientă pentru Data Services sau DXC.
  • Este nevoie neapărat ca datele să fie copiate? Dacă este interogată rar și se află într-o bază de date capabilă, SDA evită complet duplicarea.
  • Câtă transformare este necesară? Filtrarea simplă se potrivește SLT; curățarea complexă, deduplicarea și căutările sunt potrivite pentru Data Services.

Odată ce datele au ajuns, acestea sunt expuse raportării prin intermediul vizualizărilor informațiilor descrise în SAP Modelare HANA tutorial.

Întrebări frecvente

Replicarea copiază rândurile în HANA, astfel încât interogările sunt rapide și spațiul de stocare este consumat. Virtualizarea prin SDA lasă datele în sursă și le citește la cerere, schimbând viteza pentru valută.

Da, și majoritatea peisajelor o fac. SLT gestionează de obicei tabelele tranzacționale live, în timp ce Data Services consolidează sursele externe peste noapte, fiecare scriind în scheme diferite.

IA profilează datele sursă înainte de încărcare, detectând duplicate, formate inconsistente și chei lipsă, astfel încât problemele sunt corectate la sursă, în loc să apară într-un raport săptămâni mai târziu.

Da. Detectarea anomaliilor privind numărul de rânduri și temporizările de încărcare semnalează o replicare care s-a blocat sau a încetinit, lucru adesea invizibil până când un raport nu afișează cifrele de ieri.

Pentru prototipping, tabele de referință mici și încărcări unice. Este manual și irepetabil, deci nu ar trebui să se afle niciodată într-un flux de date de producție care trebuie să ruleze conform unui program.

Rezumați această postare cu: