Provisioning e replica dei DATI in SAP HANA

โšก Riepilogo intelligente

Fornitura dati in SAP HANA carica i dati dai sistemi sorgente prima che qualsiasi strumento front-end possa accedervi. Es.tracLe fasi di t, trasformazione e caricamento costituiscono il processo, erogato tramite opzioni integrate o strumenti esterni come SLT, Data Services e DXC.

  • ๐Ÿ”„ Processo principale: Il provisioning crea, prepara e abilita una rete a fornire dati ai suoi utenti attraverso extract, trasforma e carica.
  • โš™๏ธ Opzioni integrate: File flat, streaming intelligente dei dati, accesso intelligente ai dati, gestione delle informazioni aziendali e dati remoti.
  • ???? Strumenti esterni: SAP Trasformazione del panorama, Business Objects Data Services, Direct ExtracConnessione Tor e Sybase Replica Server.
  • ๏ธ Forza SLT: Replicazione in tempo reale e programmata da entrambi SAP e nonSAP sistemi sorgente.
  • ๏ธ Servizi dati: Una piattaforma grafica per la progettazione di processi ETL da fonti eterogenee.
  • ๐Ÿ“ฆ Natura DXC: Ex direttotracTor Connection รจ un percorso ETL basato su batch che riutilizza l'ex BW esistentetracTors.
  • ๐Ÿ”— Prerequisiti SLT: Una connessione RFC o al database alla sorgente e una connessione al database a SAP HANA.

Fornitura e replica dei dati in SAP HANA

Cos'รจ il provisioning dei DATI?

Il provisioning dei DATI รจ un processo di creazione, preparazione e abilitazione di una rete a fornire dati ai propri utenti. รˆ necessario caricare i dati SAP HANA prima che i dati raggiungano l'utente tramite uno strumento front-end.

Tutti questi processi sono indicati come ETL (Extract, Trasforma e Carica), e i dettagli sono riportati di seguito-

  • Extract - Questa รจ la prima e a volte la parte piรน difficile dell'ETL, in cui i dati vengono espressitracderivato dal diverso sistema sorgente.
  • Trasforma โ€“ Nella parte di trasformazione, viene definita una serie di regole o funzioni per l'esportazione dei dati.tracdati dal sistema sorgente, per caricare i dati nel sistema di destinazione.
  • Carico - La fase di caricamento carica i dati nel sistema di destinazione.

Perchรฉ SAP HANA memorizza i dati in memoria ed รจ spesso utilizzato per la creazione di report in tempo reale; la scelta del metodo di provisioning ha un impatto diretto sull'attualitร  dei dati presenti in un report. Tale scelta verrร  esaminata dopo aver elencato gli strumenti disponibili.

Replica dentro SAP HANA

SAP HANA supporta due tipi di strumenti di provisioning:

  1. SAP Strumento di provisioning integrato di HANA
    1. Archivio base
    2. Streaming intelligente dei dati
    3. Accesso intelligente ai dati (SDA)
    4. Gestione delle informazioni aziendali (EIM)
    5. Dati remoti
  2. Strumento esterno supportato da SAP HANA
    1. SAP Trasformazione del paesaggio
    2. SAP Servizi dati di Business Objects
    3. SAP Ex direttotracConnessione tor
    4. Server di replica Sybase

Attualmente esistono le principali modalitร  di provisioning dei dati SAP HANA, questi sono...

Modalitร  di fornitura dei dati Descrizione
SLT SLT ( 'SAP Landscape Transformation Replication Server") in esecuzione su SAP Piattaforma Net Weaver. SLT รจ una soluzione ideale per la replica in tempo reale e pianificata SAP e nonSAP sistema di origine.
SAP Servizi DATI SAP Servizi DATI รจ una piattaforma per la progettazione di processi ETL con un'interfaccia utente grafica.
DXC DXC sta per Direct ExtracTor Connect รจ uno strumento ETL basato su processi batch.
Caricamento di file flat Questa opzione veniva utilizzata per caricare dati (.csv, .xls, .xlsx) su SAP HANA.

SAP Mappa stradale di HANA SLT

SAP La road map di HANA SLT รจ la seguente: il provisioning dei DATI tramite SLT richiede una connessione RFC/DB SAP/Non-SAP Sistema di origine e una connessione DB per SAP Banca dati HANA. SU SAP server TLS, definiamo Mappaping e Trasformazione. Di seguito รจ riportata una roadmap per il provisioning dei dati tramite SLT.

SAP Mappa stradale di HANA SLT
SAP Mappa stradale di HANA SLT

Confronto tra SLT, servizi dati, DXC e file flat

I quattro metodi principali non sono intercambiabili. Ciascuno รจ stato progettato per soddisfare requisiti di latenza differenti e per un diverso tipo di sorgente, come chiaramente illustrato nella tabella.

Parametro SLT SAP Servizi dati DXC Archivio base
Latenza In tempo reale o programmato Lotto, programmato Lotto, programmato Manuale, pezzo unico
Sistemi di origine SAP e nonSAP banche dati Quasi tutte le fonti, inclusi file e servizi web. SAP Solo suite business CSV, XLS, XLSX
Trasformazione Semplice, basato su regole durante la replicazione Ricche trasformazioni grafiche Applicato dall'ex esistentetractor Nona
Semantica preservata Solo livello del tavolo Come previsto nel lavoro Sรฌ, la semantica commerciale dell'extractor Nona
Sforzo di installazione Medio, richiede un server SLT Elevato, necessita di un panorama di servizi dati Basso dove extracesistono tori Molto basso
Utilizzo tipico Operareportistica nazionale sulle transazioni in tempo reale Consolidamento di fonti eterogenee Riutilizzo di BW esistente extraclogica toro Prototipoping e piccole tabelle di ricerca

Ciascuno ha un tutorial dedicato: SLT, SAP Servizi dati, DXCe caricamento di file flat.

Accesso intelligente ai dati e integrazione intelligente dei dati

L'elenco predefinito qui sopra include due opzioni che si comportano in modo diverso dalle altre, perchรฉ possono evitare del tutto la copia dei dati.

Accesso intelligente ai dati (SDA). SDA crea una tabella virtuale in SAP HANA punta a una tabella in un sistema remoto. Nessun dato viene replicato. Quando una query accede alla tabella virtuale, HANA delega la maggior parte del lavoro al database remoto e recupera solo il risultato. Il vantaggio รจ che i costi di archiviazione sono pari a zero e i dati sono sempre aggiornati. Il limite รจ che la velocitร  delle query ora dipende dal sistema remoto, quindi una sorgente lenta renderร  lento anche un report HANA veloce.

Integrazione intelligente dei dati (SDI). SDI estende il concetto con adattatori in grado di replicare i dati, sia in modalitร  batch che tramite acquisizione dei dati modificati, e di applicare trasformazioni lungo il percorso. In pratica, integra gran parte delle funzionalitร  offerte da Data Services all'interno di HANA stesso, eliminando la necessitร  di un ambiente ETL separato per i progetti di dimensioni ridotte.

La scelta tra le tre famiglie si riduce a tre domande:

  • Quanto devono essere aggiornati i dati? Acquisizione dei dati di modifica in tempo reale dei punti SLT o SDI; per Data Services o DXC รจ sufficiente una notte.
  • รˆ necessario copiare i dati? Se i dati vengono interrogati raramente e risiedono in un database adeguato, SDA evita completamente la duplicazione.
  • Quanta trasformazione รจ necessaria? Il filtraggio semplice รจ adatto a SLT; la pulizia complessa, la deduplicazione e le ricerche sono piรน adatte a Data Services.

Una volta che i dati sono arrivati, vengono esposti alla creazione di report attraverso le viste informative descritte nel SAP Modellazione HANA tutorial.

DOMANDE FREQUENTI

La replica copia le righe in HANA, quindi le query sono veloci e lo spazio di archiviazione viene utilizzato. La virtualizzazione tramite SDA lascia i dati nella sorgente e li legge su richiesta, sacrificando velocitร  e denaro.

Sรฌ, e la maggior parte degli ambienti lo fa. SLT in genere gestisce le tabelle transazionali in tempo reale, mentre Data Services consolida le fonti esterne durante la notte, ognuna scrivendo su schemi diversi.

L'intelligenza artificiale analizza i dati di origine prima di caricarli, rilevando duplicati, formati incoerenti e chiavi mancanti, in modo che i problemi vengano corretti alla fonte anzichรฉ emergere in un report settimane dopo.

Sรฌ. Il rilevamento delle anomalie nel conteggio delle righe e nei tempi di caricamento segnala una replica bloccata o rallentata, problema che spesso non si nota finchรฉ un report non mostra i dati del giorno precedente.

Per il prototipoping, piccole tabelle di riferimento e caricamenti una tantum. รˆ manuale e non ripetibile, quindi non dovrebbe mai essere inserito in un flusso di dati di produzione che deve essere eseguito secondo una pianificazione.

Riassumi questo post con: