Hvězdné schéma a rozšířené hvězdné schéma v SAP BI/BW

⚡ Chytré shrnutí

Hvězdné schéma a rozšířené hvězdné schéma v SAP BW organizuje data do tabulek faktů a dimenzí, kde rozšířený model propojuje dimenze s kmenovými daty prostřednictvím tabulek SID, což umožňuje mnohem větší hloubku analýzy a opětovné použití kmenových dat.

  • Klasické hvězdné schéma: Centrální faktická tabulka obklopená tabulkami dimenzí, které obsahují kmenová data uvnitř krychle.
  • 🔗 Rozšířené hvězdicové schéma: Tabulky SID propojují dimenze s kmenovými daty uloženými mimo krychli pro opětovné použití.
  • 📐 Hloubka analýzy: Rozšířený model umožňuje 16 dimenzí krát 248 tabulek SID pro bohatší analýzu.
  • 🔑 Tabulky SID: Náhradní ID propojují tabulky dimenzí s tabulkami atributů, textu a hlavních dat.
  • 📊 Tabulka faktů: Tabulka faktů obsahuje klíčové ukazatele a podporuje až 233 měřitelných klíčových ukazatelů.
  • 🤖 Asistence AI: AI a SAP HANA optimalizuje tyto modely pro rychlé a rozsáhlé analytické dotazy.

Hvězdné schéma a rozšířené hvězdné schéma v SAP BI/BW

Co je to schéma?

V systému správy databází (DBMS) schéma představuje relační databázi. Definuje tabulky, pole v každé tabulce a vztahy mezi poli a tabulkami. Jinými slovy, schéma je kolekce databázových objektů, včetně tabulek, pohledů, indexů a synonym. Schémata jsou obvykle uložena v datovém slovníku.

Co je to klasické hvězdné schéma?

Klasické hvězdicové schéma je vícerozměrný datový model. Je založeno na centrálním tabulka faktů obklopený několika tabulkami rozměrů ve tvaru hvězdy (odtud název).

InfoCube se skládá z několika InfoObjects (charakteristiky a klíčové ukazatele) a je strukturován podle hvězdicového schématu. Pro InfoCube existuje rozsáhlá tabulka faktů s klíčovými ukazateli, obklopená mnoha tabulkami dimenzí, které tvoří hvězdu. Tabulka faktů může mít maximálně 16 dimenzí.

Výhody hvězdicového schématu jsou snadné rozdělení dat, snadná pochopení a lepší výkon.

Hvězdné schéma v SAP BI/BW

Co je rozšířené hvězdicové schéma?

V rozšířeném hvězdicovém schématu jsou „tabulka faktů“ a „tabulka hlavních dat“ propojeny tabulkou SID (náhradní ID). Tabulka faktů a tabulka dimenzí se nacházejí uvnitř krychle, zatímco hlavní data se nacházejí vně ní. Má analytickou kapacitu 16 × 248 (tabulky SID). Tabulka faktů je malá a tabulka dimenzí velká, na rozdíl od klasického hvězdicového schématu. V rozšířeném hvězdicovém schématu tabulka dimenzí neobsahuje hlavní data.

Rozšířené hvězdné schéma v SAP BI/BW

Různé komponenty rozšířeného hvězdicového schématu jsou:

  1. Tabulka atributů obsahuje atributy kmenových dat.
  2. Tabulka SID vytváří pro každý záznam kmenových dat jedinečné SID (náhradní ID).
  3. Tabulka dimenzí vytváří DimID pro každou jedinečnou kombinaci SID (v tabulce dimenzí lze umístit maximálně 248 charakteristik SID).
  4. Textová tabulka obsahuje popisy kmenových dat.
  5. Tabulka faktů obsahuje jedinečnou kombinaci DimID a klíčových ukazatelů (v tabulce faktů lze umístit maximálně 233 klíčových ukazatelů).

Rozšířené hvězdné schéma v SAP BI/BW

Níže je uveden příklad, jak vypadá tabulka faktů v InfoCube.

Rozšířené hvězdné schéma v SAP BI/BW

Níže jsou uvedeny tabulky dimenzí a SID.

Rozšířené hvězdné schéma v SAP BI/BW

Níže jsou uvedeny tabulky s kmenovými daty a textem InfoObject.

Rozšířené hvězdné schéma v SAP BI/BW

InfoCube: Ukázkové rozšířené hvězdicové schéma

Následuje příklad InfoCube zobrazující rozšířené hvězdicové schéma.

Kroky vysvětlující rozšířené hvězdicové schéma InfoCube:

  1. Tabulka faktů v InfoCube má hodnotu 3.
  2. Hodnota tabulky faktů („3“) je namapována v tabulce dimenzí.
  3. ID dimenze „3“ má SID namapované v tabulce SID.
  4. Hodnota SID je namapována na textové a kmenové datové tabulky.

Ukázka rozšířeného hvězdicového schématu InfoCube

Nejčastější dotazy

Tabulka SID (náhradní ID) přiřazuje krátký, jedinečný celočíselný klíč každé hodnotě hlavních dat. V rozšířeném hvězdicovém schématu propojují tabulky SID tabulky dimenzí s tabulkami hlavních dat, textu a atributů, čímž zlepšují výkon spojení a opětovné použití.

Hlavní data jsou uložena mimo InfoCube v samostatných tabulkách atributů, textu a SID, nikoli uvnitř tabulek dimenzí. Toto oddělení umožňuje opakované použití stejných hlavních dat v mnoha InfoCube, místo aby se duplikovala.

Tabulka faktů ukládá měřitelné klíčové ukazatele a DimID, které odkazují na dimenze. Tabulka dimenzí seskupuje související charakteristiky a propojuje se prostřednictvím tabulek SID s kmenovými daty, která je popisují. Tabulky faktů jsou velké; tabulky dimenzí jsou menší.

Ano. SAP HANA a strojové učení analyzují vzory dotazů a doporučují agregace, dělení a změny modelů. SAP V rámci Datasphere a Analytics Cloudu umělá inteligence dále navrhuje modely a zjišťuje poznatky z podkladového schématu.

Strojové učení čte čistá, strukturovaná faktická a dimenzní data pro trénování modelů pro předpovídání a detekci anomálií. Konzistentní klíče a hlavní data hvězdicového schématu z něj činí spolehlivý základ pro analýzy a plánování řízené umělou inteligencí.

Shrňte tento příspěvek takto: