Csillagséma és kiterjesztett csillagséma SAP BI/BW

⚡ Okos összefoglaló

Csillagséma és kibővített csillagséma a SAP A BW tény- és dimenziótáblákba rendezi az adatokat, ahol a kibővített modell SID-táblákon keresztül összekapcsolja a dimenziókat a törzsadatokkal, lehetővé téve a sokkal nagyobb elemzési mélységet és a törzsadatok újrafelhasználását.

  • Klasszikus csillagrendszer: Egy központi ténytábla, amelyet dimenziótáblák vesznek körül, amelyek a kockán belüli törzsadatokat tárolják.
  • 🔗 Kiterjesztett csillagrendszer: A SID táblák a dimenziókat a kockán kívül tárolt törzsadatokhoz kapcsolják az újrafelhasználás érdekében.
  • 📐 Elemzés mélysége: A kibővített modell 16 dimenzió szorzatát teszi lehetővé 248 SID táblával a gazdagabb elemzés érdekében.
  • 🔑 SID-táblázatok: A helyettesítő azonosítók dimenziótáblákat kapcsolnak az attribútum-, szöveg- és törzsadattáblákhoz.
  • 📊 Tény táblázat: Egy ténytábla kulcsmutatókat tartalmaz, és akár 233 mérhető kulcsmutatót is támogat.
  • 🤖 AI segítség: AI és SAP A HANA optimalizálja ezeket a modelleket gyors, nagyméretű analitikai lekérdezésekhez.

Csillagséma és kiterjesztett csillagséma a SAP BI/BW

Mi az a séma?

Egy adatbázis-kezelő rendszerben (DBMS) a séma a relációs adatbázist képviseli. Meghatározza a táblákat, az egyes táblákban található mezőket, valamint a mezők és táblák közötti kapcsolatokat. Más szóval, a séma adatbázis-objektumok gyűjteménye, beleértve a táblákat, nézeteket, indexeket és szinonimákat. A sémákat általában egy adatszótárban tárolják.

Mi a klasszikus csillagséma?

A klasszikus csillagséma egy többdimenziós adatmodell. Egy központi elemen alapul. ténytáblázat több, csillag alakú mérettáblázat veszi körül (innen a név).

Az InfoCube több részből áll InfoObjects (jellemzők és kulcsadatok), és a csillagséma szerint van strukturálva. Van egy nagyméretű ténytábla az InfoCube kulcsadataival, amelyet számos dimenziótábla vesz körül, amelyek a csillagot alkotják. Egy ténytábla legfeljebb 16 dimenziót tartalmazhat.

A csillagséma előnyei az adatok egyszerű szeletelése, a könnyű megértés és a jobb teljesítmény.

Csillagséma SAP BI/BW

Mi a kiterjesztett csillagséma?

A kibővített csillagsémában a „ténytábla” és a „törzsadattábla” egy SID (helyettesítő azonosító) táblán keresztül kapcsolódik. A ténytábla és a dimenziótábla a kockán belül található, míg a törzsadatok azon kívül. Elemzési kapacitása 16 × 248 (SID táblák). A ténytábla kicsi, a dimenziótábla pedig nagy, ellentétben a klasszikus csillagsémával. A kibővített csillagséma alatt a dimenziótábla nem tartalmaz törzsadatokat.

Kiterjesztett csillagséma be SAP BI/BW

A kiterjesztett csillagséma különböző összetevői a következők:

  1. Az attribútumtábla a törzsadatok attribútumait tartalmazza.
  2. Az SID tábla minden törzsadatrekordhoz egyedi SID-t (helyettesítő azonosítót) hoz létre.
  3. A dimenziótábla minden egyedi SID-kombinációhoz létrehoz egy DimID-t (legfeljebb 248 SID jellemző fér el egy dimenziótáblában).
  4. A szöveges táblázat a törzsadatok leírásait tartalmazza.
  5. A ténytábla DimID-k és kulcsmutatók egyedi kombinációját tartalmazza (legfeljebb 233 kulcsmutató fér el egy ténytáblában).

Kiterjesztett csillagséma be SAP BI/BW

Az alábbi példa arra mutat be, hogyan néz ki egy InfoCube ténytáblája.

Kiterjesztett csillagséma be SAP BI/BW

Az alábbiakban a dimenzió- és SID-táblázatok láthatók.

Kiterjesztett csillagséma be SAP BI/BW

Az alábbiakban az InfoObject törzsadat- és szövegtáblái láthatók.

Kiterjesztett csillagséma be SAP BI/BW

InfoCube: Minta kiterjesztett csillagsémára

A következő egy példa egy InfoCube-ra, amely a kibővített csillagsémát mutatja.

Az InfoCube kibővített csillagsémájának lépései:

  1. Az InfoCube ténytáblázatának értéke 3.
  2. A ténytábla értéke („3”) a dimenziótáblában van leképezve.
  3. A „3” dimenzióazonosító egy SID-t tartalmaz a SID táblázatban.
  4. Az SID értékét a szöveges és a törzsadattáblázatokhoz rendeli a rendszer.

InfoCube minta kiterjesztett csillagsémára

GYIK

Egy SID (Surrogate ID) tábla minden törzsadatértékhez egy rövid, egyedi egész kulcsot rendel. A kibővített csillagsémában az SID táblák dimenziótáblákat kapcsolnak össze törzsadat-, szöveg- és attribútumtáblákkal, javítva az illesztési teljesítményt és az újrafelhasználhatóságot.

A törzsadatok az InfoCube-on kívül, külön attribútum-, szöveg- és SID-táblázatokban tárolódnak, nem a dimenziótáblákban. Ez az elkülönítés lehetővé teszi, hogy ugyanazokat a törzsadatokat több InfoCube-on is újra felhasználhassuk a duplikáció helyett.

A ténytábla a mérhető kulcsadatokat és a dimenziókhoz kapcsolódó DimID-ket tárolja. A dimenziótábla a kapcsolódó jellemzőket csoportosítja, és SID-táblákon keresztül kapcsolódik a azokat leíró törzsadatokhoz. A ténytáblák nagyok; a dimenziótáblák kisebbek.

Igen. SAP A HANA és a gépi tanulás elemzi a lekérdezési mintákat, hogy aggregációkat, particionálást és modellmódosításokat javasoljon. SAP A Datasphere és az Analytics Cloud esetében a mesterséges intelligencia további modelleket javasol, és az alapul szolgáló sémából nyeri ki az információkat.

A gépi tanulás tiszta, strukturált tény- és dimenzióadatokat olvas be az előrejelzési és anomáliaészlelési modellek betanításához. A csillagséma konzisztens kulcsai és törzsadatai megbízható alapot biztosítanak a mesterséges intelligencia által vezérelt elemzéshez és tervezéshez.

Foglald össze ezt a bejegyzést a következőképpen: