Teradata-opetusohjelma: Tietokanta Archirakenne ja tyypit

⚡ Älykäs yhteenveto

Teradata SQL toimii massiivisesti rinnakkaisessa relaatiotietokannassa, joka on rakennettu yritystason tietovarastointia varten. Tällä sivulla selitetään jäsennysmoottori, BYNET ja AMP-arkkitehtuuri, tuetut DDL-, DCL- ja DML-komentosarjat sekä käytännön liiketoimintasovellukset.

  • 🏛️ Ydinmääritelmä: Teradata on kaupallinen relaatiotietokannan hallintajärjestelmä, joka on rakennettu massiivisesti rinnakkaiskäsittelyyn, ei avoimen lähdekoodin moottori.
  • ⚙️ Kolme komponenttia: Jäsennysmoottori suunnittelee kyselyt, BYNET siirtää rivejä ja käyttömoduuliprosessorit hakevat omilta levyiltään.
  • 📈 Lineaarinen skaalautuvuus: Solmujen lisääminen lisää läpimenoaikaa suhteellisesti, koska jaettu-ei-mitään-rakenne poistaa kilpailun rinnakkaisten yksiköiden välillä.
  • 🧾 Komentoalueen kattavuus: DDL luo objekteja, DCL myöntää käyttöoikeuksia ja DML valitsee, päivittää ja poistaa rivejä.
  • ☁️ Moderni alusta: Vantage, VantageCloud ja ClearScape Analytics laajentavat moottoria pilvi- ja tietokannan sisäiseen koneoppimiseen.

Teradata opetusohjelma

Mikä on Teradata?

Teradata on kaupallinen relaatiotietokannan hallintajärjestelmä kehittäjilleping laajamittaiset tietovarastointisovellukset. Tämä työkalu tukee useita tietovarastotoimintoja samanaikaisesti rinnakkaisuuden käsitteen avulla. Teradata on massiivisesti rinnakkainen käsittelyjärjestelmä, joka tukee Unix/Linux/Windows palvelinalustoilla.

Teradata-ohjelmiston on kehittänyt Teradata Corporation, joka on amerikkalainen IT-yritys. Se on analytiikkatietoalustojen, -sovellusten ja muiden niihin liittyvien palveluiden toimittaja. Yritys kehittää tuotteen, joka yhdistää eri lähteistä peräisin olevia tietoja ja antaa tiedon analysoitavaksi.

Miksi Teradata?

  • Teradata tarjoaa täyden valikoiman palveluita, jotka keskittyvät Tietovarastointi
  • Järjestelmä on rakennettu avoimelle arkkitehtuurille. Joten aina kun nopeampia laitteita tulee saataville, se voidaan sisällyttää jo rakennettuun arkkitehtuuriin.
  • Teradata tukee yli 50 petatavua dataa.
  • Yhden toiminnon näkymä suurelle Teradata-monisolmujärjestelmälle Service Workstationilla
  • Yhteensopiva laajan valikoiman kanssa BI työkalu tietojen hakemiseen.
  • Se voi toimia yhtenä ohjauspisteenä DBA:n hallinnassa tietokanta.
  • Korkea suorituskyky, monipuoliset kyselyt, tietokannan sisäinen analytiikka ja hienostunut työkuorman hallinta
  • Teradatan avulla voit saada samat tiedot useista käyttöönottovaihtoehdoista

Nämä edut rakennettiin neljän vuosikymmenen aikana, kuten alla oleva aikajana osoittaa.

Teradatan historia

Caltechin tutkijat, jotka työskentelivät Citibankin kanssa, perustivat Teradatan vuonna 1979. NCR Corporation osti sen vuonna 1991, ja Teradata eriytettiin itsenäiseksi pörssiyhtiöksi lokakuussa 2007, ja Michael Koehler toimi sen ensimmäisenä toimitusjohtajana. Yhtiön pääkonttori sijaitsee San Diegossa, ja toimitusjohtaja Steve McMillan on johtanut sitä vuodesta 2020 lähtien.

Teradata Corporationin virstanpylväät:

  • 1979 – Teradata perustettiin
  • 1984 – Ensimmäinen tietokantatietokone DBC/1012 julkaistiin
  • 1986 – Fortune-lehti julisti Teradatan "Vuoden tuotteeksi"
  • 1991 – NCR Corporation ostaa Teradatan
  • 1999 – Suurin Teradatalla rakennettu tietokanta 130 teratavulla
  • 2002 – Teradata V2R5 -version julkaisu pakkauksella ja Partition Primary
  • 2006 – Teradata Master Data Management -ratkaisun julkaisu
  • 2007 – Teradata eriytyy NCR:stä ja listautuu itsenäiseksi yhtiöksi
  • 2008 – Teradata 13.0 julkaistiin Active Data Warehousingin kanssa
  • 2011 – Ostaa Teradata Asterin ja sukeltaa Advanced Analytics Spaceen
  • 2012 – Teradata 14.0 esitelty
  • 2014 – Teradata 15.0 esitelty
  • 2015 – Teradata ostaa sovellusmarkkinointialusta Appoxeen
  • 2017 – Teradata ostaa San Diegon StackIQ:n
  • 2018 – Teradata Vantage lanseerataan yhtenäisenä analytiikka-alustana
  • 2022 – VantageCloud Lake julkaistiin pilvinatiiviin analytiikkaan
  • 2023 – ClearScape Analytics lisää tietokannan sisäistä tekoälyä ja koneoppimista skaalautuvasti
  • 2024 – Lisää avoimen taulukkomuodon tuen Apache Icebergille ja Delta Lake ja julkaisee Teradata AI Unlimitedin AWS:lle ja Azure markkinapaikkojen
  • 2025 – Julkaisee Enterprise Vector Storen, avoimen lähdekoodin MCP-palvelimen, ja AgentBuilderin tukemaan agenttisia tekoälytyökuormia
  • 2026 – Teradatan autonominen tietopankkialusta julkistettiin toukokuussa ja tuli yleisesti saataville heinäkuussa pilvi-, paikallisissa ja hybridiympäristöissä.

Seuraavaksi tässä Teradata-opetusohjelmassa opimme Teradatan ominaisuuksista.

Teradata SQL:n ominaisuudet

Teradata tarjoaa seuraavat tehokkaat ominaisuudet:

  • Lineaarinen skaalautuvuus: Tarjoaa lineaarisen skaalautuvuuden käsiteltäessä suuria tietomääriä lisäämällä solmuja järjestelmän suorituskyvyn parantamiseksi.
  • Rajoittamaton rinnakkaisuus: Teradata perustuu MPP:hen (Massively Parallel Processing Architektuuri). Joten se on suunniteltu rinnakkaiseksi alusta alkaen. Se voi jakaa suuren tehtävän pienempiin tehtäviin ja suorittaa niitä rinnakkain
  • Aikuisille suunnattu optimoija: Teradata Optimizer voi käsitellä jopa 64 liitosta kyselyssä.
  • Matala TCO: Teradatan kokonaiskustannukset ovat alhaiset. Se on helppo asentaa, ylläpitää ja hallinnoida.
  • Load & Unload -apuohjelmat: Teradata tarjoaa lataus- ja purkuapuohjelmia tietojen siirtämiseksi Teradata System -järjestelmään tai sieltä.
  • Liitettävyys: Tämä MPP-järjestelmä voi muodostaa yhteyden kanavaan liitettyihin järjestelmiin, kuten keskuskoneeseen tai verkkoon liitettyihin järjestelmiin.
  • SQL: Teradata tukee SQL vuorovaikutuksessa taulukoihin tallennettujen tietojen kanssa. Se tarjoaa sen laajennuksen.
  • Vahvat apuohjelmat: Teradata tarjoaa vankkoja apuohjelmia tietojen tuomiseksi/viemiseksi Teradata-järjestelmistä, kuten FastExport, FastLoad, MultiLoad ja TPT.
  • Automaattinen jakelu: Teradata voi jakaa tiedot levyille automaattisesti ilman manuaalista puuttumista.

Seuraavaksi tässä Teradata SQL -opetusohjelmassa opimme Teradatasta Archirakenne.

Teradata Archirakenne

Teradata-arkkitehtuuri on Massively Parallel Processing Archirakenne.

Teradatan kolme tärkeää osaa ovat:

  • Jäsennysmoottori
  • BYNET
  • Access Module Processors (AMP:t)

Teradata-tallennus Architecture tietokanta Archirakennekaavio:

Teradata Archirakenne
Teradata Architecture Kaavio

Yllä oleva kaavio traclähettää pyynnön jäsennysmoottorilta BYNETin kautta levyjä omistaville AMP:ille. Kaksi alla olevaa alakohtaa seuraavat tätä polkua kumpaankin suuntaan.

Teradata-tallennus Archirakenne

Jäsennysmoottori:

Jäsennysmoottori jäsentää kyselyt ja valmistelee suoritussuunnitelman. Se hallitsee istuntoja käyttäjille. Se optimoi ja lähettää pyynnön käyttäjille.

Joten kun asiakas suorittaa kyselyitä tietueiden lisäämiseksi, jäsennysmoottori lähettää tietueet Viestin välitystasolle. Viestinvälityskerros eli BYNET on ohjelmisto- ja laitteistokomponentti. Se tarjoaa verkostoitumismahdollisuuden. Se myös noutaa tietueet ja lähettää rivin kohde-AMP:hen.

AMP:

AMP tulee sanoista Access Module Processor. Se tallentaa tietueita näille levyille. AMP suorittaa seuraavia toimintoja:

  • Hallitsee osaa tietokannasta
  • Hallitsee osaa kustakin taulukosta
  • Suorita kaikki tulosjoukon luomiseen liittyvät tehtävät, kuten lajittelu, yhdistäminen ja liittäminen
  • Suorita lukon ja tilan hallinta

Teradatan haku Archirakenne

Kun asiakas suorittaa kyselyitä tietueiden noutamiseksi, jäsennysmoottori lähettää pyynnön BYNETille. Sitten BYNET lähettää hakupyynnön asianmukaisille AMP:ille.

AMP:t etsivät levyitään rinnakkain ja tunnistavat tarvittavat tietueet ja lähettävät ne BYNETiin. BYNET lähettää tietueet jäsennysmoottorille, joka puolestaan ​​​​lähetetään asiakkaalle.

Seuraavaksi tässä Teradata Database -opetusohjelmassa opimme Teradata SQL -komennoista.

Teradata SQL -komentojen tyypit

Teradata Database tukee seuraavia SQL-peruskomentoja:

  1. Data Definition Language (DDL) -komennot
  2. Data Control Language (DCL) -komennot
  3. Data Manipulation Language (DML) -komennot

Datan määrittelykielen komennot

COMMAND Tuotetiedot
LUODA Luo uuden tietokannan, taulukon, käyttäjän jne.
DROP Poistaa uuden tietokannan, taulukon, käyttäjän jne.
MUUTTAA Muuttaa taulukkoa, saraketta, liipaisinta jne.
MUUTTAA Muuttaa tietokannan tai käyttäjän määritelmää
NIMEÄ UUDELLEEN Muuttaa taulukoiden, näkymien, makrojen jne. nimeä.

Tiedonhallintakielen komennot

COMMAND Tuotetiedot
MYÖNTÄ/PERUUTA Käytetään hallitsemaan käyttäjän oikeuksia objektiin
MYÖNTÄ KIRJAUDU/POISTA KIRJAUDU Käytetään isännän tai isäntäryhmän kirjautumisoikeuksien hallitsemiseen
ANTAA Käytetään antamaan tietokantaobjekti toiselle tietokantaobjektille

Teradata-tietokannan SQL-tiedonkäsittelykielen komennot

COMMAND Tuotetiedot
POISTA Poistaa rivin taulukosta
ECHO Käytetään toistamaan merkkijono tai komento asiakkaalle
TARKASTUSPISTE Määrittää kirjauskansion palautuspisteen, jota voidaan käyttää myöhemmin taulukon sisällön palauttamiseen
VALITSE Käytetään tietyn rivin tietojen palauttamiseen taulukkomuodossa
PÄIVITYS Muokkaa tietoja yhdellä tai useammalla taulukon rivillä

Teradata-tuotepaketti ja käyttöönottovaihtoehdot

Nuo komennot toimivat samalla tavalla riippumatta siitä, minkä version alla se on, koska Teradata toimittaa yhden moottorin useille eri toimitusmalleille.

  • Teradata Vantage: Ydinalusta, joka yhdistää SQL-moottorin, työkuormituksen hallinnan ja liittimet objektitallennukseen.
  • VantageCloud-yritys: Hallittu käyttöönotto AWS:ssä Azuretai Google Cloud varastoille, jotka muuttavat pois omistamansa laitteiston.
  • VantageCloud-järvi: Pilvinatiivi, objektitallennukseen keskittyvä versio, jossa on itsenäiset laskentaklusterit joustavia työkuormia varten.
  • ClearScape Analytics: Tietokannan sisäinen taso suorittaa koneoppimista ja aikasarjafunktioita datan rinnalla.
  • Paikallinen IntelliFlex: Tarkoin rakennettu laitteisto säännellyille työkuormille, joiden on pysyttävä yksityisessä datakeskuksessa.

Koska yksi SQL-lauseke toimii muuttumattomana kaikissa näissä versioissa, hybridikiinteistöt ovat yleisiä.

Teradata-tietokannan sovellukset

Seuraavat ovat suosittuja Teradata-sovelluksia:

  • Asiakastietojen hallinta: Auttaa ylläpitämään pitkäaikaisia ​​asiakassuhteita.
  • Perustietojen hallinta: Auttaa kehittämään ympäristön, jossa päätietoja voidaan käyttää, synkronoida ja tallentaa.
  • Talous- ja tuloshallinta: Auttaa organisaatiota parantamaan taloudellisen raportoinnin nopeutta ja laatua. Se vähentää rahoitusinfrastruktuurin kustannuksia ja hallitsee ennakoivasti yrityksen suorituskykyä.
  • Toimitusketjun hallinta: Paranna toimitusketjun toimintoja, mikä auttaa parantamaan asiakaspalvelua, lyhentämään kiertoaikoja ja pienentämään varastoja.
  • Kysyntäketjun hallinta: Auttaa lisäämään asiakaspalvelun tasoa ja myyntiä. Se myös auttaa yrityksiä ennustamaan tarkasti myymälätuotteensa kysynnän.

Seuraavaksi tässä Teradata aloittelijoille -opetusohjelmassa opimme erosta Teradatan ja muiden välillä RDBMS.

Ero Teradatan ja muiden RDBMS:ien välillä

Parametri Teradata RDBMS
Architektuurit Seuraa jaettua ei mitään Archirakenne. Jaettu kaikki ja sallii resurssikilpailun.
prosessit MIPS [miljoonia ohjeita/s] KIPS [Tuhansia ohjeita/sekunti]
Indexes Parempi jakelu ja haku Tarjoaa vain FASI-haun
rinnakkaisuus Tukee ehdotonta rinnakkaisuutta. Rinnakkaisuus on ehdollista ja arvaamatonta
Bulkkikuorma Teradata sallii bulkkikuorman. Sallii vain rajoitetun bulkkikuorman.
skaalautuvuus Lineaarinen skaalautuvuus yhden kaltevuuden kanssa Skaalautuvuus pienenevällä tuotolla
Tietokantapuskuri Yksi tietokantapuskuri, jota kaikki käyttäjät käyttävät (rinnakkaisuusyksikkö). Yksi tietovarasto, johon kaikki käyttäjät pääsevät käsiksi. Query Controller toimittaa toimintoja UoP:ille, jotka omistavat tiedot
Varastot Se tallentaa TERABYTTEJÄ [Billrivien ionit] GIGATAVUA [Miljoonia rivejä]

Yllä oleva jaettu-ei-mitään-rivi riippuu seuraavaksi verrattavasta käsittelymallista.

MPP vs. SMP

MPP SMP
MPP – Massively Parallel Processing. Se on tietokonejärjestelmä, joka on liitetty useisiin itsenäisiin aritmeettisiin yksiköihin tai kokonaisiin mikroprosessoreihin, jotka toimivat rinnakkain. Symmetrinen monikäsittely. SMP-prosessointijärjestelmässä CPU:t jakavat saman muistin, minkä seurauksena yhdessä järjestelmässä ajettava koodi voi vaikuttaa toisen käyttämään muistiin.
Tietokannat voivat laajentua lisäämällä uusia suorittimia. SMP-tietokannat käyttävät yleensä yhtä CPU:ta tietokantahakujen suorittamiseen.
MPP-ympäristössä suorituskyky paranee, koska resursseja ei tarvitse jakaa fyysisten tietokoneiden kesken. Rinnakkaistyön työmäärä on hajautettu järjestelmän prosessoreille.
Massiivisen rinnakkaiskäsittelyjärjestelmän suorituskyky on lineaarinen. Se kuitenkin kasvaa suhteessa solmujen määrään. SMP-tietokannat voivat toimia useilla palvelimilla. Kuitenkin jakaa toinen resurssi.

UKK

Ensisijainen indeksi päättää, mikä AMP tallentaa kunkin rivin. Teradata hajauttaa indeksisarakkeen ja reitittää rivin vastaavaan AMP:hen, joten hyvin valittu indeksi levittää datan tasaisesti ja välttää vääristymän.

Teradata Studio on nykyinen graafinen asiakasohjelma, joka korvaa vanhemman SQL Assistantin. BTEQ käsittelee komentosarjoilla tehtävää erätyötä terminaalista, ja tavalliset ODBC- tai JDBC-ajurit yhdistävät kolmannen osapuolen palvelimet. BI-työkalut.

Tuotantoympäristö on lisensoitu kaupallisesti, mutta Teradata tarjoaa ilmaisen ClearScape Analytics Experience -ympäristön ja kehittäjille tarkoitettuja kokeilujaksoja, jotka riittävät SQL:n, indeksoinnin ja kyselysuunnittelun harjoitteluun.

ClearScape Analytics suorittaa koneoppimis-, pisteytys- ja aikasarjafunktioita SQL-lausekkeina suoraan tallennetuille riveille. Keepping Datan vieressä olevat mallit poistavat vientivaiheet ja antavat ennusteiden käyttää koko varastoa otoksen sijaan.

Tekoälyavustajat luonnostelevat kyselyitä ja ehdottavat indeksointi- tai liittymismuutoksia, mutta optimoijan tilastot ja liiketoimintasäännöt vaativat silti ihmisen tarkistuksen. Käsittele luotua SQL-kyselyä alustavana luonnoksena, älä koskaan tuotantoversiona.

Tiivistä tämä viesti seuraavasti: