Datový sklad ukládá integrovaná data z více zdrojů pro účely analýzy. Nejedná se o produkční databázi. Produkční systémy řídí podnikání. Datový sklad podporuje reporting a rozhodování. Data tečou ze zdrojových systémů do skladu prostřednictvím ETL nebo ELT kanálů. Datový sklad čistí, transformuje a organizuje data do schématu optimalizovaného pro dotazy. Analytici a nástroje business intelligence se dotazují skladu namísto produkčních systémů.
Architektura odděluje pracovní zátěže. Spouštění náročných analytických dotazů v produkční databázi zpomaluje aplikace, které zákazníci používají. Databázový sklad tuto zátěž izoluje. Zároveň integruje data. Objednávky zákazníků, tikety podpory a webová aktivita se nacházejí v různých systémech. Databázový sklad je sjednocuje. Z tohoto jednotného pohledu pocházejí poznatky. Tradiční cloudové sklady běžely na specializovaných zařízeních od společností Teradata, Oracle a IBM. Cloudové sklady jako Snowflake, BigQuery a Redshift změnily ekonomiku. Oddělují úložiště od výpočetních výkonů, elasticky škálují a účtují podle využití. Bariéra vstupu klesla. Menší společnosti si nyní mohou dovolit skladovací kapacity, které kdysi vyžadovaly velké kapitálové investice. Technologie se změnila. Účel se změnil: ukládat integrovaná data pro analýzu.
Charakteristiky skladu
- Zaměřeno na předmět – organizované podle obchodních oblastí
- Integrovaný – kombinuje data z více zdrojů
- Časově proměnné – uchovává historická data
- Nevolatilní – data se načítají a čtou, neaktualizují se na místě
- Optimalizováno pro dotazy – indexy, oddíly, sloupcové úložiště
Knihovna je knihovna. Zdrojové systémy jsou autoři. Analytici jsou čtenáři. Knihovna organizuje sbírku.
Comments
No comments yet. Be the first to share a thought.
Leave a comment