Návrh Školení
Úvod do Apache Icebergu
- Přehled o projektu Apache Iceberg
- Zopakování základních konceptů
Hluboký pohled do architektury Icebergu
- Podrobná analýza formátu tabulek Iceberg
- Přehled celé architektury včetně správy metadat a uspořádání souborů
- Jak probíhá evoluce schématu a partitions
Pokročilá instalace a konfigurace
- Konfigurace Iceberg pro dosažení nejlepšího výkonu v různých prostředích
- Integrace s různými nástroji na zpracování dat
- Pokročilá nastavení: zabezpečení, šifrování a kontrola přístupu
- Nastavení Iceberg v distribuovaném prostředí
Pokročilá správa a údržba
- Správa velmi rozsáhlých tabulek Iceberg
- Realizace složitých změn ve struktuře dat a jejich správa
- Řešení evoluce partitions a skrytého rozdělování dat
- Pokročilé operace CRUD při změnách schématu i struktury partitions
Techniky optimalizace dotazů
- Metody snižování doby odezvy dotazů
- Optimální využití omezení počtu zpracovávaných partitions a souborů
- Cachování metadat a strategie jejich optimalizace
- Nácvik a testování různých technik optimalizace dotazů
Ladění výkonu u velkých datových sad
- Jak dosáhnout lepšího výkonu při zpracování rozsáhlých datových sad
- Využití vestavěných nástrojů Iceberg pro ladění výkonu
- Příklady z praxe – jak se dosahuje vysokého výkonu ve skutečných aplikacích
- Konkrétní metody ladění výkonu u rozsáhlých datových sad
Pokročilá migrace a integrace dat
- Přesun složitě strukturovaných dat z jiných systémů
- Integrace Icebergu se streamovacími kanály reálných dat
- Společná realizace migrace velkých datových sad a jejich propojení s reálnými tokovými daty
Spolehlivost a konzistence dat
- Jak zajistit konzistenci a integritu dat v distribuovaných prostředích
- Realizace spolehlivých transakčních mechanismů
- Řešení chyb a systémy obnovy po selhání
- Zavádění prvků pro spolehlivost a konzistenci dat
Pokročilé funkce a vlastní úpravy
- Vytváření vlastních katalogů dat
- Rozšiřování možností Iceberg o nové funkce dle potřeb
- Kombinace vytvoření vlastního katalogu a rozšíření Icebergu
Správa dat a shoda s legislativou
- Zavádění pravidel pro správu dat
- Dodržování předpisů týkajících se ochrany osobních údajů a dalších regulací
- Evidence změn a sledování vztahů mezi daty
- Implementace mechanismů pro správu a shodu s předpisy
Závěr a další kroky
Požadavky
- Znalost základních konceptů, operací a správy tabulek Iceberg
Cílové skupiny
- Datoví inženýři
- Architekti dat
- Data analytici
- Vývojáři softwaru
Reference (2)
Cesta světem Sparku: velmi intenzivní kurz. DSL, Spark SQL, rozdělování oproti kbelíkování pro mě.
Georgiana Elisabeta
Kurz - Apache Spark Fundamentals
Přeloženo strojem
Praktické cvičení. Třída by měla trvat 5 dní, ale i tři dny pomohly rozjasnit spoustu otázek, které jsem měl z práce s NiFi.
James - BHG Financial
Kurz - Apache NiFi for Administrators
Přeloženo strojem