Návrh Školení
Úvod
Přehled funkcí a architektury „Open Studio pro velká data“
Instalace a nastavení Open Studio pro velká data
Orientace v uživatelském rozhraní
Seznámení s komponentami a konektory určenými k práci s velkými daty
Připojení k clusteru Hadoop
Čtení a zápis dat
Zpracování dat pomocí nástrojů Hive a MapReduce
Analyzování výsledků
Zvyšování kvality velkých datových sad
Vytváření datových toků pro práci s velkými daty
Správa uživatelů, skupin, rolí a projektů
Nasazení Open Studio do produkčního prostředí
Sledování fungování Open Studio
Řešení běžných problémů
Shrnutí a závěr kurzu
Požadavky
- Základní znalosti relačních databází
- Přehled o konceptech datových skladů
- Porozumění principům ETL (extrakce, transformace a načítání dat)
Určené publikum
- Odborníci na obchodní inteligenci
- Databázoví specialisté
- Vývojáři SQL
- Vývojáři ETL řešení
- Architekti řešení
- Datoví architekti
- Odborníci na správu datových skladů
- Systémoví administrátoři a integrátoři
Reference (2)
Cesta světem Sparku: velmi intenzivní kurz. DSL, Spark SQL, rozdělování oproti kbelíkování pro mě.
Georgiana Elisabeta
Kurz - Apache Spark Fundamentals
Přeloženo strojem
Praktické cvičení. Třída by měla trvat 5 dní, ale i tři dny pomohly rozjasnit spoustu otázek, které jsem měl z práce s NiFi.
James - BHG Financial
Kurz - Apache NiFi for Administrators
Přeloženo strojem