Zkuste nás kontaktovat

Návrh Školení

Úvod

  • Přehled vlastností a architektury Sparku a Hadoopu
  • Základy velkých dat
  • Základy programování v Pythonu

Začínáme

  • Nastavení prostředí pro Python, Spark a Hadoop
  • Práce s datovými strukturami v Pythonu
  • Pochopení API PySpark
  • Seznámení se systémem HDFS a technikou MapReduce

Integrace Sparku, Hadoopu a Pythonu

  • Využití RDD v rámci Sparku s Pythonem
  • Zpracování dat pomocí MapReduce
  • Tvorba distribuovaných datových sad v HDFS

Strojové učení s využitím Spark MLlib

Zpracování velkých dat pomocí Spark Streamingu

Praktická práce s doporučovacími systémy

Použití nástrojů Kafka, Sqoop a Flume

Apache Mahout v kombinaci se Sparkem a Hadoopem

Ledení problémů

Shrnutí a další kroky

Požadavky

  • Předchozí zkušenosti se Sparkem a Hadoopem
  • Znalost programování v Pythonu

Cílová skupina

  • Odborníci na datovou analýzu
  • Vývojáři
 21 Hodiny

Počet účastníků


Cena za účastníka

Reference (3)

Nadcházející kurzy

Související kategorie