Neem contact met ons op

Cursusaanbod

Inleiding

  • Overzicht van de kenmerken en architectuur van Spark en Hadoop
  • Het begrijpen van big data
  • Grondbeginselen van Python-programmeren

Aan de slag

  • Het instellen van Python, Spark en Hadoop
  • De datastructuren in Python begrijpen
  • Kennis maken met de PySpark API
  • Werking van HDFS en MapReduce begrijpen

Integratie van Spark en Hadoop met Python

  • Het implementeren van Spark RDD in Python
  • Gegevens verwerken met behulp van MapReduce
  • Het creëren van gedistribueerde datasets in HDFS

Machine Learning met Spark MLlib

Verwerking van Big Data met Spark Streaming

Werken aan aanbevelingssystemen

Het werken met Kafka, Sqoop, Flume en Kafka

Apache Mahout in combinatie met Spark en Hadoop

Problemen oplossen

Samenvatting en vervolgstappen

Vereisten

  • Ervaring met Spark en Hadoop
  • Programmeerervaring in Python

Doelgroep

  • Datawetenschappers
  • Ontwikkelaars
 21 Uren

Aantal deelnemers


Prijs per deelnemer

Getuigenissen (3)

Voorlopige Aankomende Cursussen

Gerelateerde categorieën