Neem contact met ons op

Cursusaanbod

Fundamentals van NiFi en datastroom

  • Data in beweging versus data opslag: concepten en uitdagingen
  • NiFi-architectuur: cores, flow controller, provenance en bulletin
  • Belangrijke componenten: processors, verbindingen, controllers en provenance

Context en integratie van Big Data

  • Rol van NiFi in Big Data-ecosystemen (Hadoop, Kafka, cloudopslag)
  • Overzicht van HDFS, MapReduce en moderne alternatieven
  • Gebruiksscenario’s: streaminname, logverzending, event-pipelines

Installatie, configuratie en clusteropstelling

  • Installeren van NiFi op een enkel node en in clustermode
  • Clusternconfiguratie: knooprollen, zookeeper en loadbalancing
  • Orchestratie van NiFi-implementaties: het gebruik van Ansible, Docker of Helm

Ontwerpen en beheren van datastromen

  • Routing, filteren, splitsen en samenvoegen van stromen
  • Configuratie van processors (InvokeHTTP, QueryRecord, PutDatabaseRecord, etc.)
  • Behandeling van schema’s, verrijking en transformatieoperaties
  • Foutafhandeling, retry-verbindingen en backpressure

Integratie-scenario’s

  • Verbinden met databases, messaging-systemen en REST APIs
  • Streamen naar analytische systemen: Kafka, Elasticsearch of cloudopslag
  • Integratie met Splunk, Prometheus of logging-pipelines

Monitoring, herstel en provenance

  • Gebruik van de NiFi-UI, metrics en de provenance-weergave
  • Ontwerpen van autonoom herstel en beheerste foutafhandeling
  • Backups, versiebeheer van stromen en wijzigingsbeheer

Prestatiestuning en optimalisatie

  • Tunes van de JVM, heap, threadpools en clusterparameters
  • Optimaliseren van het stroomontwerp om bottleneck te verminderen
  • Bronnenisolatie, prioritering van stromen en doorvoerregeling

Best practices en governance

  • Documentatie van stromen, naamgevingsstandaarden, modulair ontwerp
  • Beveiliging: TLS, authenticatie, toegangsbeheer, data-versleuteling
  • Wijzigingsbeheer, versiebeheer, rolgebaseerde toegang, audittrails

Probleemoplossing en incidentafhandeling

  • Veelvoorkomende problemen: deadlock, geheugenlekkages, processorfouten
  • Loganalyse, foutdiagnostiek en oorzakelijk onderzoek
  • Herstelstrategieën en rollback van stromen

Hands-on lab: Implementatie van een realistische datapipeline

  • Bouwen van een end-to-end stroom: inname, transformatie, levering
  • Implementeren van foutafhandeling, backpressure en schalering
  • Prestatietest en tuning van de pipeline

Samenvatting en vervolgstappen

Vereisten

  • Ervaring met de Linux-opdrachtregel
  • Basisbegrip van netwerken en datasystemen
  • Kennismaking met datastreaming of ETL-concepten

Doelgroep

  • Systeembeheerders
  • Data-ingenieurs
  • Ontwikkelaars
  • DevOps-professionals
 21 Uren

Aantal deelnemers


Prijs per deelnemer

Getuigenissen (7)

Voorlopige Aankomende Cursussen

Gerelateerde categorieën