Plan du cours
Introduction
Aperçu des fonctionnalités et de l'architecture d'« Open Studio for Big Data »
Configuration d'Open Studio for Big Data
Navigation dans l'interface utilisateur
Compréhension des composants Big Data et des connecteurs
Connexion à un cluster Hadoop
Lecture et écriture de données
Traitement des données avec Hive et MapReduce
Analyse des résultats
Amélioration de la qualité des données massives
Construction d'un pipeline Big Data
Gestion des utilisateurs, groupes, rôles et projets
Déploiement d'Open Studio en production
Surveillance d'Open Studio
Dépannage
Résumé et conclusion
Pré requis
- Une compréhension des bases de données relationnelles
- Une compréhension du data warehousing
- Une compréhension des concepts ETL (Extract, Transform, Load)
Public cible
- Professionnels de l'intelligence économique
- Professionnels des bases de données
- Développeurs SQL
- Développeurs ETL
- Architectes solution
- Architectes données
- Professionnels du data warehousing
- Administrateurs système et intégrateurs
Nos clients témoignent (2)
Un voyage à travers l'univers de Spark : un cours très intensif. DSL, Spark SQL, partitionnement versus bucketing pour moi.
Georgiana Elisabeta
Formation - Apache Spark Fundamentals
Traduction automatique
Exercices pratiques. La formation aurait dû durer 5 jours, mais les 3 jours ont permis de clarifier beaucoup de questions que je me posais déjà en travaillant avec NiFi.
James - BHG Financial
Formation - Apache NiFi for Administrators
Traduction automatique