
Big Data - Mise en oeuvre d'une solution complète d'analyse des données
Description
Objectif général de la formation : Permettre aux participants de concevoir, déployer et exploiter une solution complète d’analyse des données Big Data, en maîtrisant les flux, les analyses et la visualisation. Modalité : Toutes les modalités (présentiel, classe virtuelle et hybride) sont possibles Lieu possible de réalisation : Locaux du bénéficiaire ou locaux d’Ascent Formation, en France métropolitaine et dans les DROM-COM Nombre maximal de participants : 20 Niveau SAME visé : Maîtrise (M) Compétences visées : Identifier les concepts clés du Big Data et ses applications dans un contexte professionnel. Déployer les technologies nécessaires pour gérer des données complexes et massives. Maîtriser les méthodes d’analyse statistique et les appliquer aux données Big Data. Restituer les résultats à travers des visualisations claires et dynamiques.
Objectifs pédagogiques
- Comprendre les concepts et l'apport du Big Data par rapport aux enjeux métiers.
- Comprendre l’écosystème technologique nécessaire pour réaliser un projet Big Data.
- Acquérir les compétences techniques pour gérer des flux de données complexes, non structurés et massifs.
- Implémenter des modèles d’analyses statistiques pour répondre aux besoins métiers.
- Appréhender un outil de data visualisation pour restituer des analyses dynamiques.
Public concerné
Prérequis
Déroulé du programme
Jour 1 : Concepts fondamentaux et introduction au Big Data (6 heures)
- Introduction au Big Data (2 heures)
Les enjeux métiers du Big Data.
Concepts clés : Volume, Vélocité, Variété, Véracité, Valeur.
Cas d’usage concrets par secteur d’activité.
Travaux pratiques : Identifier des opportunités Big Data dans un secteur donné.
- Écosystème technologique du Big Data (2 heures)
Présentation des technologies clés : Hadoop, Spark, Kafka.
Architecture des systèmes distribués.
Travaux pratiques : Analyser un schéma d’architecture Big Data.
- Collecte et gestion des flux de données (2 heures)
Gestion des données massives : structuration, ingestion, pipelines.
Travaux pratiques : Mettre en place un pipeline simple pour des données massives.
Jour 2 : Gestion et transformation des données (6 heures)
- Gestion des données complexes et non structurées (3 heures)
Travaux pratiques : Explorer et transformer des données semi-structurées et non structurées.
- Transformation et nettoyage des données (3 heures)
Utilisation des outils pour structurer les données et améliorer leur qualité.
Travaux pratiques : Nettoyer et structurer un jeu de données hétérogènes.
Jour 3 : Analyse statistique et modélisation (6 heures)
- Introduction à l’analyse statistique avancée (3 heures)
Calcul d’indicateurs : tendances, corrélations.
Travaux pratiques : Appliquer des analyses statistiques sur un dataset Big Data.
- Modélisation et Machine Learning (3 heures)
Mise en œuvre de modèles prédictifs (régression, clustering).
Travaux pratiques : Construire un modèle de clustering avec un outil Big Data.
Jour 4 : Visualisation et interprétation des données (6 heures)
- Restitution des résultats avec un outil de data visualisation (3 heures)
Présentation des outils (Tableau, Power BI, Matplotlib).
Création de graphiques dynamiques et tableaux de bord.
Travaux pratiques : Construire un tableau de bord interactif.
- Interprétation des résultats pour les besoins métiers (3 heures)
Adapter les visualisations aux publics cible.
Travaux pratiques : Présenter une analyse complète à travers des visualisations.
Jour 5 : Mise en œuvre complète d’une solution Big Data (6 heures)
- Réalisation d’un projet complet (6 heures)
Définition du problème métier.
Collecte, transformation et analyse des données.
Visualisation et présentation des résultats.
Travaux pratiques : Réalisation d’un projet complet en équipes.
Informations
Durée
5 jour(s)
30h
Sur demande
Formations similaires

Analyse bayésienne
Sur demande

Analyse de réseaux (graphes)
Sur demande

Analyse orientée business des logs applicatifs
Sur demande

Apache Superset (4-168)
1500 € HT