Data & BI

Data Fullstack : de Python et SQL au produit data

Un parcours pratique de 140 heures pour préparer les données, analyser, évaluer un modèle et concevoir un produit data reproductible.

20 jours · 140 hIntermédiaireHybride

Pour qui ?

Analystes, professionnels en évolution vers la data et développeurs souhaitant relier analyse et livraison.

Prérequis

Aisance avec les fichiers et tableurs, proportions et logique. Bases Python/SQL à consolider au positionnement. Poste adapté requis pour les ateliers Docker, API et BI.

Des compétences à mettre en pratique

Objectifs pédagogiques

  • Définir des indicateurs et contrôler la qualité des données.
  • Écrire des traitements Python et des requêtes SQL vérifiables.
  • Explorer une distribution et expliquer l’incertitude.
  • Évaluer un modèle sans fuite de données et le comparer à une référence.
  • Concevoir un pipeline relançable, un contrat API et un tableau BI.
  • Soutenir un dossier reproductible et organiser son transfert.

Votre progression, jour après jour

Programme détaillé

20 séquences · 140 heures indicatives · ateliers et évaluation

Télécharger le programme (PDF)

Le cas fil rouge

Solari Services, entreprise fictive de maintenance : 120 interventions synthétiques pour définir les indicateurs, contrôler les données et soutenir un produit data.

Préparer votre formation et découvrir la méthode

Préparer la formation

Positionnement et vérification du matériel avant inscription. Lire le programme, préparer son objectif et vérifier les modalités avec le centre.

Leçons structurées, exemples résolus, vingt ateliers, quarante questions originales et projet accompagné. Retours et soutenance avec un formateur selon le calendrier convenu.

Jour 01Cadrer une question et définir un indicateur7 h · 1 séquences avec mise en pratique

Séquence 1 · 7 h

Cadrer une question et définir un indicateur

  • Besoin métier
  • Dictionnaire de données
  • Unité d’analyse
Notions et méthodes en détail
  • Besoin métier
  • Dictionnaire de données
  • Unité d’analyse

Atelier prévuRédigez une fiche de décision pour répartir une équipe de maintenance entre trois sites fictifs. Définissez trois indicateurs, leur grain et leurs limites. Construisez un dictionnaire de dix champs et expliquez comment traiter les interventions encore ouvertes.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 02Contrôler et préparer un tableau source7 h · 1 séquences avec mise en pratique

Séquence 2 · 7 h

Contrôler et préparer un tableau source

  • Types et formats
  • Doublons
  • Contrôles de réconciliation
Notions et méthodes en détail
  • Types et formats
  • Doublons
  • Contrôles de réconciliation

Atelier prévuCréez un petit fichier contenant un doublon, une date ambiguë, un code avec zéro initial et une valeur manquante. Préparez une feuille de contrôles séparée. Expliquez chaque transformation et vérifiez que le total retenu se réconcilie avec les lignes rejetées.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 03Utiliser les bases de Python7 h · 1 séquences avec mise en pratique

Séquence 3 · 7 h

Utiliser les bases de Python

  • Variables et types
  • Conditions et boucles
  • Collections
Notions et méthodes en détail
  • Variables et types
  • Conditions et boucles
  • Collections

Atelier prévuDans le notebook fourni, calculez le nombre de dossiers clos, la durée moyenne disponible et la somme des montants en centimes. Traitez séparément une liste vide, une durée manquante et une chaîne non convertible.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 04Structurer du code réutilisable7 h · 1 séquences avec mise en pratique

Séquence 4 · 7 h

Structurer du code réutilisable

  • Fonctions et contrats
  • Objets simples
  • Tests de comportement
Notions et méthodes en détail
  • Fonctions et contrats
  • Objets simples
  • Tests de comportement

Atelier prévuImplémentez ce contrat dans une fonction sans accès au réseau ni au fichier. Ajoutez des tests pour les limites et un appel utilisant le résultat. Proposez ensuite une petite classe de configuration seulement si elle simplifie réellement les paramètres.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 05Nettoyer et joindre avec pandas7 h · 1 séquences avec mise en pratique

Séquence 5 · 7 h

Nettoyer et joindre avec pandas

  • Lecture typée
  • Valeurs manquantes
  • Cardinalité des jointures
Notions et méthodes en détail
  • Lecture typée
  • Valeurs manquantes
  • Cardinalité des jointures

Atelier prévuUtilisez les fichiers synthétiques du notebook pour profiler les données, séparer les anomalies et joindre un référentiel de sites. Introduisez volontairement une clé dupliquée dans le référentiel et démontrez que votre contrôle bloque le calcul.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 06Explorer sans tromper avec un graphique7 h · 1 séquences avec mise en pratique

Séquence 6 · 7 h

Explorer sans tromper avec un graphique

  • Distribution et dispersion
  • Comparaisons
  • Communication des limites
Notions et méthodes en détail
  • Distribution et dispersion
  • Comparaisons
  • Communication des limites

Atelier prévuCréez trois figures sur le jeu Solari : distribution des durées, taux de respect par site avec effectifs et volume par semaine. Ajoutez sous chaque figure une observation, une limite et une question à vérifier.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 07Raisonner avec un échantillon et un test A/B7 h · 1 séquences avec mise en pratique

Séquence 7 · 7 h

Raisonner avec un échantillon et un test A/B

  • Échantillonnage
  • Incertitude
  • Plan d’expérience
Notions et méthodes en détail
  • Échantillonnage
  • Incertitude
  • Plan d’expérience

Atelier prévuRédigez un protocole pour tester un rappel de maintenance. Précisez unité de tirage, critère principal, durée, exclusions et risque de contamination. Calculez l’écart observé puis expliquez ce que l’échantillon permet et ne permet pas d’affirmer.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 08Interroger et agréger avec SQL7 h · 1 séquences avec mise en pratique

Séquence 8 · 7 h

Interroger et agréger avec SQL

  • SELECT et filtres
  • GROUP BY
  • JOIN et NULL
Notions et méthodes en détail
  • SELECT et filtres
  • GROUP BY
  • JOIN et NULL

Atelier prévuDans SQLite via le notebook, créez une table d’interventions, calculez les volumes par site et les moyennes sur dossiers clos. Ajoutez un site sans intervention, puis comparez jointures gauche et interne et expliquez les écarts.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 09Analyser une chronologie avec les fenêtres SQL7 h · 1 séquences avec mise en pratique

Séquence 9 · 7 h

Analyser une chronologie avec les fenêtres SQL

  • PARTITION BY
  • Ordre déterministe
  • Cumuls et décalages
Notions et méthodes en détail
  • PARTITION BY
  • Ordre déterministe
  • Cumuls et décalages

Atelier prévuÉcrivez une requête calculant rang, cumul et variation par site. Testez deux dates identiques et un jour absent. Décrivez la différence entre une fenêtre de trois lignes et une fenêtre de trois jours calendaires.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 10Concevoir un modèle décisionnel7 h · 1 séquences avec mise en pratique

Séquence 10 · 7 h

Concevoir un modèle décisionnel

  • Faits et dimensions
  • Schéma en étoile
  • Historisation
Notions et méthodes en détail
  • Faits et dimensions
  • Schéma en étoile
  • Historisation

Atelier prévuDessinez une étoile avec une table de faits Intervention et trois dimensions. Donnez les clés, le grain et trois mesures. Décrivez le traitement d’un site inconnu et d’un changement de région en cours d’année.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 11Choisir un stockage documentaire et organiser un lac7 h · 1 séquences avec mise en pratique

Séquence 11 · 7 h

Choisir un stockage documentaire et organiser un lac

  • Documents JSON
  • Contrats de schéma
  • Traçabilité des fichiers
Notions et méthodes en détail
  • Documents JSON
  • Contrats de schéma
  • Traçabilité des fichiers

Atelier prévuDéfinissez deux documents JSON valides et un invalide, puis un contrat de contrôle. Proposez l’arborescence d’un lac pédagogique et un manifeste contenant source fictive, date, nombre de lignes et empreinte des fichiers.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 12Collecter une API de manière robuste7 h · 1 séquences avec mise en pratique

Séquence 12 · 7 h

Collecter une API de manière robuste

  • HTTP et statuts
  • Pagination
  • Timeouts et reprise
Notions et méthodes en détail
  • HTTP et statuts
  • Pagination
  • Timeouts et reprise

Atelier prévuAvec une API simulée dans le notebook, traitez pagination, page répétée et erreur temporaire. Définissez les erreurs à réessayer et celles à signaler immédiatement. Rédigez un journal qui permet le diagnostic sans exposer un secret.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 13Construire un pipeline relançable7 h · 1 séquences avec mise en pratique

Séquence 13 · 7 h

Construire un pipeline relançable

  • Extraction et transformation
  • Idempotence
  • Qualité et transactions
Notions et méthodes en détail
  • Extraction et transformation
  • Idempotence
  • Qualité et transactions

Atelier prévuImplémentez dans SQLite un import de lot relançable. Exécutez-le deux fois, injectez un identifiant invalide et simulez une erreur avant validation finale. Comparez le nombre de lignes, les montants et le journal de traitement.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 14Versionner et contrôler en équipe7 h · 1 séquences avec mise en pratique

Séquence 14 · 7 h

Versionner et contrôler en équipe

  • Git et revue
  • Tests en intégration continue
  • Secrets
Notions et méthodes en détail
  • Git et revue
  • Tests en intégration continue
  • Secrets

Atelier prévuDans un dépôt d’exercice local, préparez une branche, un changement de transformation et un test indépendant. Rédigez une description de revue expliquant le problème, le résultat et la validation. Concevez un workflow qui n’a besoin d’aucun secret pour les tests de données fictives.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 15Reproduire un environnement avec des conteneurs7 h · 1 séquences avec mise en pratique

Séquence 15 · 7 h

Reproduire un environnement avec des conteneurs

  • Image et conteneur
  • Ports et volumes
  • Configuration
Notions et méthodes en détail
  • Image et conteneur
  • Ports et volumes
  • Configuration

Atelier prévuSur un poste de travail autorisé, décrivez une image Python minimale, son fichier de dépendances et son contrôle de santé. Identifiez les fichiers à exclure du contexte de construction. Expliquez où résident les données et comment les restaurer.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 16Évaluer un modèle supervisé sans fuite de données7 h · 1 séquences avec mise en pratique

Séquence 16 · 7 h

Évaluer un modèle supervisé sans fuite de données

  • Cible et référence simple
  • Séparation des jeux
  • Prétraitement et métriques
Notions et méthodes en détail
  • Cible et référence simple
  • Séparation des jeux
  • Prétraitement et métriques

Atelier prévuLe notebook sépare une série synthétique par date et entraîne une régression linéaire simple. Comparez son erreur à la moyenne d’entraînement, puis expliquez quelles variables auraient été indisponibles au moment de prédire. Proposez une extension scikit-learn sur un poste configuré.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 17Comparer des modèles et explorer des groupes7 h · 1 séquences avec mise en pratique

Séquence 17 · 7 h

Comparer des modèles et explorer des groupes

  • Validation croisée
  • Arbres et régularisation
  • Clustering
Notions et méthodes en détail
  • Validation croisée
  • Arbres et régularisation
  • Clustering

Atelier prévuConcevez un tableau comparant référence, régression et arbre selon erreur, complexité et coût d’usage. Dans le notebook, affectez des sites synthétiques à des centres imposés puis examinez l’effet d’un changement d’échelle. Proposez des critères de stabilité des groupes.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 18Exposer un résultat dans un produit data7 h · 1 séquences avec mise en pratique

Séquence 18 · 7 h

Exposer un résultat dans un produit data

  • Contrat d’API
  • Validation des entrées
  • Interface et exploitation
Notions et méthodes en détail
  • Contrat d’API
  • Validation des entrées
  • Interface et exploitation

Atelier prévuDéfinissez le contrat d’un endpoint local d’estimation : entrée, bornes, sortie et erreurs. Testez la fonction pure dans le notebook. Utilisez ensuite le kit FastAPI fourni sur un poste configuré, puis rédigez une maquette d’interface indiquant limites et date du modèle.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 19Livrer un tableau de bord BI gouverné7 h · 1 séquences avec mise en pratique

Séquence 19 · 7 h

Livrer un tableau de bord BI gouverné

  • Modèle sémantique
  • Mesures et filtres
  • Accès et actualisation
Notions et méthodes en détail
  • Modèle sémantique
  • Mesures et filtres
  • Accès et actualisation

Atelier prévuDessinez une page Solari avec trois indicateurs et deux filtres. Spécifiez les mesures en numérateurs et dénominateurs. Sur un poste Power BI configuré, importez les données synthétiques, vérifiez les totaux et préparez une matrice de tests de visibilité par rôle.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Jour 20Soutenir et transmettre un projet reproductible7 h · 1 séquences avec mise en pratique

Séquence 20 · 7 h

Soutenir et transmettre un projet reproductible

  • Dossier de preuves
  • Recette et transfert
  • Limites et amélioration
Notions et méthodes en détail
  • Dossier de preuves
  • Recette et transfert
  • Limites et amélioration

Atelier prévuLivrez le dossier Solari : question métier, source synthétique, pipeline contrôlé, analyses SQL et graphiques, modèle comparé à une référence, contrat d’API, maquette BI et procédure de reprise. Préparez dix minutes de démonstration et dix minutes de discussion avec le formateur.

Livrable attenduTrace de calcul ou de décision, résultat argumenté et limites, à intégrer au dossier fil rouge.

Vérification en atelierExpliquer la méthode, vérifier un cas limite et justifier les hypothèses devant le formateur.

Pour aller plus loin

Transposer la méthode à un autre contexte en documentant ce qui change.

Mettre vos acquis à l’épreuve

Évaluation finale prévue

Quiz formatifs originaux et dossier final avec soutenance. Évaluation humaine selon la grille communiquée ; aucune certification externe garantie. Durée indicative : 60 minutes.

Critères de réussite
  • Cohérence entre le besoin et la méthode.
  • Justesse des calculs et qualité des preuves.
  • Traitement des limites et des erreurs.
  • Clarté du dossier et capacité à défendre une décision.

Adaptation et validation pédagogique. Version enrichie proposée, à valider par le formateur. 20 journées équivalentes de 7 heures, à répartir selon la cohorte. Durées incluant lecture, pratique, retours et évaluation ; rythme à confirmer au positionnement.

Supports Beyond rédigés et intégrés dans l’espace pédagogique privé. Relecture et validation par le formateur avant attribution aux apprenants. Aucun contenu ni diplôme tiers n’est inclus par simple équivalence de thème. Le laboratoire navigateur couvre Python/pandas/SQL et les calculs fournis. Docker, FastAPI, Streamlit et Power BI s’utilisent sur un poste ou environnement adapté, à confirmer avec le centre.

Références pour approfondir

Documentation des organismes et éditeurs. La progression et les ateliers sont une rédaction originale pour Beyond Expertise.

Pour obtenir plus de détails ou le programme détaillé, contactez le centre Beyond Expertise.

Contacter le centre

Accès, accompagnement et reconnaissance

Le centre doit confirmer les prérequis, le programme final, les dates, les horaires et le tarif avant inscription. Le délai d’accès dépend des disponibilités et du besoin. L’ouverture d’une session et la disponibilité d’un cours e-learning sont confirmées avant inscription.

Les ateliers, méthodes et évaluations du programme sont proposés pour validation pédagogique. Les supports effectivement disponibles sont indiqués dans la section « Contenu e-learning ».

Le parcours ne délivre pas de diplôme ni de certification professionnelle. Aucune éligibilité CPF ou prise en charge n’est garantie. Toute préparation à un examen externe devra faire l’objet d’informations et d’habilitations vérifiées.

Contenu e-learning

Cours e-learning à préparer

Les objectifs et prérequis sont disponibles. Les leçons, supports et évaluations de ce parcours ne sont pas encore intégrés dans cet espace. Le programme détaillé ci-dessus décrit les apprentissages et les ateliers prévus.

Origine des informations et statut du programme

Durée, niveau, modalités, objectifs et tarif relevés sur le site officiel le 11 septembre 2026. Le déroulé détaillé a été enrichi par Beyond Expertise. Validation pédagogique du formateur à réaliser avant animation.

Data Fullstack : de Python et SQL au produit data | Beyond Expertise