> Formations > Technologies numériques > Big Data, Intelligence Artificielle > Big Data, NoSQL > Formation Big Data Analytics avec Python > Formations > Technologies numériques > Formation Big Data Analytics avec Python
Formation incontournable

Big Data Analytics avec Python

modélisation et représentation des données

Big Data Analytics avec Python

modélisation et représentation des données
Télécharger au format pdf Partager cette formation par e-mail 2


Data Analytics est un terme pour exprimer les démarches d'analyse de données, afin d'être en mesure de prendre des décisions. Le langage Python dispose d'un écosystème permettant les traitements statistiques : de la construction de modèles d'analyse, à leur évaluation jusqu'à leur représentation.


Inter
Intra
Sur mesure

Cours pratique en présentiel ou en classe à distance

Réf. BDA
Prix : 2690 € HT
  4j - 28h
Pauses-café et
déjeuners offerts




Data Analytics est un terme pour exprimer les démarches d'analyse de données, afin d'être en mesure de prendre des décisions. Le langage Python dispose d'un écosystème permettant les traitements statistiques : de la construction de modèles d'analyse, à leur évaluation jusqu'à leur représentation.

Objectifs pédagogiques
À l’issue de la formation, le participant sera en mesure de :
  • Comprendre le principe de la modélisation statistique
  • Choisir entre la régression et la classification en fonction du type de données
  • Évaluer les performances prédictives d'un algorithme
  • Créer des sélections et des classements dans de grands volumes de données pour dégager des tendances

Public concerné
Responsables Infocentre (Datamining, Marketing, Qualité...), utilisateurs et gestionnaires métiers de bases de données.

Prérequis
Connaissances de base en Python. Connaissances de base en statistiques ou avoir suivi le stage "Statistiques, maîtriser les fondamentaux" (Réf. STA).
Vérifiez que vous avez les prérequis nécessaires pour profiter pleinement de cette formation en faisant  ce test.

Programme de la formation

Introduction à la modélisation

  • Introduction au langage Python.
  • Introduction au logiciel Jupiter Notebook.
  • Les étapes de construction d'un modèle.
  • Les algorithmes supervisés et non supervisés.
  • Le choix entre la régression et la classification.
Travaux pratiques
Installation de Python 3, d'Anaconda et de Jupiter Notebook.

Procédures d'évaluation de modèles

  • Les techniques de ré-échantillonnage en jeu d'apprentissage, de validation et de test.
  • Test de représentativité des données d'apprentissage.
  • Mesures de performance des modèles prédictifs.
  • Matrice de confusion, de coût et la courbe ROC et AUC.
Travaux pratiques
Mise en place d'échantillonnage de jeux de donnes. Effectuer des tests d'évaluations sur plusieurs modèles fournis.

Les algorithmes supervisés

  • Le principe de régression linéaire univariée.
  • La régression multivariée.
  • La régression polynomiale.
  • La régression régularisée.
  • Le Naive Bayes.
  • La régression logistique.
Travaux pratiques
Mise en œuvre des régressions et des classifications sur plusieurs types de données.

Les algorithmes non supervisés

  • Le clustering hiérarchique.
  • Le clustering non hiérarchique.
  • Les approches mixtes.
Travaux pratiques
Traitements de clustering non supervisés sur plusieurs jeux de données.

Analyse en composantes

  • Analyse en composantes principales.
  • Analyse factorielle des correspondances.
  • Analyse des correspondances multiples.
  • Analyse factorielle pour données mixtes.
  • Classification hiérarchique sur composantes principales.
Travaux pratiques
Mise en œuvre de la diminution du nombre des variables et identification des facteurs sous-jacents des dimensions associées à une variabilité importante.

Analyse de données textuelles

  • Collecte et prétraitement des données textuelles.
  • Extraction d'entités primaires, d'entités nommées et résolution référentielle.
  • Étiquetage grammatical, analyse syntaxique, analyse sémantique.
  • Lemmatisation.
  • Représentation vectorielle des textes.
  • Pondération TF-IDF.
  • Word2Vec.
Travaux pratiques
Explorer le contenu d'une base de textes en utilisant l'analyse sémantique latente.


Modalités pratiques
Travaux pratiques
Développement/réalisation d'analyses sur le logiciel Python, avec les modules pandas, NumPy, SciPy, MatPlotLib, seaborn, scikit-learn et statsmodels.

Modalités d'évaluation
Le formateur évalue la progression pédagogique du participant tout au long de la formation au moyen de QCM, mises en situation, travaux pratiques…
Le participant complète également un test de positionnement en amont et en aval pour valider les compétences acquises.

Parcours certifiants associés
Pour aller plus loin et renforcer votre employabilité, découvrez les parcours certifiants qui contiennent cette formation :

Solutions de financement
Pour trouver la meilleure solution de financement adaptée à votre situation : contactez votre conseiller formation.
Il vous aidera à choisir parmi les solutions suivantes :
  • Le plan de développement des compétences de votre entreprise : rapprochez-vous de votre service RH.
  • Le dispositif FNE-Formation.
  • L’OPCO (opérateurs de compétences) de votre entreprise.
  • Pôle Emploi sous réserve de l’acceptation de votre dossier par votre conseiller Pôle Emploi.
  • Le plan de développement des compétences de votre entreprise : rapprochez-vous de votre service RH.
  • Le dispositif FNE-Formation.
  • L’OPCO (opérateurs de compétences) de votre entreprise.
  • Pôle Emploi sous réserve de l’acceptation de votre dossier par votre conseiller Pôle Emploi.

Avis clients
4,4 / 5
Les avis clients sont issus des évaluations de fin de formation. La note est calculée à partir de l’ensemble des évaluations datant de moins de 12 mois. Seules celles avec un commentaire textuel sont affichées.
LOIC C.
17/05/22
5 / 5

Un programme complet sur les 4 jours et bonne répartition des différents chapitres. Très pédagogue et appréciation des TP pour la pratique
ROMAIN S.
17/05/22
5 / 5

Excllente montée en compétence, excellent formateur.
CÉDRIC B.
08/03/22
5 / 5

L’ensemble de la formation est très satisfaisante. Le contenu est complet, et on passe du temps sur les questions pour être sur de bien comprendre. La formation est très bonne pour avoir une visions des étapes de travail du métier de data engineering.




Horaires
En présentiel, les cours ont lieu de 9h à 12h30 et de 14h à 17h30.
Les participants sont accueillis à partir de 8h45. Les pauses et déjeuners sont offerts.
En classe à distance, la formation démarre à partir de 9h.
Pour les stages pratiques de 4 ou 5 jours, quelle que soit la modalité, les sessions se terminent à 15h30 le dernier jour.

Dates et lieux
Pour vous inscrire, sélectionnez la ville et la date de votre choix.
Du 7 Au 10 juin 2022 *
Classe à distance
S’inscrire
Du 7 Au 10 juin 2022 *
Paris La Défense
S’inscrire
Du 5 Au 8 juillet 2022
Paris La Défense
S’inscrire
Du 5 Au 8 juillet 2022 *
Classe à distance
S’inscrire
Du 5 Au 8 juillet 2022
Luxembourg
S’inscrire
Du 5 Au 8 juillet 2022
Lausanne
S’inscrire
Du 5 Au 8 juillet 2022
Genève
S’inscrire
Du 5 Au 8 juillet 2022
Bruxelles
S’inscrire
Du 5 Au 8 juillet 2022
Bruxelles
S’inscrire
Du 5 Au 8 juillet 2022
Lyon
S’inscrire
Du 5 Au 8 juillet 2022
Angers
S’inscrire
Du 5 Au 8 juillet 2022
Bourges
S’inscrire
Du 5 Au 8 juillet 2022
Lille
S’inscrire
Du 5 Au 8 juillet 2022
Orléans
S’inscrire
Du 5 Au 8 juillet 2022
Grenoble
S’inscrire
Du 5 Au 8 juillet 2022
Clermont-Ferrand
S’inscrire
Du 5 Au 8 juillet 2022
Metz
S’inscrire
Du 5 Au 8 juillet 2022
Tours
S’inscrire
Du 5 Au 8 juillet 2022
Reims
S’inscrire
Du 5 Au 8 juillet 2022
Rouen
S’inscrire
Du 5 Au 8 juillet 2022
Chartres
S’inscrire
Du 5 Au 8 juillet 2022
Le Mans
S’inscrire
Du 5 Au 8 juillet 2022
Caen
S’inscrire
Du 5 Au 8 juillet 2022
Le Havre
S’inscrire
Du 5 Au 8 juillet 2022
Dijon
S’inscrire
Du 5 Au 8 juillet 2022
Saint-Etienne
S’inscrire
Du 26 Au 29 juillet 2022
Niort
S’inscrire
Du 26 Au 29 juillet 2022
Pau
S’inscrire
Du 26 Au 29 juillet 2022
Bordeaux
S’inscrire
Du 26 Au 29 juillet 2022
Toulouse
S’inscrire
Du 26 Au 29 juillet 2022
Limoges
S’inscrire
Du 2 Au 5 août 2022
Classe à distance
S’inscrire
Du 2 Au 5 août 2022
Paris La Défense
S’inscrire
Du 9 Au 12 août 2022
Nantes
S’inscrire
Du 9 Au 12 août 2022
Rennes
S’inscrire
Du 9 Au 12 août 2022
Brest
S’inscrire
Du 9 Au 12 août 2022
Mulhouse
S’inscrire
Du 9 Au 12 août 2022
Strasbourg
S’inscrire
Du 30 août Au 2 septembre 2022
Montpellier
S’inscrire
Du 30 août Au 2 septembre 2022
Avignon
S’inscrire
Du 30 août Au 2 septembre 2022
Toulon
S’inscrire
Du 30 août Au 2 septembre 2022
Sophia-Antipolis
S’inscrire
Du 30 août Au 2 septembre 2022
Aix-en-Provence
S’inscrire
Du 13 Au 16 septembre 2022
Orléans
S’inscrire
Du 13 Au 16 septembre 2022
Lille
S’inscrire
Du 13 Au 16 septembre 2022
Tours
S’inscrire
Du 13 Au 16 septembre 2022 *
Paris La Défense
S’inscrire
Du 13 Au 16 septembre 2022
Classe à distance
S’inscrire
Du 13 Au 16 septembre 2022
Luxembourg
S’inscrire
Du 13 Au 16 septembre 2022
Genève
S’inscrire
Du 13 Au 16 septembre 2022
Lausanne
S’inscrire
Du 13 Au 16 septembre 2022
Bruxelles
S’inscrire
Du 13 Au 16 septembre 2022
Bruxelles
S’inscrire
Du 20 Au 23 septembre 2022
Strasbourg
S’inscrire
Du 20 Au 23 septembre 2022
Nantes
S’inscrire
Du 20 Au 23 septembre 2022
Rennes
S’inscrire
Du 27 Au 30 septembre 2022
Aix-en-Provence
S’inscrire
Du 27 Au 30 septembre 2022
Montpellier
S’inscrire
Du 27 Au 30 septembre 2022
Sophia-Antipolis
S’inscrire
Du 4 Au 7 octobre 2022
Saint-Etienne
S’inscrire
Du 4 Au 7 octobre 2022
Dijon
S’inscrire
Du 4 Au 7 octobre 2022
Lyon
S’inscrire
Du 4 Au 7 octobre 2022
Metz
S’inscrire
Du 4 Au 7 octobre 2022
Clermont-Ferrand
S’inscrire
Du 4 Au 7 octobre 2022
Grenoble
S’inscrire
Du 11 Au 14 octobre 2022
Bourges
S’inscrire
Du 11 Au 14 octobre 2022
Angers
S’inscrire
Du 11 Au 14 octobre 2022
Le Havre
S’inscrire
Du 11 Au 14 octobre 2022
Caen
S’inscrire
Du 11 Au 14 octobre 2022
Le Mans
S’inscrire
Du 11 Au 14 octobre 2022
Chartres
S’inscrire
Du 11 Au 14 octobre 2022
Rouen
S’inscrire
Du 11 Au 14 octobre 2022
Reims
S’inscrire
Du 11 Au 14 octobre 2022 *
Classe à distance
S’inscrire
Du 11 Au 14 octobre 2022
Paris La Défense
S’inscrire
Du 18 Au 21 octobre 2022
Limoges
S’inscrire
Du 18 Au 21 octobre 2022
Toulouse
S’inscrire
Du 18 Au 21 octobre 2022
Niort
S’inscrire
Du 18 Au 21 octobre 2022
Bordeaux
S’inscrire
Du 18 Au 21 octobre 2022
Pau
S’inscrire
Du 15 Au 18 novembre 2022
Lille
S’inscrire
Du 15 Au 18 novembre 2022
Orléans
S’inscrire
Du 15 Au 18 novembre 2022
Tours
S’inscrire
Du 15 Au 18 novembre 2022
Luxembourg
S’inscrire
Du 15 Au 18 novembre 2022
Lausanne
S’inscrire
Du 15 Au 18 novembre 2022
Genève
S’inscrire
Du 15 Au 18 novembre 2022
Paris La Défense
S’inscrire
Du 15 Au 18 novembre 2022
Classe à distance
S’inscrire
Du 15 Au 18 novembre 2022
Bruxelles
S’inscrire
Du 15 Au 18 novembre 2022
Bruxelles
S’inscrire
Du 22 Au 25 novembre 2022
Sophia-Antipolis
S’inscrire
Du 22 Au 25 novembre 2022
Toulon
S’inscrire
Du 22 Au 25 novembre 2022
Montpellier
S’inscrire
Du 22 Au 25 novembre 2022
Avignon
S’inscrire
Du 22 Au 25 novembre 2022
Toulouse
S’inscrire
Du 22 Au 25 novembre 2022
Aix-en-Provence
S’inscrire
Du 22 Au 25 novembre 2022
Bordeaux
S’inscrire
Du 6 Au 9 décembre 2022
Rennes
S’inscrire
Du 6 Au 9 décembre 2022
Brest
S’inscrire
Du 6 Au 9 décembre 2022
Grenoble
S’inscrire
Du 6 Au 9 décembre 2022
Nantes
S’inscrire
Du 6 Au 9 décembre 2022
Lyon
S’inscrire
Du 6 Au 9 décembre 2022
Strasbourg
S’inscrire
Du 6 Au 9 décembre 2022
Mulhouse
S’inscrire
Du 13 Au 16 décembre 2022
Classe à distance
S’inscrire
Du 13 Au 16 décembre 2022
Paris La Défense
S’inscrire