> Formations > Technologies numériques > Intelligence Artificielle, Big Data > Big Data > Formation Data Analytics avec R > Formations > Technologies numériques > Formation Data Analytics avec R

Formation : Data Analytics avec R

modélisation et représentation des données

Data Analytics avec R

modélisation et représentation des données



Le Big Data Analytics suppose la maîtrise de techniques fondamentales de traitement des données : méthodes statistiques, classifications, régressions, ACP... Ce stage pratique vous montrera, à partir de données concrètes, comment utiliser ces techniques pour construire puis évaluer des modèles à l'aide du langage R.


INTER
INTRA
SUR MESURE

Cours pratique en présentiel ou à distance
Disponible en anglais, à la demande

Réf. DTA
  4j - 28h00
Prix : 2920 € H.T.
Pauses-café et
déjeuners offerts




Le Big Data Analytics suppose la maîtrise de techniques fondamentales de traitement des données : méthodes statistiques, classifications, régressions, ACP... Ce stage pratique vous montrera, à partir de données concrètes, comment utiliser ces techniques pour construire puis évaluer des modèles à l'aide du langage R.


Objectifs pédagogiques
À l’issue de la formation, le participant sera en mesure de :
Comprendre le principe de la modélisation statistique
Choisir entre la régression et la classification en fonction du type de données
Évaluer les performances prédictives d'un algorithme
Créer des sélections et des classements dans de grands volumes de données pour dégager des tendances

Public concerné
Responsables Infocentre (Datamining, Marketing, Qualité...), utilisateurs et gestionnaires métiers de bases de données.

Prérequis
Connaissances de base en statistiques et en R, ou avoir suivi les stages "Statistiques, maîtriser les fondamentaux" (Réf. STA) et "Environnement R, traitement de données et analyse ... " (Réf. TDA).
Vérifiez que vous avez les prérequis nécessaires pour profiter pleinement de cette formation en faisant  ce test.

Modalités d'évaluation
Le formateur évalue la progression pédagogique du participant tout au long de la formation au moyen de QCM, mises en situation, travaux pratiques…
Le participant complète également un test de positionnement en amont et en aval pour valider les compétences acquises.

Programme de la formation

1
Rappels au langage R

  • Les types de données dans R.
  • Importation-exportation de données.
  • Techniques pour tracer des courbes et des graphiques.
Mise en situation
Prise en main des scripts et Notebooks.

2
Analyse en composantes

  • Analyse en Composantes Principales.
  • Analyse Factorielle des Correspondances.
  • Analyse des Correspondances Multiples.
  • Analyse Factorielle pour Données Mixtes.
  • Classification Hiérarchique sur Composantes Principales.
Travaux pratiques
Mise en œuvre de la diminution du nombre des variables et identification des facteurs sous-jacents des dimensions associées à une variabilité importante.

3
La modélisation

  • Les étapes de construction d'un modèle.
  • Les algorithmes supervisés et non supervisés.
  • Le choix entre la régression et la classification.
Travaux pratiques
Mise en place d'échantillonnage de jeux de donnes. Effectuer des tests d'évaluations sur plusieurs modèles fournis.

4
Procédures d'évaluation de modèles

  • Les techniques de ré-échantillonnage en jeu d'apprentissage, de validation et de test.
  • Test de représentativité des données d'apprentissage.
  • Mesures de performance des modèles prédictifs.
  • Matrice de confusion, de coût et la courbe ROC et AUC.
Travaux pratiques
Mise en place d'échantillonnage de jeux de donnes. Effectuer des tests d'évaluations sur plusieurs modèles fournis.

5
Les algorithmes non supervisés

  • Le clustering hiérarchique.
  • Le clustering non hiérarchique.
  • Les approches mixtes.
Travaux pratiques
Traitements de clustering non supervisés sur plusieurs jeux de données.

6
Les algorithmes supervisés

  • Le principe de régression linéaire univariée.
  • La régression multivariée.
  • La régression polynomiale.
  • La régression régularisée.
  • Le Naive Bayes.
  • La régression logistique.
Travaux pratiques
Mise en œuvre des régressions et des classifications sur plusieurs types de données.

7
Analyse de données textuelles

  • Collecte et prétraitement des données textuelles.
  • Extraction d'entités primaires, d'entités nommées et résolution référentielle.
  • Étiquetage grammatical, analyse syntaxique, analyse sémantique.
  • Lemmatisation. Représentation vectorielle des textes. Pondération TF-IDF.


Solutions de financement
Plusieurs solutions existent pour financer votre formation et dépendent de votre situation professionnelle.
Découvrez-les sur notre page Comment financer sa formation ou contactez votre conseiller formation.

Avis clients
4,2 / 5
Les avis clients sont issus des évaluations de fin de formation. La note est calculée à partir de l’ensemble des évaluations datant de moins de 12 mois. Seules celles avec un commentaire textuel sont affichées.
ELISE L.
11/03/25
5 / 5

le professeur est pédagogue et a adapté le contenu de la formation au niveau des élèvescontenu de la formation complet, avec focus sur des ressources en lignemise en application des connaissances à des cas pratiques réels intéressante
EMMANUELLE D.
11/03/25
4 / 5

Le contenu est dense mais les sujets abordées répondent aux besoins que j’avais. Par contre, la formation était difficile à suivre sur la partie exercice. Il aurait été plus facile d’avoir le squelette du script des exercices avant de les commencer.
PAULINE M.
11/03/25
4 / 5

J’aurai préférer avoir les supports avant le cours surtout les scriptsPar rapport aux anciennes formations que j’ai eu, nous avions un echange au préalable avec le formateur pour travailler sur des jeux de données à nous donc les exemples étaient tous liés à nos besoins/ Il nous fournissait le script avant afin qu’on puisse l’annoter en fonction de nos besoins.



Horaires
les cours ont lieu de 9h à 12h30 et de 14h à 17h30.
Les participants sont accueillis à partir de 8h45. Les pauses et déjeuners sont offerts.
Pour les stages pratiques de 4 ou 5 jours, quelle que soit la modalité, les sessions se terminent à 16h le dernier jour.

Dates et lieux
Sélectionnez votre lieu ou optez pour la classe à distance puis choisissez votre date.
Classe à distance

Dernières places
Date garantie en présentiel ou à distance
Session garantie




PARTICIPANTS
Futurs managers et responsables d’équipe souhaitant structurer leur pratique managériale

PRÉREQUIS
Aucun

COMPÉTENCES DU FORMATEUR
Les experts qui animent la formation sont des spécialistes des matières abordées. Ils ont été validés par nos équipes pédagogiques tant sur le plan des connaissances métiers que sur celui de la pédagogie, et ce pour chaque cours qu’ils enseignent. Ils ont au minimum cinq à dix années d’expérience dans leur domaine et occupent ou ont occupé des postes à responsabilité en entreprise.

MODALITÉS D’ÉVALUATION
Le formateur évalue la progression pédagogique du participant tout au long de la formation au moyen de QCM, mises en situation, travaux pratiques… Le participant complète également un test de positionnement en amont et en aval pour valider les compétences acquises.

MOYENS PÉDAGOGIQUES ET TECHNIQUES
• Les moyens pédagogiques et les méthodes d’enseignement utilisés sont principalement : aides audiovisuelles, documentation et support de cours, exercices pratiques d’application et corrigés des exercices pour les stages pratiques, études de cas ou présentation de cas réels pour les séminaires de formation. • À l’issue de chaque stage ou séminaire, ORSYS fournit aux participants un questionnaire d’évaluation du cours qui est ensuite analysé par nos équipes pédagogiques. • Une feuille d’émargement par demi-journée de présence est fournie en fin de formation ainsi qu’une attestation de fin de formation si le stagiaire a bien assisté à la totalité de la session.

MODALITÉS ET DÉLAIS D’ACCÈS
L’inscription doit être finalisée 24 heures avant le début de la formation.

ACCESSIBILITÉ AUX PERSONNES HANDICAPÉES
Pour toute question ou besoin relatif à l’accessibilité, vous pouvez joindre notre équipe PSH par e-mail à l'adresse psh-accueil@orsys.fr.