Nos solutions de formation à distance et en présentiel éligibles au dispositif FNE-Formation 100% financées En savoir plus
ORSYS formation
NOUS CONTACTER - +33 (0)1 49 07 73 73
NOUS CONTACTER - 📞 +33 (0)1 49 07 73 73    espace pro ESPACE CLIENT     inscription formation orsys S'INSCRIRE     drapeau francais   drapeau anglais

Nos formations :

Toutes nos formations Big Data, NoSQL

Formation Big Data Analytics avec Python
modélisation et représentation des données

4 / 5
Stage pratique
Best
Durée : 4 jours
Réf : BDA
Prix  2020 : 2580 € H.T.
Pauses et déjeuners offerts
  • Programme
  • Cycles certifiants
  • Participants / Prérequis
  • Intra / sur-mesure
  • avis vérifiés
Programme

Le Big Bata Analytics repose sur la maîtrise des techniques d'exploration de données fondamentales : statistiques descriptives, prédictives ou exploratoires. Ce stage pratique vous présentera des méthodes telles que les régressions et les ACP et vous apprendra à les mettre en œuvre avec le logiciel Python.

Objectifs pédagogiques

  • Comprendre le principe de la modélisation statistique
  • Choisir entre la régression et la classification en fonction du type de données
  • Évaluer les performances prédictives d'un algorithme
  • Créer des sélections et des classements dans de grands volumes de données pour dégager des tendances

Travaux pratiques

Développement/réalisation d'analyses sur le logiciel Python, avec les modules pandas, NumPy, SciPy, MatPlotLib, seaborn, scikit-learn et statsmodels.
PROGRAMME DE FORMATION

Introduction à la modélisation

  • Introduction au langage Python.
  • Introduction au logiciel Jupiter Notebook.
  • Les étapes de construction d'un modèle.
  • Les algorithmes supervisés et non supervisés.
  • Le choix entre la régression et la classification.

Travaux pratiques
Installation de Python 3, d'Anaconda et de Jupiter Notebook.

Procédures d'évaluation de modèles

  • Les techniques de ré-échantillonnage en jeu d'apprentissage, de validation et de test.
  • Test de représentativité des données d'apprentissage.
  • Mesures de performance des modèles prédictifs.
  • Matrice de confusion, de coût et la courbe ROC et AUC.

Travaux pratiques
Mise en place d'échantillonnage de jeux de donnes. Effectuer des tests d'évaluations sur plusieurs modèles fournis.

Les algorithmes supervisés

  • Le principe de régression linéaire univariée.
  • La régression multivariée.
  • La régression polynomiale.
  • La régression régularisée.
  • Le Naive Bayes.
  • La régression logistique.

Travaux pratiques
Mise en œuvre des régressions et des classifications sur plusieurs types de données.

Les algorithmes non supervisés

  • Le clustering hiérarchique.
  • Le clustering non hiérarchique.
  • Les approches mixtes.

Travaux pratiques
Traitements de clustering non supervisés sur plusieurs jeux de données.

Analyse en composantes

  • Analyse en composantes principales.
  • Analyse factorielle des correspondances.
  • Analyse des correspondances multiples.
  • Analyse factorielle pour données mixtes.
  • Classification hiérarchique sur composantes principales.

Travaux pratiques
Mise en œuvre de la diminution du nombre des variables et identification des facteurs sous-jacents des dimensions associées à une variabilité importante.

Analyse de données textuelles

  • Collecte et prétraitement des données textuelles.
  • Extraction d'entités primaires, d'entités nommées et résolution référentielle.
  • Étiquetage grammatical, analyse syntaxique, analyse sémantique.
  • Lemmatisation.
  • Représentation vectorielle des textes.
  • Pondération TF-IDF.
  • Word2Vec.

Travaux pratiques
Explorer le contenu d'une base de textes en utilisant l'analyse sémantique latente.

Cycles certifiants
Participants / Prérequis

» Participants

Responsables Infocentre (Datamining, Marketing, Qualité...), utilisateurs et gestionnaires métiers de bases de données.

» Prérequis

Connaissances de base en statistiques ou avoir suivi le stages"Statistiques, maîtriser les fondamentaux" (Réf. STA). Connaissances de base en Python.
Intra / sur-mesure

Demande de devis intra-entreprise
(réponse sous 48h)

Vos coordonnées

En cochant cette case, j’atteste avoir lu et accepté les conditions liées à l’usage de mes données dans le cadre de la réglementation sur la protection des données à caractère personnel (RGPD).
Vous pouvez à tout moment modifier l’usage de vos données et exercer vos droits en envoyant un email à l’adresse rgpd@orsys.fr
En cochant cette case, j’accepte de recevoir les communications à vocation commerciale et promotionnelle de la part d’ORSYS Formation*
Vous pouvez à tout moment vous désinscrire en utilisant le lien de désabonnement inclus dans nos communications.
* Les participants inscrits à nos sessions de formation sont également susceptibles de recevoir nos communications avec la possibilité de se désabonner à tout moment.
Avis vérifiés
picto avis vérifiés
José C. 16/06/2020
4 / 5
Contenu théorique très enrichissant, les exercices ont beaucoup d'intérêt et sont de bonne qualité, malheureusement il y a un manque de temps considérable pour pouvoir les exploiter directement pendant la formation. Cet déséquilibre marqué est pénalisant sur l'ensemble de la formation. Personnellement je vais le refaire de mon côté pour commencer à intégrer les sujets.

Tanor N. 16/06/2020
4 / 5
Le contenu est très riche et le prof explique bien

Alexandre G. 16/06/2020
5 / 5
explication en profondeur, programme très complet.

MORGANE E. 16/06/2020
5 / 5
Le contenu est dense, il y a beaucoup de sujets et méthodes en 4 jours. La qualité de l'animation est top, le formateur répond à toutes les questions, il est très disponible avec une touche d'humour super appréciable :-)

Salma A. 14/04/2020
5 / 5
Le contenu est intéressant et offre la possibilité d'explorer la théorie d'algorithmes qu'on utilise de manière automatique. Il aurait été souhaitable d'avoir une autre journée de formation pour apprendre et appliquer les méthodes adaptées à d'autres typologies de données (Séries temporelles par exemple ?)

Fabien T. 14/04/2020
5 / 5
Contenu extrêmement dense adressé en 4 jours mais bien équilibré et me semble bien couvrir les différents concepts et méthodes du ML

Mathias N. 10/03/2020
5 / 5
Animation parfaite, un formateur dynamique et extrêment compétent.

Alain B. 10/03/2020
5 / 5
très bonne overview de ce domaine large et complexe

Marc-Antoine S. 27/01/2020
4 / 5
Il serait intéressant d'accentuer la pratique par rapport à la théorie. J'aurais aimé travailler sur un cas pratique sur les algorithmes de recommandations.

Guillaume V. 27/01/2020
4 / 5
Très bon support de cours, les exercices proposés sont également de qualité mais j'aurai aimé une variété d'exercices plus importantes (notamment sur la partie série temporelles et sur les algos de recommandations)

Bertrand G. 27/01/2020
5 / 5
Survol global satisfaisant de l'état de l'art sur les méthodes applicables sur nos problématiques de modélisation, avec des notebooks très pratiques à utiliser pour ne pas perdre de temps et permettre des expérimentations complémentaires. Juste dommage qu'on n'ait pas eu de TP sur la partie recommandation

LAMIA M. 21/01/2020
3 / 5
J'aurais aimé développer plus la partie pratique surtout le language python

Nouhom A. 21/01/2020
4 / 5
Le contenu est un peu dense, pédagogie ok

Adrien B. 21/01/2020
4 / 5
Formation très intéressante avec un bon équilibre théorie/pratique cependant le contenu est très dense et si on est débutant dans le domaine, on peut vite perdre le fil.

Mohamed B. 10/12/2019
3 / 5
On attendais plus de statisques

Elorri D. 13/11/2019
3 / 5
Formation très intéressante.Je trouve pourtant dommage la répartition du cours, à savoir théorique le matin et TP le reste du temps.Il serait plus avantageux à mon sens d'équilibrer ces deux et d'alterner afin d'avoir une réelle compréhension directe.On retrouve notamment dans les TP des outils dont on n'a pas parlé précédemment.Aussi, les TP permettent à chacun d'avancer à

Bertrand G. 13/11/2019
4 / 5
Grâce aux notebooks sous Gooble Colab, les pré-requis de configuration s'en sont trouvés simplifiés. Les exercices avec solutions masquées mais accessibles, et liens utiles intégrés permettaient d'adapter le rythme et les approfondissements en fonction du niveau de base de chacun et de ne pas buter longtemps sur les difficultés. Le changement de formateur a limité toutefois les possibilités d'adapter le

Khanh M. 13/11/2019
4 / 5
Formateur compétent dans le domaine et pédagogue.

Julie D. 12/11/2019
3 / 5
Approche des TD pas appropriée, aurait été souhaitable de montrer un exemple de code avant de se lancer dans le code + dernière session sur le text mining beaucoup trop superficielle

FAISSAL B. 12/11/2019
3 / 5
les exercices sont théorique et il y a pas des exercices qui touchent des cas pratique dans les entreprises
Avis client 4 / 5

Les avis client sont issus des feuilles d’évaluation de fin de formation. La note est calculée à partir de l’ensemble des avis datant de moins de 12 mois.

CLASSE A DISTANCE

En inter et en intra-entreprise
Inscrivez-vous ou contactez-nous !

Pour vous inscrire

Cliquez sur la ville, puis sur la date de votre choix.
[+]
CLASSE A DISTANCE
[+]
PARIS
[+]
AIX
[+]
ANGERS
[+]
BORDEAUX
[+]
BRUXELLES
[+]
DIJON
[+]
GENEVE
[+]
GRENOBLE
[+]
LILLE
[+]
LIMOGES
[+]
LUXEMBOURG
[+]
LYON
[+]
MONTPELLIER
[+]
NANCY
[+]
NANTES
[+]
NIORT
[+]
ORLEANS
[+]
REIMS
[+]
RENNES
[+]
ROUEN
[+]
SOPHIA-ANTIPOLIS
[+]
STRASBOURG
[+]
TOULON
[+]
TOULOUSE
[+]
TOURS

Horaires

Les cours ont lieu de 9h à 12h30 et de 14h à 17h30.
Les participants sont accueillis à partir de 8h45.
Pour les stages pratiques de 4 ou 5 jours, les sessions se terminent à 15h30 le dernier jour.
Formations conseillées
Filières métiers
Thème associé
En poursuivant votre navigation, vous acceptez l’utilisation de cookies nous permettant de vous proposer des offres correspondant à vos centres d’intérêt.
En savoir plus sur l’usage des cookies…   ✖ Fermer
linkedin orsys
twitter orsys
it! orsys
instagram orsys
pinterest orsys
facebook orsys
youtube orsys