Big Data - Python pour l'analyse de données

An wen richtet sich die Weiterbildung?

Développeurs en Python, responsables infocentre, développeurs de logiciels, programmeurs, data analysts, data scientists.

Dauer

3,00 Tag(e)

Sprache(n) der Dienstleistung

Nächster Termin

27.05.2024

Details anzeigen

Ort

Online

Preis

2280,00€

Voraussetzungen

Maîtrise de la programmation Python. Connaissances de base en statistiques ou avoir suivi le stage "Statistiques, maîtriser les fondamentaux" (Réf. STA).

Ziele

À l’issue de la formation, le participant sera en mesure de:

Comprendre le principe de la modélisation statistique
Savoir utiliser les principaux outils de traitement et d'analyse de données pour Python
Savoir appliquer les pratiques optimales en matière de nettoyage et de préparation des données avant l'analyse
Choisir entre la régression et la classification en fonction du type de données
Apprendre à mettre en place un modèle d'apprentissage simple
Être capable d'extraire des données d'un fichier

Inhalt

Présentation de l’écosystème Python scientifique

Panorama de l’écosystème scientifique de Python: les librairies incontournables.
Savoir ou trouver de nouvelles librairies et juger de leur pérennité.
Les principaux outils et logiciels open source pour la data science.

Travaux pratiques
Installation de Python 3, d'Anaconda et de Jupiter Notebook.

Travailler les données avec Python

Le socle scientifique Python: la SciPy Stack.
Les bonnes pratiques pour bien démarrer votre projet de data science avec Python.
Les formats de fichiers scientifiques et les librairies pour les manipuler.
Pandas: l’analyse de données tabulaires (fichiers csv, excel...), statistiques, pivots, filtres, recherche…
Numpy: calcul numérique et algèbre linéaire (les vecteurs, matrices, images).
L’extraction des données,la préparation, le nettoyage.

Travaux pratiques
Ecrire des scripts Python permettant de travailler avec des données issues de fichiers, afin d’appliquer des filtres, des traitements de formatage, de nettoyage.

Introduction à la modélisation

Les étapes de construction d'un modèle.
Les algorithmes supervisés et non supervisés.
Le choix entre la régression et la classification.

Travaux pratiques
Intégration dans l’environnement installé de scripts Python, pour analyse.

Procédures d'évaluation de modèles

Les techniques de ré-échantillonnage en jeu d'apprentissage, de validation et de test.
Test de représentativité des données d'apprentissage.
Mesures de performance des modèles prédictifs.
Matrice de confusion, de coût et la courbe ROC et AUC.

Travaux pratiques
Mise en place d'échantillonnage de jeux de données. Effectuer des tests d'évaluations sur plusieurs modèles fournis.

Les algorithmes supervisés

Le principe de régression linéaire univariée.
La régression multivariée.
La régression polynomiale.
La régression régularisée.
Le Naive Bayes.
La régression logistique.

Travaux pratiques
Mise en œuvre des régressions et des classifications sur plusieurs types de données.

Les algorithmes non supervisés

Le clustering hiérarchique.
Le clustering non hiérarchique.
Les approches mixtes.

Travaux pratiques
Traitements de clustering non supervisés sur plusieurs jeux de données.

Bewertung

Le formateur évalue la progression pédagogique du participant tout au long de la formation au moyen de QCM, mises en situation, travaux pratiques…Le participant complète également un test de positionnement pour valider les compétences acquises.

Nächster Termin

Datum

Stadt

Sprache und Preis

27.05.2024

29.05.2024

Online

FR 2280,00€

Details anzeigen

PROMO -0%

Veranstaltungsort der Weiterbildung

Online

Uhrzeiten

Anmeldefrist

27.05.2024

Sich anmelden

17.07.2024

19.07.2024

Online

FR 2280,00€

Details anzeigen

PROMO -0%

Veranstaltungsort der Weiterbildung

Online

Uhrzeiten

Anmeldefrist

17.07.2024

Sich anmelden

28.10.2024

30.10.2024

Online

FR 2280,00€

Details anzeigen

PROMO -0%

Veranstaltungsort der Weiterbildung

Online

Uhrzeiten

Anmeldefrist

28.10.2024

Sich anmelden

Zusätzliche Informationen

Une attestation de présence sera envoyée aux participants après la formation.
12 participants maximum - Ouverture garantie à partir de 3 personnes - Classe à distance possible

Kontakt für diese Weiterbildung

Julie Simier

jsimier@orsys.lu
+352 20 60 25 26 8127

En savoir plus sur ORSYS Luxembourg

Diese Weiterbildungen könnten Sie interessieren

Vue.js, maîtriser le framework JavaScript Open Source

Blended-Learning

Programmiersprache - Programmiersprache Javascript

12.06.2024

Bases de données et langage SQL pour non-informaticiens

Online

Programmiersprache - Programmiersprache SQL

22.05.2024