Accéder au contenu principal

Cours

Analyse de clusters avec R

Intermédiaire4 h

Développez votre intuition sur les regroupements hiérarchiques et via k-means, et appliquez-les pour extraire des infos pertinentes.

R4 h16 vidéos52 exercices3,800 XP44,160Attestation de réussite

Créez votre compte gratuit

Continuer avec Google
ou
En continuant, vous acceptez nos Conditions d’utilisation, notre notre Politique de confidentialité et que vos données sont stockées aux États-Unis.

Plébiscité par des apprenants dans des milliers d’entreprises

Description du cours

Apprenez à réaliser une analyse par grappes

L'analyse par grappes constitue un outil puissant dans le domaine de la science des données. Il est utilisé pour identifier des groupes d'observations (clusters) qui partagent des caractéristiques similaires. Ces similitudes peuvent éclairer toutes sortes de décisions commerciales ; par exemple, en marketing, elles sont utilisées pour identifier des groupes distincts de clients auxquels des publicités peuvent être adaptées.

Découvrez les techniques de regroupement hiérarchique et par la méthode des k-moyennes

Dans ce cours, vous découvrirez deux méthodes de regroupement couramment utilisées : le regroupement hiérarchique et le regroupement par la méthode des k-moyennes. Vous n'apprendrez pas seulement à utiliser ces méthodes, vous développerez également une intuition solide quant à leur fonctionnement et à l'interprétation de leurs résultats. Vous développerez cette intuition en explorant trois ensembles de données différents : les positions des joueurs de football, les données sur les dépenses des clients grossistes et les données longitudinales sur les salaires professionnels.

Perfectionnez vos compétences grâce à une étude de cas pratique

Vous terminerez le cours en mettant en pratique vos nouvelles compétences dans le cadre d'une étude de cas portant sur les salaires moyens et leur évolution au fil du temps. Cela combinera des techniques de regroupement hiérarchique telles que les arbres professionnels, la préparation à l'exploration et la création de graphiques de grappes professionnelles, avec des techniques k-means, notamment l'analyse du coude et les largeurs moyennes de silhouette.

Les cours DataCamp comprennent une combinaison de vidéos, d'articles et d'exercices pratiques afin de vous permettre de tester et de consolider vos nouvelles compétences, de manière à ce que vous vous sentiez à l'aise pour les mettre en application en dehors du cadre du cours.

Prérequis

Programme de formation

Plan du cours

1

Calculer la distance entre des observations

L’analyse de clusters vise à trouver des groupes d’observations similaires entre elles, tout en étant différentes des autres groupes. Cette similarité/différence est mesurée par une métrique appelée distance. Dans ce chapitre, vous apprendrez à calculer la distance entre des observations pour des variables continues et catégorielles. Vous développerez aussi une intuition sur la façon dont l’échelle de vos variables peut influencer la distance.
Commencer le chapitre
2

Clustering hiérarchique

Ce chapitre vous aidera à répondre à la dernière question du chapitre 1 : comment trouver des groupes d’observations similaires (clusters) dans vos données à partir des distances que vous avez calculées ? Vous découvrirez les principes fondamentaux du clustering hiérarchique — le critère de liaison et le dendrogramme — et comment ils servent à construire des clusters. Vous explorerez également des données d’un distributeur de gros afin de segmenter des clients en fonction de leurs habitudes de dépense.
Commencer le chapitre
R

Analyse de clusters avec R

Cours
terminé

Obtenir un certificat d'achèvement

S’inscrire maintenant

Apprenez où que vous soyez avec l'application DataCamp

Même en déplacement, suivez quotidiennement nos cours mobiles et nos défis de codage de 5 minutes.