Accéder au contenu principal

Cours

Introduction au Natural Language Processing en R

Intermédiaire4 h

Obtenez une vue d’ensemble de toutes les compétences et outils nécessaires pour exceller en traitement du langage naturel avec R.

R4 h15 vidéos47 exercices3,750 XP8,579Attestation de réussite

Créez votre compte gratuit

Continuer avec Google
ou
En continuant, vous acceptez nos Conditions d’utilisation, notre notre Politique de confidentialité et que vos données sont stockées aux États-Unis.

Plébiscité par des apprenants dans des milliers d’entreprises

Description du cours

Comme tout cours d’initiation, Introduction au Natural Language Processing en R a pour objectif de vous donner les outils essentiels pour débuter vos analyses de texte. Le Natural Language Processing (NLP) est un domaine de la data science en expansion constante, avec des avancées très enthousiasmantes au cours de la dernière décennie. Ce cours couvre les bases de ces sujets et vous prépare à développer vos capacités d’analyse. Nous abordons les expressions régulières, le topic modeling, la reconnaissance d’entités nommées, entre autres, en fournissant des exemples complets pour lancer vos futures analyses.

Prérequis

Programme de formation

Plan du cours

1

Les véritables fondamentaux

Le chapitre 1 d’Introduction au Natural Langauge Processing vous prépare à exécuter votre première analyse de texte. Vous explorerez les expressions régulières et la tokenisation, deux composants très courants dans la plupart des tâches d’analyse. Avec les expressions régulières, vous pouvez rechercher n’importe quel motif imaginé ; avec la tokenisation, vous préparez et nettoyez le texte pour des analyses plus poussées. Ce chapitre est indispensable pour aborder les techniques que nous verrons dans le reste du cours.
Commencer le chapitre
2

Représentations du texte

Dans ce chapitre, vous apprendrez les approches les plus courantes et étudiées pour analyser du texte. Vous verrez comment créer un corpus, étendre une représentation en sac de mots vers une matrice TF-IDF, et utiliser des mesures de similarité cosinus pour déterminer à quel point deux textes se ressemblent. Vous consoliderez vos bases pour pratiquer le NLP avant de plonger dans ses applications aux chapitres 3 et 4.
Commencer le chapitre
3

Applications : classification et topic modeling

Le chapitre 3 se concentre sur deux approches classiques d’analyse de texte : la modélisation de classification et le topic modeling. Si vous travaillez sur des projets d’analyse de texte, vous utiliserez inévitablement l’une ou l’autre de ces méthodes. Ce chapitre vous apprend à mettre en œuvre ces deux techniques et vous donne des pistes pour les aborder de manière pratique.
Commencer le chapitre
4

Techniques avancées

Au chapitre 4, nous couvrons deux incontournables du Natural Language Processing : l’analyse de sentiments et les word embeddings. Ce sont deux techniques essentielles pour toute personne qui apprend les fondamentaux de l’analyse de texte. De plus, vous découvrirez brièvement BERT, l’étiquetage morphosyntaxique (part-of-speech tagging) et la reconnaissance d’entités nommées. Près de 15 techniques d’analyse différentes sont abordées dans ce cours ; le chapitre 4 se termine donc en récapitulant toutes les excellentes méthodes que vous allez découvrir.
Commencer le chapitre
R

Introduction au Natural Language Processing en R

Cours
terminé

Obtenir un certificat d'achèvement

S’inscrire maintenant

Apprenez où que vous soyez avec l'application DataCamp

Même en déplacement, suivez quotidiennement nos cours mobiles et nos défis de codage de 5 minutes.