Explorer un corpus R
Une collègue ou un collègue a préparé un corpus de 20 documents sur le pétrole brut, nommé crude. Ce n'est qu'un échantillon parmi les plusieurs milliers d'articles que vous recevrez la semaine prochaine. Pour vous préparer à analyser ces textes, vous avez décidé d'explorer leur contenu et leurs métadonnées. Rappelez-vous qu'en R, un VCorpus contient à la fois meta et content pour chaque texte. Dans cette leçon, vous allez explorer ces deux objets.
Cette activité fait partie du cours
Introduction au traitement automatique des langues en R
Instructions de l’exercice
- Affichez
crudeet examinez le résultat. - Affichez le contenu du 10e article.
- Affichez l'ID du premier article dans
crude. - À l'aide de la boucle for fournie, créez un vecteur des ID du corpus.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Print out the corpus
print(___)
# Print the content of the 10th article
crude[[___]]$___
# Find the first ID
crude[[___]]$___$id
# Make a vector of IDs
ids <- c()
for(i in c(1:20)){
ids <- append(ids, crude[[___]]$___$id)
}