CommencezCommencez gratuitement

Explorer un corpus R

Une collègue ou un collègue a préparé un corpus de 20 documents sur le pétrole brut, nommé crude. Ce n'est qu'un échantillon parmi les plusieurs milliers d'articles que vous recevrez la semaine prochaine. Pour vous préparer à analyser ces textes, vous avez décidé d'explorer leur contenu et leurs métadonnées. Rappelez-vous qu'en R, un VCorpus contient à la fois meta et content pour chaque texte. Dans cette leçon, vous allez explorer ces deux objets.

Cette activité fait partie du cours

Introduction au traitement automatique des langues en R

Voir le cours

Instructions de l’exercice

  • Affichez crude et examinez le résultat.
  • Affichez le contenu du 10e article.
  • Affichez l'ID du premier article dans crude.
  • À l'aide de la boucle for fournie, créez un vecteur des ID du corpus.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Print out the corpus
print(___)

# Print the content of the 10th article
crude[[___]]$___

# Find the first ID
crude[[___]]$___$id

# Make a vector of IDs
ids <- c()
for(i in c(1:20)){
  ids <- append(ids, crude[[___]]$___$id)
}
Modifier et exécuter le code