ПочатиПочніть безкоштовно

Кількість символів у твітах з Росії

У цій вправі вам надано датафрейм tweets, який містить твіти, пов'язані з Інтернет-агентством досліджень Росії, зібрані FiveThirtyEight.

Ваше завдання — створити нову ознаку 'char_count' у tweets, яка обчислює кількість символів для кожного твіта. Також обчисліть середню довжину твіта. Твіти містяться в ознаці content датафрейму tweets.

Зверніть увагу, що це реальні дані з Twitter, тож існує ризик, що вони можуть містити нецензурну лексику або інший образливий контент (у цій вправі та в будь-яких наступних вправах, які також використовують реальні дані з Twitter).

Ця вправа є частиною курсу

Інженерія ознак для NLP у Python

Переглянути курс

Інструкції до вправи

  • Створіть нову ознаку char_count, застосувавши len до ознаки 'content' у tweets.
  • Надрукуйте середню кількість символів у твітах, обчисливши середнє значення ознаки 'char_count'.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Create a feature char_count
tweets['char_count'] = tweets[____].apply(____)

# Print the average character count
print(tweets[____].____)
Редагувати та запускати код