ПочатиПочніть безкоштовно

Залишайтеся змістовними

Щоб краще зрозуміти враження мандрівників в аеропорту Сан-Франциско, відділ контролю якості надіслав якісну анкету всім пасажирам, які поставили аеропорту найгіршу оцінку за всіма можливими категоріями. Мета цієї анкети — виявити спільні закономірності у висловлюваннях пасажирів про аеропорт.

Їхні відповіді збережено в стовпці survey_response. Ретельніше придивившись, ви помітили, що деякі респонденти дали найкоротші можливі відповіді без суттєвого змісту. У цій вправі ви ізолюєте відповіді з кількістю символів більшою за 40, а також переконаєтеся, що ваш новий датафрейм містить відповіді з 40 символів або більше, використовуючи оператор assert.

Датафрейм airlines є у вашому середовищі, а pandas імпортовано як pd.

Ця вправа є частиною курсу

Очищення даних у Python

Переглянути курс

Інструкції до вправи

  • Використовуючи датафрейм airlines, збережіть довжину кожного елемента у стовпці survey_response в resp_length, застосувавши .str.len().
  • Відіберіть рядки airlines, де resp_length більша за 40.
  • Переконайтеся за допомогою assert, що найменша довжина survey_response у airlines_survey тепер більша за 40.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Store length of each row in survey_response column
resp_length = ____

# Find rows in airlines where resp_length > 40
airlines_survey = airlines[____ > ____]

# Assert minimum survey_response length is > 40
assert ____.str.len().____ > _____

# Print new survey_response column
print(airlines_survey['survey_response'])
Редагувати та запускати код