Răspunsuri detaliate
Pentru a înțelege mai bine experiența călătorilor pe Aeroportul San Francisco, departamentul de asigurare a calității a trimis un chestionar calitativ tuturor călătorilor care au acordat aeroportului cele mai mici scoruri posibile la toate categoriile. Scopul acestui chestionar este de a identifica tipare comune în ceea ce spun călătorii despre aeroport.
Răspunsurile lor sunt stocate în coloana survey_response. Analizând datele mai atent, ai observat că unele răspunsuri conțin numărul minim de caractere, fără prea mult conținut. În acest exercițiu, vei izola răspunsurile cu un număr de caractere mai mare de 40 și vei verifica că noul tău DataFrame conține răspunsuri cu cel puțin 40 de caractere, folosind o instrucțiune assert.
DataFrame-ul airlines este disponibil în mediul tău de lucru, iar pandas este importat ca pd.
Acest exercițiu face parte din cursul
Curățarea datelor în Python
Instrucțiuni pentru exercițiu
- Folosind DataFrame-ul
airlines, stochează lungimea fiecărui răspuns din coloanasurvey_responseînresp_lengthcu ajutorul.str.len(). - Izolează rândurile din
airlinespentru careresp_lengtheste mai mare de40. - Verifică prin
assertcă lungimea minimă a răspunsurilor dinsurvey_responseînairlines_surveyeste acum mai mare de40.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Store length of each row in survey_response column
resp_length = ____
# Find rows in airlines where resp_length > 40
airlines_survey = airlines[____ > ____]
# Assert minimum survey_response length is > 40
assert ____.str.len().____ > _____
# Print new survey_response column
print(airlines_survey['survey_response'])