ÎncepețiÎncepe gratuit

Din text în DataFrame

Acum că ai generat aceste caracteristici bazate pe numărătoare într-un array, va trebui să le reformatezi pentru a putea fi combinate cu restul setului de date. Acest lucru se poate realiza prin conversia array-ului într-un DataFrame pandas, folosind numele caracteristicilor găsite anterior ca nume de coloane, apoi concatenând rezultatul cu DataFrame-ul original.

Array-ul numpy (cv_array) și vectorizatorul (cv) pe care le-ai antrenat în exercițiul anterior sunt disponibile în spațiul tău de lucru.

Acest exercițiu face parte din cursul

Ingineria caracteristicilor pentru Machine Learning în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Creează un DataFrame cv_df care să conțină cv_array ca valori și numele caracteristicilor ca nume de coloane.
  • Adaugă prefixul Counts_ la numele coloanelor, pentru o identificare mai ușoară.
  • Concatenează acest DataFrame (cv_df) cu DataFrame-ul original (speech_df) pe coloane.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Create a DataFrame with these features
cv_df = pd.DataFrame(____, 
                     columns=____).____('Counts_')

# Add the new columns to the original DataFrame
speech_df_new = ____([speech_df, cv_df], axis=1, sort=False)
print(speech_df_new.head())
Editează și rulează codul