Zacznij terazZacznij za darmo

Tekst do ramki danych

Teraz, gdy wygenerowałeś cechy oparte na licznikach w postaci tablicy, musisz je przekształcić tak, aby można było je połączyć z resztą zbioru danych. Możesz to zrobić, konwertując tablicę na ramkę danych pandas – użyj nazw cech znalezionych wcześniej jako nazw kolumn, a następnie połącz ją z oryginalną ramką danych.

Tablica numpy (cv_array) oraz wektoryzator (cv) dopasowany w poprzednim ćwiczeniu są dostępne w twoim środowisku pracy.

To ćwiczenie jest częścią kursu

Inżynieria cech w uczeniu maszynowym w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Utwórz ramkę danych cv_df zawierającą cv_array jako wartości oraz nazwy cech jako nazwy kolumn.
  • Dodaj prefiks Counts_ do nazw kolumn, aby ułatwić ich identyfikację.
  • Połącz tę ramkę danych (cv_df) z oryginalną ramką danych (speech_df) wzdłuż osi kolumn.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Create a DataFrame with these features
cv_df = pd.DataFrame(____, 
                     columns=____).____('Counts_')

# Add the new columns to the original DataFrame
speech_df_new = ____([speech_df, cv_df], axis=1, sort=False)
print(speech_df_new.head())
Edytuj i uruchom kod