Din text în DataFrame
Acum că ai generat aceste caracteristici bazate pe numărătoare într-un array, va trebui să le reformatezi pentru a putea fi combinate cu restul setului de date. Acest lucru se poate realiza prin conversia array-ului într-un DataFrame pandas, folosind numele caracteristicilor găsite anterior ca nume de coloane, apoi concatenând rezultatul cu DataFrame-ul original.
Array-ul numpy (cv_array) și vectorizatorul (cv) pe care le-ai antrenat în exercițiul anterior sunt disponibile în spațiul tău de lucru.
Acest exercițiu face parte din cursul
Ingineria caracteristicilor pentru Machine Learning în Python
Instrucțiuni pentru exercițiu
- Creează un DataFrame
cv_dfcare să conținăcv_arrayca valori și numele caracteristicilor ca nume de coloane. - Adaugă prefixul
Counts_la numele coloanelor, pentru o identificare mai ușoară. - Concatenează acest DataFrame (
cv_df) cu DataFrame-ul original (speech_df) pe coloane.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Create a DataFrame with these features
cv_df = pd.DataFrame(____,
columns=____).____('Counts_')
# Add the new columns to the original DataFrame
speech_df_new = ____([speech_df, cv_df], axis=1, sort=False)
print(speech_df_new.head())