Inizia subitoInizia gratis

Corrispondenza e split

Alcuni dei tweet nel tuo insieme di dati sono stati scaricati in modo errato. Invece degli spazi tra le parole, compaiono caratteri strani. Decidi di usare le espressioni regolari per gestire la situazione. Stampi alcuni di questi tweet per capire quale pattern devi intercettare.

Noti che le frasi sono sempre separate da un carattere speciale, seguito da un numero, dalla parola break e poi da un altro carattere speciale, ad esempio &4break!. Le parole sono sempre separate da un carattere speciale, dalla parola new e da un normale carattere casuale, ad esempio #newH.

La variabile sentiment_analysis con il testo di un tweet e il modulo re sono già stati caricati nella tua sessione. Puoi usare print(sentiment_analysis) per visualizzarla nella IPython Shell.

Questo esercizio fa parte del corso

Espressioni regolari in Python

Visualizza corso

esercizio interattivo pratico

Prova questo esercizio completando questo codice di esempio.

# Write a regex to match pattern separating sentences
regex_sentence = ____"____"
Modifica ed esegui il codice