Corrispondenza e split
Alcuni dei tweet nel tuo insieme di dati sono stati scaricati in modo errato. Invece degli spazi tra le parole, compaiono caratteri strani. Decidi di usare le espressioni regolari per gestire la situazione. Stampi alcuni di questi tweet per capire quale pattern devi intercettare.
Noti che le frasi sono sempre separate da un carattere speciale, seguito da un numero, dalla parola break e poi da un altro carattere speciale, ad esempio &4break!. Le parole sono sempre separate da un carattere speciale, dalla parola new e da un normale carattere casuale, ad esempio #newH.
La variabile sentiment_analysis con il testo di un tweet e il modulo re sono già stati caricati nella tua sessione. Puoi usare print(sentiment_analysis) per visualizzarla nella IPython Shell.
Questo esercizio fa parte del corso
Espressioni regolari in Python
esercizio interattivo pratico
Prova questo esercizio completando questo codice di esempio.
# Write a regex to match pattern separating sentences
regex_sentence = ____"____"