Začněte nyníZačněte zdarma

Procvičování syntaxe s grep

Právě jsi dokončil/a seznamovací aktivitu v práci a zaznamenal/a jsi 10 faktů o svém šéfovi. Těchto 10 faktů jsi uložil/a do vektoru s názvem text. Pomocí regulárních výrazů chceš odpovědi shrnout.

Několik poznámek k regulárním výrazům v R:

  • Při použití grep() nastavení value = TRUE vypíše samotný text místo indexů.
  • Vzory lze kombinovat – například číslici "\\d" následovanou tečkou "\\." zapíšeš jako "\\d\\."
  • Mezeru vyhledáš pomocí "\\s".
  • Konkrétní slovo najdeš tak, že ho jednoduše použiješ jako vzor: pattern = 'slovo'

Toto cvičení je součástí kurzu

Úvod do zpracování přirozeného jazyka v R

Zobrazit kurz

Pokyny k cvičení

  • Pomocí grep() vypiš text odpovědí, které obsahují číselný údaj.
  • Najdi všechny položky obsahující číslo následované mezerou. Pro číslo i mezeru použij regulární výraz.
  • Pomocí length() a grep() zjisti, kolikrát jsi napsal/a slovo "favorite".

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Print off each item that contained a numeric number
___(pattern = ___, x = text, value = TRUE)

# Find all items with a number followed by a space
___(pattern = ___, x = text)

# How many times did you write down 'favorite'?
length(___(pattern = ___, x = text))
Upravit a spustit kód