행 정렬하기
음악을 CD에 보관하던 시절, 늘 고민이 있었죠. 원하는 CD를 빨리 찾으려면 어떻게 정리하는 게 좋을까요? 아티스트 이름 순으로? 연대기 순으로? 아니면 장르별로?
arrange() 함수는 tibble의 행 순서를 바꾸게 해 줍니다. 이 함수는 tibble과, 따옴표 없이 컬럼 이름들을 인수로 받습니다. 예를 들어, 컬럼 x 값을 오름차순으로, 그리고 x 값이 같은 경우에는 y 값을 내림차순으로 정렬하려면 다음과 같이 작성합니다.
a_tibble %>%
arrange(x, desc(y))
내림차순 정렬을 강제하려면 desc()를 사용한다는 점에 주의하세요. 또한 sparklyr에서는 data.frame의 행을 정렬할 때 쓰는 order() 함수가 동작하지 않는다는 것도 알아두세요.
이 연습은 강의의 일부입니다
R에서 sparklyr로 시작하는 Spark
연습 안내
spark_conn으로 Spark 연결이 생성되어 있습니다. Spark에 저장된 트랙 메타데이터에 연결된 tibble은 track_metadata_tbl로 미리 정의되어 있습니다.
artist_name,release,title,year필드를 선택하세요.- 결과를 파이프해 1960년대 트랙만 필터링하세요.
- 이어서 결과를
arrange()에 파이프해artist_name, 그다음 내림차순year, 그다음title순으로 정렬하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# track_metadata_tbl has been pre-defined
track_metadata_tbl
# Manipulate the track metadata
track_metadata_tbl %>%
# Select columns
___ %>%
# Filter rows
___ %>%
# Arrange rows
___