자주 쓰이는 함수
select()
- 변수를 선택할 때 사용한다.
subset = select("변수명", "범위")로 사용한다.
r
subset = select(chicago, city:dptp)
- 범위 파라미터 앞에 마이너스(-) 기호를 붙이면 해당 범위만 제외할 수 있다.
r
subset = select(chicago, -(city:dptp))
with() 계열 함수
ends_with(): ~로 끝나는 대상을 찾고 싶을 때 사용하는 함수starts_with(): ~로 시작하는 대상을 찾고 싶을 때 사용하는 함수select()와 같이 사용하는 경우가 많다.
r
filter()
- 일종의 조건문이라고 할 수 있다.
filter("변수명”, “조건식”)의 형태로 사용한다.
r
summary()
데이터를 요약 + 정리해준다.
r
> summary(chic.f$pm25tmean2)
Min. 1st Qu. Median Mean 3rd Qu. Max. NA's
30.05 32.12 35.04 36.63 39.53 61.50 4447
arrange()
자료의 정렬에서 사용됨.
r
rename()
변수명을 바꿀 때 사용
r
mutate()
자료값을 바꿀 때 사용하는 함수
r
%>% 표기
r
group.by()
그룹으로 묶는 함수
- tapply() : 그룹별 계산시 이용
- cbind()