- 전체
- Sample DB
- database modeling
- [표준 SQL] Standard SQL
- G-SQL
- 10-Min
- ORACLE
- MS SQLserver
- MySQL
- SQLite
- postgreSQL
- 데이터아키텍처전문가 - 국가공인자격
- 데이터 분석 전문가 [ADP]
- [국가공인] SQL 개발자/전문가
- NoSQL
- hadoop
- hadoop eco system
- big data (빅데이터)
- stat(통계) R 언어
- XML DB & XQuery
- spark
- DataBase Tool
- 데이터분석 & 데이터사이언스
- Engineer Quality Management
- [기계학습] machine learning
- 데이터 수집 및 전처리
- 국가기술자격 빅데이터분석기사
- 암호화폐 (비트코인, cryptocurrency, bitcoin)
stat(통계) R 언어 [통계 R 언어] [ R ] pipe operator %>% 의 의미 - magrittr 패키지
2023.12.10 18:56
[통계 R 언어] [ R ] pipe operator %>% 의 의미 - magrittr 패키지
이번에는 항상 거슬렸던 %>%의 의미에 대해서 써보려고 합니다.
%>% operator는 magrittr 패키지를 설치하여야 이용할 수 있는데 이것저것 예제를 찾아보다
보면 심심치 않게 등장합니다. 그때마다 미루다가 한번 공부해 봤습니다.
정확히 어떤 경우에 효과적으로 사용되고 큰 의미를 가지는지는 아직 잘 모르겠습니다.
그런데 잘 설명되어 있는 문서를 찾아서 일단 첨부하고 간단히 설명 하겠습니다.
(https://rdrr.io/cran/magrittr/man/pipe.html)
%>%는 함수에 인수를 편하게 적용할 수 있게 해주는 operator입니다.
예제를 보는 것이 가장 이해가 빠르므로 코드부터 보겠습니다.
x %>% f(y) #(1) f(x, y)와 같습니다.
y %>% f(x, .) #(2) f(x, y)와 같습니다
z %>% f(x, y, arg = .) #(3) f(x, y, arg = z)와 같습니다
iris %>% subset(1:nrow(.) %% 2 == 0) #(4) iris %>% subset(., 1:nrow(.) %% 2 == 0)
와 같습니다
1:10 %>% {c(min(.), max(.))} # (5) c(min(1:10), max(1:10)) 와 같습니다
간단히 설명하겠습니다.
%>% operator는 어떤 함수에 특정 인수를 손쉽게 넣기 위해 사용하는 것으로 보입니다.
(1)의 경우 이해가 안되실 수 있지만 x를 1:10이라고 생각하시면 왜 사용하는지 이해가 쉽습니다.
제가 지금까지 알고 있는 지식을 바탕으로 생각했을 때는 거의 do.call과 비슷하다고 생각하면
될 듯합니다. 하지만 do.call은 인수로 리스트만 받기 때문에 이 오퍼레이터가 유용한 것이 아닐까..
합니다. 아무튼 %>%을 기준으로 왼쪽을 lhs 오른쪽을 rhs라 합니다.
lhs에는 값을 주고 rhs에는 함수를 인수로 주어야 합니다. 그래서 rhs에 있는 함수에 lhs에 있는 값을
넣어서 실행하는 기능입니다. 그런데 실질적으로 사용하려면 rhs있는 함수에 몇 번째 인수로 lhs 값을
넣을지 등 다양하게 응용 가능해야 하기 때문에 (2),(3),(4),(5) 등이 존재합니다.
기본으로 lhs는 무조건 rhs의 첫 번째 인수로 주어집니다. 그런데 상황에 따라 인수의 위치를
변경해야 하는 상황이 많기 때문에 그런 경우에는 원하는 인수 위치에
dot (.)으로 lhs가 들어갈 위치를 정해줄 수 있습니다.
예를 들면 mean(100,10) 은 10 %>% mean(100, . )과 같습니다. 이는 꼭 두 번째가 아니라
세 번째 인수나 다른 위치의 인수를 넣고 싶을 때도 유효합니다.
이제 (4), (5) 번입니다. 이 부분은 조금 특이한 성질이 있어서 유의해서 보시기 바랍니다.
만약 함수 안에 함수를 사용하고 함수 안에 있는 함수의 인수로 dot(.)을 사용하고
바깥 함수의 인수로dot(.)이 주어지지 않는 경우에는 바깥 쪽에 있는 함수의
첫 번째 인수로도 . 이 자동으로 들어가게 됩니다.
말로 보니 굉장히 어려워 보이는데 예를 들겠습니다.
> 1:10 %>% sum(.)
[1] 55
> 1:10 %>% sum(length(.))
[1] 65
> 1:10 %>% {sum(length(.))}
[1] 10
첫 번째 실행은 sum(1:10)과 같습니다.
그런데 두 번째 실행을 보면 sum(length(.))이면 length(1:10)이 10 이므로
10이 리턴되어야 할 것으로 생각되지만 65가 리턴됩니다.
이 성질이 제가 위에 말씀드렸던
|
만약 함수 안에 함수를 사용하고 함수 안에 있는 함수의 인수로 dot(.)을 사용하고
바깥 함수의 인수로dot(.)이 주어지지 않는 경우에는 바깥 쪽에 있는 함수의
첫 번째 인수로도 . 이 자동으로 들어가게 됩니다.
|
에 대한 내용입니다.
sum( length ( . ) ) 의 경우, 바깥 쪽 함수가 sum을 말하고 안쪽 함수는 length를 의미합니다.
dot(.)이 length의 인수로만 쓰였기 때문에 sum의 첫 번째 인수로 .이 자동으로 들어가게 됩니다.
안쪽의 함수가 여러 개라고 해도 바깥쪽 함수에 dot(.)이 자동으로 첫 번째 인수로 제공됩니다.
1:10 %>% c(min(.), max(.)) 는 c(1:10,max(1:10),min(1:10))과 같습니다.
그렇다면 첫 번째 인수로 dot(.)을 주고 싶지 않을 수도 있는데 어떻게 해결해야 할까요?
그런 경우에는 바깥쪽 함수를 ' { } ' 로 감싸주면 됩니다.
그래서 1:10 %>% {c(min(.), max(.))}는 c(min(1:10), max(1:10))와 같습니다.
1:10 %>% c(min(.), max(.)) 는 c(1:10,max(1:10),min(1:10))과 같고
1:10 %>% {c(min(.), max(.))}는 c(min(1:10), max(1:10))와 같습니다.
이해가 되셨나요? 이 정도만 알고 있으면 이해하거나 필요할 때 응용하는데 있어 전혀 문제가
없으리라고 생각됩니다!
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
댓글 0
| 번호 | 제목 | 글쓴이 | 날짜 | 조회 수 |
|---|---|---|---|---|
| 공지 | 오라클 기본 샘플 데이터베이스 | 졸리운_곰 | 2014.01.02 | 86126 |
| 공지 | [SQL컨셉] 서적 "SQL컨셉"의 샘플 데이타 베이스 SAMPLE DATABASE of ORACLE | 가을의 곰을... | 2013.02.10 | 78630 |
| 공지 | [G_SQL] Sample Database | 가을의 곰을... | 2012.05.20 | 95348 |


[출처] [ R ] pipe operator %>% 의 의미 - magrittr 패키지|작성자 토적