- 전체
- Sample DB
- database modeling
- [표준 SQL] Standard SQL
- G-SQL
- 10-Min
- ORACLE
- MS SQLserver
- MySQL
- SQLite
- postgreSQL
- 데이터아키텍처전문가 - 국가공인자격
- 데이터 분석 전문가 [ADP]
- [국가공인] SQL 개발자/전문가
- NoSQL
- hadoop
- hadoop eco system
- big data (빅데이터)
- stat(통계) R 언어
- XML DB & XQuery
- spark
- DataBase Tool
- 데이터분석 & 데이터사이언스
- Engineer Quality Management
- [기계학습] machine learning
- 데이터 수집 및 전처리
- 국가기술자격 빅데이터분석기사
- 암호화폐 (비트코인, cryptocurrency, bitcoin)
stat(통계) R 언어 [R lang 크롤링] (R) 정규식에서 사용되는 주요 기호들과 의미
2023.12.10 23:36
[R lang 크롤링] (R) 정규식에서 사용되는 주요 기호들과 의미
(R) 정규식에서 사용되는 주요 기호들과 의미
이번에는 많은 문자들 중에서 원하는 문자들만 훨씬 더 쉽게 찾을 수 있도록 도와주는 정규식이라는 기술을 소개하겠습니다. 처리해야 할 데이터 중 문자열일 경우 아래와 같이 다양한 정규식 관련 함수들을 사용하여 데이터를 조회하거나 특정 형태로 처리할 수 있습니다. 정규식은 주어진 문자열에서 특정 조건에 해당되는 것들만 골라서 찾아내는 기능입니다.
|
|
|
|
|
\d
|
Digit, 0,1,2,...9
|
|
|
\D
|
숫자가 아닌 것
|
|
|
\s
|
공백
|
|
|
\S
|
공백이 아닌 것
|
|
|
\w
|
단어
|
|
|
\W
|
단어가 아닌 것
|
|
|
\t
|
Tab
|
|
|
\n
|
New line(엔터 문자)
|
|
|
^
|
시작되는 글자
|
|
|
$
|
마지막 글자
|
|
|
\
|
Escape character (탈출문자), e.g. \ is, \+ is "+"
|
|
|
|
|
두 개 이상의 조건을 동시에 지정. e.g. /(e|d)n/ matches "en" and "dn"
|
|
|
[ab]
|
a 또는 b
|
|
|
[^ab]
|
a와 b를 제외한 모든 문자
|
|
|
[0-9]
|
모든 숫자
|
|
|
[A-Z]
|
영어 대문자
|
|
|
[a-z]
|
영어 소문자
|
|
|
[A-z]
|
모든 영문자(대소문자 전부)
|
|
|
i+
|
i가 최소 1회는 나오는 경우
|
|
|
i*
|
i가 최소 0회 이상 나오는 경우
|
|
|
i?
|
i가 최소 0회에서 최대 1회만 나오는 경우
|
|
|
i{n}
|
i가 연속적으로 n회 나오는 경우
|
|
|
i{n1,n2}
|
i가 n1 에서 n2 회 나오는 경우
|
|
|
i{n,}
|
i가 n 회 이상 나오는 경우
|
|
|
[:alnum:]
|
문자와 숫자가 나오는 경우: [:alpha:] and [:digit:]
|
|
|
[:alpha:]
|
문자가 나오는 경우 : [:lower:] and [:upper:]
|
|
|
[:blank:]
|
공백이 있는 경우 : e.g. space, tab
|
|
|
[:cntrl:]
|
제어문자가 있는 경우
|
|
|
[:digit:]
|
Digits : 0 1 2 3 4 5 6 7 8 9
|
|
|
[:graph:]
|
Graphical characters : [:alnum:] and [:punct:]
|
|
|
[:lower:]
|
소문자가 있는 경우
|
|
|
[:print:]
|
숫자, 문자, 특수문자, 공백 모두 : [:alnum:], [:punct:] and space
|
|
|
[:punct:]
|
특수 문자 예 : ! " # $ % ^ & ' ( ) * + , - . / : ; < = > ? @ [ \ ] _ ~
|
|
|
[:space:]
|
공백문자 : tab, newline, vertical tab, form feed, carriage return, space
|
|
|
[:upper:]
|
대문자가 있는 경우
|
|
|
[:xdigit:]
|
16진수가 있는 경우 : 0 1 2 3 4 5 6 7 8 9 A B C D E F a b c d e f
|
|
코딩짜실때 참고하시면 편하게 짤 수 있습니다.
질문이나 지적할 점은 댓글로 해주세요!
[출처] https://m.blog.naver.com/jk940/221341970825
본 웹사이트는 광고를 포함하고 있습니다.
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
댓글 0
| 번호 | 제목 | 글쓴이 | 날짜 | 조회 수 |
|---|---|---|---|---|
| 공지 | 오라클 기본 샘플 데이터베이스 | 졸리운_곰 | 2014.01.02 | 86194 |
| 공지 | [SQL컨셉] 서적 "SQL컨셉"의 샘플 데이타 베이스 SAMPLE DATABASE of ORACLE | 가을의 곰을... | 2013.02.10 | 78670 |
| 공지 | [G_SQL] Sample Database | 가을의 곰을... | 2012.05.20 | 95410 |
| 13 |
[데이터 수집 및 전처리] 주식 전종목 어떻게 불러올까? 거래소 종목 불러오기
| 졸리운_곰 | 2023.12.09 | 1701 |
| 12 |
[데이터 수집 및 전처리] [Python/파이썬]네이버증권API 활용 - 회사명, 종목코드 받아오기
| 졸리운_곰 | 2023.12.08 | 1509 |
| 11 |
[데이터 수집 및 전처리] 네이버 금융(차트)에서 주가 갈무리(크롤링)하기
| 졸리운_곰 | 2023.12.08 | 1495 |
| 10 |
[데이터 수집 및 전처리] 네이버 증권에서 일봉, 주봉 데이터 가져오기
| 졸리운_곰 | 2023.12.08 | 1499 |
| 9 |
[데이터 수집 및 전처리] (놀라운) 한글 데이터 짱! AwesomeKorean_Data
| 졸리운_곰 | 2023.03.07 | 1197 |
| 8 |
[데이터 수집 및 전처리] Crawling, Scraping
| 졸리운_곰 | 2022.05.21 | 1476 |
| 7 |
[데이터분석][데이터수집 전처리] MS 엑셀(Excel)에서 UTF-8 로 된 csv 파일 가져오기
| 졸리운_곰 | 2021.09.30 | 1415 |
| 6 | 카프카 설치 시 가장 중요한 설정 4가지 | 졸리운_곰 | 2021.07.13 | 1928 |
| 5 |
Prometheus Query(PromQL) 기본 이해하기
| 졸리운_곰 | 2020.12.17 | 1413 |
| 4 |
[인프라 모니터링 오픈소스] Prometheus 를 알아보자
| 졸리운_곰 | 2020.12.17 | 1906 |
| 3 |
Prometheus + Grafana 대시보드
| 졸리운_곰 | 2020.12.17 | 2488 |
| 2 |
Grafana란?
| 졸리운_곰 | 2020.12.17 | 2158 |
| 1 | Importing wikipedia dump to MySql | 졸리운_곰 | 2020.10.04 | 2494 |

