[빅데이터분석기사] 실기 : 시험 후기, [자격증] 빅데이터분석기사 실기 합격 후기 (비전공자 문과)

[자격증] 빅데이터분석기사 실기 합격 후기 (비전공자 문과)

빅데이터분석기사 자격증 실기 시험 합격 후기 (최종 합격 후기) 

✔ 시험 환경, 시험 준비, 기출문제 복원, 시험 결과 

 

 

지난 2021년 6월 19일에 있었던 제 2회 빅데이터 분석기사 실기시험의 결과가 오늘 발표되어 최종 합격하였다. 

 

 

???? 시험 응시 언어 및 환경


1. 언어 : 실기시험에서 파이썬과 R 중 선택할 수 있는데 일단 난 파이썬으로 응시했다.

2. 환경 : 클라우드 기반 IDE 환경으로 시험을 봐야하며 시각화가 불가능하다. IDE는 주로 코딩 테스트에 이용되는 환경이다. 보통 데이터 분석을 하는 경우엔 Jupyter Notebook 등을 사용하여 라인별 실행을 하고 자동 완성 기능을 자주 사용하게 되는데 그런 기능은 불가능하니 시험 전 반드시 IDE환경으로 연습을 해봐야 한다. 시험 중 메모장은 사용 가능하기 때문에 작업형 풀 때 아이디어를 중간중간 적어놓을 수 있다.

3. 주의사항 : 오픈북이 아니므로 사용할 라이브러리와 코드를 잘 숙지해가야 한다. 라이브러리에 대한 정보가 잘 기억이 나지 않는 경우 help() 함수와 dir() 함수를 사용할 수 있다. 사실 난 이전에 주피터 노트북의 자동완성 기능을 사용했었기 때문에 이 함수들을 사용해본 적이 잘 없었는데, 이 시험에선 help() 함수와 dir() 함수가 생각보다 정말 유용하게 사용된다.

4. 시험 환경을 체험해볼 수 있는 사이트
구름devth (https://devth.goorm.io/)
온코더 (https://www.oncoder.com/ground/r1KQacTxQ)
프로그래머스 (https://programmers.co.kr/learn/challenges)

 

 


???? 시험 준비


이 시험은 2회차이지만 지난 1회차가 코로나로 인해 취소되어 사실상 첫 시험이기 때문에 기출문제가 없었다. 또한 첫 시험이다보니 필기 시험에서 시중 문제집들의 적중률이 크게 떨어져서인지 문제집 회사들은 이번 실기 시험 문제집을 출간하지 않았다. 따라서 따로 공부할 교재는 없었으며 그 대신 시험 출제기관인 한국 데이터산업 진흥원에서 제공한 예상문제가 있어서 시험 전 예상문제를 풀어보았다.

예상문제 

 

 

 

 


???? 총 공부 기간

 

경축! 아무것도 안하여 에스천사게임즈가 새로운 모습으로 재오픈 하였습니다.
어린이용이며, 설치가 필요없는 브라우저 게임입니다.
https://s1004games.com

빅데이터 분석기사 실기시험 3일 전부터 공부를 시작했다. 사실 공부기간을 더 투입하고 싶어도, 첫 시험인지라 시중 문제집도 없고 기출문제도 없었기에 공부기간이 짧을 수밖에 없었다. 그리고 예상문제는 데이터산업 진흥원에서 공개한 각 유형별 1개씩의 문제만 있었기 때문에, 3일동안 작업형1과 작업형2를 반복적으로 풀어보는 방식으로 공부했다. 

 



???? 출제 경향 (기출 문제 복원) 


1. 단답형
한 문항당 3점씩 10개 문항이 출제된다. 솔직히 단답형을 가장 걱정했는데 필기시험에 출제된 개념 위주로 나와서 다행이었다. 참고로 단답형 답 복원은 아래의 게시글에서 확인할 수 있다. 
 

2. 작업형 1
한 문항당 10점씩 3개 문항이 출제된다. 데이터가 주어지면 해당 데이터를 바탕으로 문제를 풀면 된다. 전처리에 필요한 작업들을 잘 수행할 수 있는지 테스트하는 듯 하다. 내 기억으로 시험에서 출제된 문제는 다음과 같았다. 

작업형 1 기출문제 

1) 주어진 데이터셋의 컬럼1에서 상위 10개의 데이터에 대하여 10개 중 최솟값으로 대체한 후, 컬럼2에서 값이 80 이상인 데이터들 중 컬럼1의 평균값 구하기 


2) 주어진 데이터셋 중 앞에서부터 80% 데이터를 샘플링하여 특정 컬럼의 표준편차를 구하고, 해당 컬럼에서 결측치를 중앙값으로 대체한 후 표준편차를 구하여 그 두가지 표준편차의 차이 구하기

3) 주어진 데이터셋에서 특정 컬럼의 이상치를 IQR rule에 의해 탐지하고 이상치들의 합을 구하기 



3. 작업형 2
배점 40점의 1개 문항이 출제된다. 데이터가 주어지면 해당 데이터를 바탕으로 필요한 전처리와 feature engineering, 모델링(앙상블 기법 사용), 하이퍼 파라미터 최적화, 교차검증 등을 수행한다. 내 기억으로 시험에서는 배송이 지연될지 안될지에 대한 여부를 예측하는 문제가 나왔다. 데이터셋에서 운송수단, 창고 종류, 택배 회사와의 연락 여부, 이전에 택배를 주문한 적이 있었는지 여부, 금액 할인을 얼마나 받았는지 등의 컬럼이 주어졌고 배송이 지연될 확률을 구하면 되었다. 또한 성능 지표는 데이터 진흥원에서 공개했었던 예상문제와 동일하게 ROC-AUC로 평가한다고 되어 있었다. 
원래 캐글이나 데이콘 등에서 대회에 참가해본 경험이 있는 사람이라면 데이터 전처리부터 모델링까지 해보았을 것이므로 어렵지 않게 풀 수 있는 문제였다.
 

 


???? 결과
 

 

 

단답형 24/30, 작업형 제1유형 30/30, 작업형 제2유형 40/40 으로 결과는 총점 94점으로 합격하였다. ????
과락기준은 없으며 총점 60점을 넘으면 합격한다. 이번이 첫 시험이라 그런지 난이도를 무난하게 출제한 것 같다고 느꼈다.
필기시험에 합격하였다면 단답형은 따로 준비할 필요가 없을 것 같고 작업형 1과 작업형 2 같은 경우에는 평소에 전처리부터 모델링까지 직접 코드를 치면서 연습해보고 예상문제를 스스로 변형가면서 풀어보기를 추천한다. 이 글을 보신 분들도 꼭 한번에 합격하시길 기원!

 



출처: https://gagadi.tistory.com/35 [가디의 tech 스터디]

 

 

 

본 웹사이트는 광고를 포함하고 있습니다.
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
번호 제목 글쓴이 날짜 조회 수
공지 오라클 기본 샘플 데이터베이스 졸리운_곰 2014.01.02 86664
공지 [SQL컨셉] 서적 "SQL컨셉"의 샘플 데이타 베이스 SAMPLE DATABASE of ORACLE 가을의 곰을... 2013.02.10 79029
공지 [G_SQL] Sample Database 가을의 곰을... 2012.05.20 95787
46 [데이터분석 & 데이터 사이언스] 수많은 데이터 사이언티스트들이 직장을 떠나는 이유는 무엇인가? file 졸리운_곰 2025.03.09 906
45 [데이터분석][파이썬][python] 한글 글꼴 사용 (matplotlib) 졸리운_곰 2024.04.18 1360
44 [데이터분석 & 데이터 사이언스] 데이터에 관한 꼭 알아야 할 오해와 진실 12가지 졸리운_곰 2024.01.17 1317
43 [데이터분석][파이썬][python] Awesome Dash Awesome file 졸리운_곰 2021.07.10 2341
42 [데이터분석][파이썬][python] ???? Introducing Dash ???? file 졸리운_곰 2021.07.10 1609
41 [dataset] (한글) 욕설 감지 데이터셋 file 졸리운_곰 2021.05.12 1559
40 [데이터분석][python] Dash를 사용하는 초보자 및 기타 모든 사용자를위한 Python의 대시 보드 file 졸리운_곰 2021.04.14 1764
39 [데이터분석][python] Dash를 사용하는 초보자 및 기타 모든 사용자를위한 Python의 대시 보드 file 졸리운_곰 2021.04.14 1605
38 [데이터분석][데이터 사이언스][python][Dash] Python, Dash 및 Plotly를 사용하여 COVID-19 사례 데이터 시각화 file 졸리운_곰 2021.03.28 1503
37 [데이터분석][머신러닝] When not to use machine learning or AI Adventures in wishful thinking, nonstationarity, and pattern-finding / 기계 학습 또는 AI를 사용하지 않아야하는 경우 희망찬 사고, 비정상 성, 패턴 찾기의 모험 file 졸리운_곰 2021.03.28 21623
36 [MSA][머신러닝] 쿠버네티스 기반의 End2End 머신러닝 플랫폼 Kubeflow #1 - 소개 file 졸리운_곰 2021.03.21 1137
35 [데이터사이언스] 데이터 과학자를위한 3 가지 훌륭한 디자인 패턴, 3 Great Design Patterns for Data Scientists file 졸리운_곰 2021.03.04 782
34 [데이터분석] 시계열 데이터에 AI를 사용하는 이유는 무엇입니까? file 졸리운_곰 2021.02.28 1193
33 [데이터분석] AI 예측 및 이상 탐지를위한 시계열 데이터 전처리 file 졸리운_곰 2021.02.28 1033
32 [데이터분석] bitcoin analysis 비트 코인 시계열 데이터에 대한 AI 이상 탐지 file 졸리운_곰 2021.02.27 1596
31 [데이터분석 & 데이터 사이언스] How To Create a Data Science Portfolio Website file 졸리운_곰 2021.02.14 1825
30 [데이터수집4] 오픈 API 데이터 수집 (소셜미디어 데이터 수집) file 졸리운_곰 2020.06.12 1952
29 [데이터수집3] 관계형 데이터베이스 데이터 수집 file 졸리운_곰 2020.06.12 1320
28 [데이터수집2] 분산시스템 로그 수집 (빅데이터 수집) file 졸리운_곰 2020.06.12 1495
27 [데이터수집1] 웹 크롤링, 웹 스크래핑 file 졸리운_곰 2020.06.12 1804
대표 김성준 주소 : 경기 용인 분당수지 U타워 등록번호 : 142-07-27414
통신판매업 신고 : 제2012-용인수지-0185호 출판업 신고 : 수지구청 제 123호 개인정보보호최고책임자 : 김성준 sjkim70@stechstar.com
대표전화 : 010-4589-2193 [fax] 02-6280-1294 COPYRIGHT(C) stechstar.com ALL RIGHTS RESERVED