딥 러닝 용어 - batch, iteration, epoch  

딥 러닝 도구인 Caffe를 사용하면서 batch_size, max_iter, test_iter, epoch 등의 용어를 이해하는 것이 힘들었어서 이렇게 기록으로 남깁니다. 설명을 쉽게 하기 위해 사진을 Caffe로 처리하는 경우를 가정해 보도록 하겠습니다.

 

1. batch_size

배치(batch)는 한 번에 처리하는 사진의 장 수를 말합니다. Caffe에서 기본으로 제공되는 cifar10 예제의 cifar10_full_train_test.prototxt 파일을 열어보면 batch_size: 100 이라는 부분이 있습니다. 한 번에 100장의 사진을 처리한다는 의미입니다.

 

2. max_iter

반복(이터레이션, iteration)은 몇 개의 배치(batch)를 사용할 것인지를 의미합니다. max_iter는 기계 학습(머신 러닝)의 학습(training) 과정에서 반복을 몇 번 할 것인지를 정해줍니다. cifar10 예제의 cifar10_full_solver.prototxt 파일에 max_iter: 60000 이라고 되어 있는데, batch_size:100 이기 때문에 학습을 한 번에 사진 100장씩 60,000번 하겠다는 말이 됩니다. 총 사진 6,000,000장으로 학습이 이루어질 것입니다. 이 과정에서 사진이 중복될 수 있는데, 그에 대해서는 아래의 세대(이폭, epoch) 에서 설명하겠습니다.

 

3. test_iter

경축! 아무것도 안하여 에스천사게임즈가 새로운 모습으로 재오픈 하였습니다.
어린이용이며, 설치가 필요없는 브라우저 게임입니다.
https://s1004games.com

학습을 했으면 실전에 사용해 보아야 합니다. 예제에서 역시 batch_size:100 으로 되어 있습니다. test_iter:100 으로 설정되어 있는데, 그 말은 한 번에 사진 100장 씩 100번, 총 10,000장의 사진으로 학습 결과를 검사해 보겠다는 뜻입니다.

 

4. epoch

학습용 사진 전체를 딱 한 번 사용했을 때 한 세대(이폭, epoch)이 지나갔다고 말합니다. cifar10의 경우 사진 60,000장 중 50,000장이 학습용, 10,000장이 검사용으로 지정되어 있습니다. 그런데 max_iter에서 학습에 사진 6,000,000장을 사용하기로 했기 때문에 50,000장의 학습용 사진이 여러번 재사용되게 됩니다. 정확히 계산해보면 6,000,000 / 50,000 = 120 이니 한 사진이 120번 씩 재사용될 것입니다. 이 경우 120 세대(epoch)라고 말합니다. 검사용의 경우 사진 10,000장을 사용하기로 했는데 실제로도 사진이 10,000장 있으니 딱 한 세대만 있는 것입니다.

 

( 도움을 얻은 곳: https://groups.google.com/forum/#!topic/caffe-users/mUIi42aKWHQ )



출처: https://crmn.tistory.com/8 [크롬망간이 글 쓰는 공간]

 

 

본 웹사이트는 광고를 포함하고 있습니다.
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
번호 제목 글쓴이 날짜 조회 수
공지 오라클 기본 샘플 데이터베이스 졸리운_곰 2014.01.02 86180
공지 [SQL컨셉] 서적 "SQL컨셉"의 샘플 데이타 베이스 SAMPLE DATABASE of ORACLE 가을의 곰을... 2013.02.10 78666
공지 [G_SQL] Sample Database 가을의 곰을... 2012.05.20 95401
644 Docker에서 SQL Server 컨테이너 이미지 구성 file 졸리운_곰 2020.01.23 1552
643 MSSQL 설치형 한글 환경으로 변경 file 졸리운_곰 2020.01.23 2885
642 FastText, 실전 사용하기 file 졸리운_곰 2020.01.12 1096
641 Generative Models Part 2: ImprovedGAN,InfoGAN,EBGAN file 졸리운_곰 2020.01.09 1202
640 Generative Models Part 1: VAE,GAN,DCGAN file 졸리운_곰 2020.01.09 1152
639 VAE & GAN 간단 비교 file 졸리운_곰 2020.01.09 1099
638 구글 Colab을 이용한 BERT-Base Model 학습하기 file 졸리운_곰 2020.01.08 1078
637 BERT 톺아보기 file 졸리운_곰 2020.01.08 1159
636 BERT 한국어버전(korquad) training 및 evaluating 해보기 file 졸리운_곰 2020.01.08 1001
» 딥 러닝 용어 - batch, iteration, epoch 졸리운_곰 2020.01.08 1068
634 tensorflow 로 mnist 흉내내는 GAN 만들기 file 졸리운_곰 2020.01.08 846
633 텐서플로우(TensorFlow)를 이용해서 MNIST 데이터를 생성하는 GAN(Generative Adversarial Networks) 생성 모델(Generative Model) 구현해보기 – GAN 예제 file 졸리운_곰 2020.01.08 965
632 Tensorflow로 50줄짜리 Original GAN Code 구현하기 졸리운_곰 2020.01.08 1193
631 Inductive bias란? 졸리운_곰 2020.01.05 936
630 형태소 분석기를 이용한 Bert-Multilingual Model 기반 Korquad 결과의 성능 개선 file 졸리운_곰 2020.01.05 1229
629 Bert-Multilingual model을 이용해 KorQuAD 수행해보기 Part 2 제출 file 졸리운_곰 2020.01.05 1181
628 Bert-Multilingual model을 이용해 KorQuAD 수행해보기 Part 1 훈련 및 평가 file 졸리운_곰 2020.01.05 1066
627 [기계독해][MRC] R-NET: MACHINE READING COMPREHENSION WITH SELF-MATCHING NETWORKS file 졸리운_곰 2020.01.05 1164
626 한국어 뉴스 데이터로 딥러닝 시작하기- 6. doc2vec으로 문사 유사도 측정하기 file 졸리운_곰 2020.01.04 1725
625 한국어 뉴스 데이터로 딥러닝 시작하기 - 5. 한국어 word2vec 데모 사이트 만들기 file 졸리운_곰 2020.01.04 961
대표 김성준 주소 : 경기 용인 분당수지 U타워 등록번호 : 142-07-27414
통신판매업 신고 : 제2012-용인수지-0185호 출판업 신고 : 수지구청 제 123호 개인정보보호최고책임자 : 김성준 sjkim70@stechstar.com
대표전화 : 010-4589-2193 [fax] 02-6280-1294 COPYRIGHT(C) stechstar.com ALL RIGHTS RESERVED