공공 데이터 csv 파일로 저장하기 [2]

센트럴리밋 2017.07.20 17:22

전술한 바와 같이 파트2 에서는 array로 저장된 데이터를 디스크에 csv 포맷으로 기록하는 파이썬 코드를 작성해 보도록하자.

여기서 우리는 디스크에 파이썬 데이터를 csv 포맷으로 저장하기 위해서 pandas라는 파이썬 라이브러리를 쓸 것이다.

 

그런데 이 때 array를 numpy.array로 바꿔줌으로써, pd.write하기에 좋은 형태로 바꾸어 주자.

item_numpy_list = np.array(item_list)

 

3. numpy append method

기능: 여기서 numpy_appender는 우리가 값을 저장할 파일을 정하고, 그 파일에 numpy list를 덧붙여서 저장한다.

구현: 이를 위해서, item_numpy_list(덧붙이려고 하는 데이터) 에 해당하는 데이터 프레임을 만들고, 이를 tmp.csv 에 저장한다.

그리고 그 pandas로 그 csv를 읽어와서 를 통해,  tmp_csv.to_csv(f,header=False,index = False)

전체 데이터 셋에 더하도록 한다. (굳이 이렇게 하는 이유는, 그냥 add할 경우, 위의 label row 가 덧붙여지기 때문이다.)

import pandas as pd
import numpy as np 
import codecs 
 

 

def numpy_appender(path, item_numpy_list): df = pd.DataFrame(item_numpy_list) df.to_csv("tmp.csv",encoding='EUC-KR',header = False,index = False ) #temp.csv 에 numpylist저장 tmp_csv = pd.read_csv('tmp.csv',encoding='EUC-KR') #다시 읽어옴. with codecs.open('nottmp.csv','a',encoding="EUC-KR") as f: tmp_csv.to_csv(f,header=False,index = False)

경축! 아무것도 안하여 에스천사게임즈가 새로운 모습으로 재오픈 하였습니다.
어린이용이며, 설치가 필요없는 브라우저 게임입니다.
https://s1004games.com

     이와 같은 절차를 거쳐, 루프를 순회하면서 읽어들이는 리스트들을, nottmp.csv에 적을 수 있다.

 

이들을 모두 합쳐놓은 메소드는 아래와 같다.

 

def item_writer(localcode, timecode, local_name, path): xml_string = query_sender(localcode,timecode) item_list = xml_to_item_list(xml_string,local_name,time_code) item_numpy_list = np.array(item_list) numpy_appender(path, item_numpy_list)

즉 item_writer 는 local code 와 time_code그리고, local code에 해당하는 name을 받아 공공데이터에 쿼리를 보내, 실제 부동산 거래 데이터들을 

path에 있는 파일에 저장하는 메소드이다.

 

이제 부록에 해당하는 part3 에서는, 

이 메소드들을 활용하여, 월들을 순회하면서 해당 데이터들을 콜렉팅하여 csv file 로 저장하는 코드에 대해서 알아보도록 하겠다.



출처: http://superelement.tistory.com/16 [아마추어 엔지니어 노트]

출처: http://superelement.tistory.com/16 [아마추어 엔지니어 노트]

 

 

본 웹사이트는 광고를 포함하고 있습니다.
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
번호 제목 글쓴이 날짜 조회 수
15 [python 데이터분석] [jupyter] 주피터 노트북에 이미지 삽입 file 졸리운_곰 2025.09.06 526
14 [python 데이터분석] [Python] Streamlit 사용법 (python 데이터분석 웹 만들기) file 졸리운_곰 2024.12.22 462
13 [python 데이터분석] Anaconda : Error while loading conda entry point: conda-libmamba-solver (libarchive.so.19: cannot open shared object file: No such file or directory) 졸리운_곰 2024.12.14 520
12 [python 데이터분석] Anaconda | Conda update 반영 안됨(update 후에도 버전 변경 없음) file 졸리운_곰 2024.11.18 431
11 [python 데이터분석] Keeping Anaconda Up To Date 졸리운_곰 2024.05.30 552
10 [python 데이터 분석] 국내 경제 100대 통계지표 졸리운_곰 2024.02.18 672
9 [python 데이터 분석] Python 에서 R언어 패키지 호출 : Calling R From Python With rpy2 file 졸리운_곰 2024.01.28 676
8 [python 데이터 분석] 파이썬을 활용한 코스피, 달러 환율정보 수집부터 차트 시각화까지 file 졸리운_곰 2023.12.11 735
7 [Python 데이터분석][pandas] [Python pandas] DataFrame의 문자열 칼럼을 숫자형으로 바꾸기 : pd.to_numeric(), DataFrame.astype() file 졸리운_곰 2023.12.09 357
6 [Python 데이터분석] [Python 환경설정] VS code 설치 및 Anaconda와 연동하기 file 졸리운_곰 2023.03.17 527
5 [Python 데이터분석][python 데이터분석 프로덕션] [Python] Docker를 사용한 Dash 웹앱 생성 file 졸리운_곰 2021.12.10 403
4 [Python 데이터분석] [pandas] 공공데이터(csv) 활용시 한글 깨짐 현상 해결 file 졸리운_곰 2021.09.30 592
3 [Python 데이터분석] 공공데이터포털::공휴일 데이터 조회 (REST API) file 졸리운_곰 2021.09.30 358
2 [Python 데이터 분석] pandas의 to_csv()를 사용해서 csv 파일로 저장하기(save 하기) 졸리운_곰 2021.09.29 603
1 [Python 데이터 분석] 데이터 과학을 단순하게 만드는 3가지 Python 패키지 file 졸리운_곰 2021.09.24 513
대표 김성준 주소 : 경기 용인 분당수지 U타워 등록번호 : 142-07-27414
통신판매업 신고 : 제2012-용인수지-0185호 출판업 신고 : 수지구청 제 123호 개인정보보호최고책임자 : 김성준 sjkim70@stechstar.com
대표전화 : 010-4589-2193 [fax] 02-6280-1294 COPYRIGHT(C) stechstar.com ALL RIGHTS RESERVED