공공 데이터 csv 파일로 저장하기 [2]

센트럴리밋 2017.07.20 17:22

전술한 바와 같이 파트2 에서는 array로 저장된 데이터를 디스크에 csv 포맷으로 기록하는 파이썬 코드를 작성해 보도록하자.

여기서 우리는 디스크에 파이썬 데이터를 csv 포맷으로 저장하기 위해서 pandas라는 파이썬 라이브러리를 쓸 것이다.

 

그런데 이 때 array를 numpy.array로 바꿔줌으로써, pd.write하기에 좋은 형태로 바꾸어 주자.

item_numpy_list = np.array(item_list)

 

3. numpy append method

기능: 여기서 numpy_appender는 우리가 값을 저장할 파일을 정하고, 그 파일에 numpy list를 덧붙여서 저장한다.

구현: 이를 위해서, item_numpy_list(덧붙이려고 하는 데이터) 에 해당하는 데이터 프레임을 만들고, 이를 tmp.csv 에 저장한다.

그리고 그 pandas로 그 csv를 읽어와서 를 통해,  tmp_csv.to_csv(f,header=False,index = False)

전체 데이터 셋에 더하도록 한다. (굳이 이렇게 하는 이유는, 그냥 add할 경우, 위의 label row 가 덧붙여지기 때문이다.)

import pandas as pd
import numpy as np 
import codecs 
 

 

def numpy_appender(path, item_numpy_list): df = pd.DataFrame(item_numpy_list) df.to_csv("tmp.csv",encoding='EUC-KR',header = False,index = False ) #temp.csv 에 numpylist저장 tmp_csv = pd.read_csv('tmp.csv',encoding='EUC-KR') #다시 읽어옴. with codecs.open('nottmp.csv','a',encoding="EUC-KR") as f: tmp_csv.to_csv(f,header=False,index = False)

경축! 아무것도 안하여 에스천사게임즈가 새로운 모습으로 재오픈 하였습니다.
어린이용이며, 설치가 필요없는 브라우저 게임입니다.
https://s1004games.com

     이와 같은 절차를 거쳐, 루프를 순회하면서 읽어들이는 리스트들을, nottmp.csv에 적을 수 있다.

 

이들을 모두 합쳐놓은 메소드는 아래와 같다.

 

def item_writer(localcode, timecode, local_name, path): xml_string = query_sender(localcode,timecode) item_list = xml_to_item_list(xml_string,local_name,time_code) item_numpy_list = np.array(item_list) numpy_appender(path, item_numpy_list)

즉 item_writer 는 local code 와 time_code그리고, local code에 해당하는 name을 받아 공공데이터에 쿼리를 보내, 실제 부동산 거래 데이터들을 

path에 있는 파일에 저장하는 메소드이다.

 

이제 부록에 해당하는 part3 에서는, 

이 메소드들을 활용하여, 월들을 순회하면서 해당 데이터들을 콜렉팅하여 csv file 로 저장하는 코드에 대해서 알아보도록 하겠다.



출처: http://superelement.tistory.com/16 [아마추어 엔지니어 노트]

출처: http://superelement.tistory.com/16 [아마추어 엔지니어 노트]

 

 

본 웹사이트는 광고를 포함하고 있습니다.
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
번호 제목 글쓴이 날짜 조회 수
42 Django에서 MySQL DB를 연동하기 pycharm file 졸리운_곰 2018.04.10 732
41 Python Flask 로 간단한 REST API 작성하기 file 졸리운_곰 2018.04.07 496
40 증권뉴스데이터 수집(3/3편) 졸리운_곰 2018.02.18 709
39 증권뉴스데이터 수집(2/3편) 졸리운_곰 2018.02.18 437
38 증권뉴스 데이터 수집(1.5/3.0) 졸리운_곰 2018.02.18 482
37 증권뉴스 데이터 수집(1/3) file 졸리운_곰 2018.02.18 601
36 python 활용 웹 사이트가 존재하는지 체크 : Python check if website exists 졸리운_곰 2018.01.16 446
35 파이썬3을 이용하여 코인원,빗썸,코빗의 가상화폐 시세정보를 불러오는 프로그램을 만들었다. file 졸리운_곰 2017.12.02 716
34 네이버 실시간 검색어를 자동 추출하는 방법 file 졸리운_곰 2017.11.14 631
33 Cinema 3 - (Extremely Simplified) Example of Microservices in Python file 졸리운_곰 2017.08.03 395
32 나만의 웹 크롤러 만들기 with Requests/BeautifulSoup file 졸리운_곰 2017.07.08 586
31 Web Scraping using Python / FinAlgML(놀러온특강) Python을 통한 웹 스크래핑 및 DB화 file 졸리운_곰 2017.07.08 728
30 PiP - Python in PHP 졸리운_곰 2017.05.06 893
29 Developing a RESTful micro service in Python file 졸리운_곰 2017.03.06 1120
28 BitTorrent 프로토콜의 동작원리 file 졸리운_곰 2017.02.26 1014
27 Torrent의 원리 file 졸리운_곰 2017.02.26 1445
26 How to automatically search and download torrents with Python and Scrapy 졸리운_곰 2017.02.26 774
25 Web scraping, article extraction and sentiment analysis with Scrapy, Goose and TextBlob 졸리운_곰 2017.02.26 395
24 [Python] 네이버 주식 종목별 일별 데이터 가져오기 file 졸리운_곰 2017.02.24 1869
23 [파이썬으로 웹 크롤러 만들기] 크롤링 시작하기(3/3) file 졸리운_곰 2017.02.16 705
대표 김성준 주소 : 경기 용인 분당수지 U타워 등록번호 : 142-07-27414
통신판매업 신고 : 제2012-용인수지-0185호 출판업 신고 : 수지구청 제 123호 개인정보보호최고책임자 : 김성준 sjkim70@stechstar.com
대표전화 : 010-4589-2193 [fax] 02-6280-1294 COPYRIGHT(C) stechstar.com ALL RIGHTS RESERVED