- 전체
- Sample DB
- database modeling
- [표준 SQL] Standard SQL
- G-SQL
- 10-Min
- ORACLE
- MS SQLserver
- MySQL
- SQLite
- postgreSQL
- 데이터아키텍처전문가 - 국가공인자격
- 데이터 분석 전문가 [ADP]
- [국가공인] SQL 개발자/전문가
- NoSQL
- hadoop
- hadoop eco system
- big data (빅데이터)
- stat(통계) R 언어
- XML DB & XQuery
- spark
- DataBase Tool
- 데이터분석 & 데이터사이언스
- Engineer Quality Management
- [기계학습] machine learning
- 데이터 수집 및 전처리
- 국가기술자격 빅데이터분석기사
- 암호화폐 (비트코인, cryptocurrency, bitcoin)
데이터 수집 및 전처리 [데이터 수집 및 전처리] 네이버 금융(차트)에서 주가 갈무리(크롤링)하기
2023.12.08 23:52
[데이터 수집 및 전처리] 네이버 금융(차트)에서 주가 갈무리(크롤링)하기
* 투자용으로 사용하지 마십시오.
네이버 금융에는 플래시를 이용한 차트 서비스가 있습니다.
https://finance.naver.com/item/fchart.nhn?code=005930

크롬의 네트워크 모니터를 켜고 위 화면의 일봉을 클릭하면 다음 화면을 볼 수 있고...

여기서 다음 주소를 찾을 수 있습니다.
https://fchart.stock.naver.com/sise.nhn?symbol=005930&timeframe=day&count=1500&requestType=0
위 주소에 들어가 보면 XML형식의 삼성전자 일봉을 볼 수 있습니다.

카운트를 늘리니 최대 1990년 01월 03일 데이터까지 볼 수 있네요..
그런데 1990년 1월부터 2월까지의 데이터가 좀 이상합니다.
4만원대군요.. 다른 데이터들과 비교를 해봅니다.

같은 페이지에서 삼성전자의 월봉을 확인하니
3월 까지 보이고 이때 종가는 438원입니다.

이는 제공된 XML 데이터와 일치합니다.
<item data="19900331|435|440|430|438|111870"/>
MSN의 삼성전자 주식 서비스와도 비교를 해봅니다.
https://www.msn.com/ko-kr/money/stockdetails/krx-005930/fi-ajn83m
90년 2월까지의 데이터들은 잘못된 데이터인 것 같네요.
지워줘야 할 것 같습니다.
이제 필요한 정보를 모두 수집했으니 코딩해 봅시다.
import urllib.request
import xml.etree.ElementTree as ET
count = '8000'
code = '005930'
url = f'https://fchart.stock.naver.com/sise.nhn?symbol={code}&timeframe=day&count={count}&requestType=0'
r = urllib.request.urlopen(url)
xml_data = r.read().decode('EUC-KR')
root = ET.fromstring(xml_data)
for index, each in enumerate(root.findall('.//item')):
temp = each.attrib['data'].split('|')
temp[1] = int(temp[1])
temp[2] = int(temp[2])
temp[3] = int(temp[3])
temp[4] = int(temp[4])
temp[5] = int(temp[5])
if temp[0] >= "19900302":
print(index, temp)
[출처] https://comdoc.tistory.com/entry/%EB%84%A4%EC%9D%B4%EB%B2%84-%EA%B8%88%EC%9C%B5%EC%B0%A8%ED%8A%B8%EC%97%90%EC%84%9C-%EC%A3%BC%EA%B0%80-%EA%B0%88%EB%AC%B4%EB%A6%AC%ED%81%AC%EB%A1%A4%EB%A7%81%ED%95%98%EA%B8%B0
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
댓글 0
| 번호 | 제목 | 글쓴이 | 날짜 | 조회 수 |
|---|---|---|---|---|
| 공지 | 오라클 기본 샘플 데이터베이스 | 졸리운_곰 | 2014.01.02 | 86023 |
| 공지 | [SQL컨셉] 서적 "SQL컨셉"의 샘플 데이타 베이스 SAMPLE DATABASE of ORACLE | 가을의 곰을... | 2013.02.10 | 78558 |
| 공지 | [G_SQL] Sample Database | 가을의 곰을... | 2012.05.20 | 95286 |
| 13 |
[데이터 수집 및 전처리] 주식 전종목 어떻게 불러올까? 거래소 종목 불러오기
| 졸리운_곰 | 2023.12.09 | 1701 |
| 12 |
[데이터 수집 및 전처리] [Python/파이썬]네이버증권API 활용 - 회사명, 종목코드 받아오기
| 졸리운_곰 | 2023.12.08 | 1509 |
| » |
[데이터 수집 및 전처리] 네이버 금융(차트)에서 주가 갈무리(크롤링)하기
| 졸리운_곰 | 2023.12.08 | 1495 |
| 10 |
[데이터 수집 및 전처리] 네이버 증권에서 일봉, 주봉 데이터 가져오기
| 졸리운_곰 | 2023.12.08 | 1498 |
| 9 |
[데이터 수집 및 전처리] (놀라운) 한글 데이터 짱! AwesomeKorean_Data
| 졸리운_곰 | 2023.03.07 | 1196 |
| 8 |
[데이터 수집 및 전처리] Crawling, Scraping
| 졸리운_곰 | 2022.05.21 | 1476 |
| 7 |
[데이터분석][데이터수집 전처리] MS 엑셀(Excel)에서 UTF-8 로 된 csv 파일 가져오기
| 졸리운_곰 | 2021.09.30 | 1414 |
| 6 | 카프카 설치 시 가장 중요한 설정 4가지 | 졸리운_곰 | 2021.07.13 | 1925 |
| 5 |
Prometheus Query(PromQL) 기본 이해하기
| 졸리운_곰 | 2020.12.17 | 1413 |
| 4 |
[인프라 모니터링 오픈소스] Prometheus 를 알아보자
| 졸리운_곰 | 2020.12.17 | 1905 |
| 3 |
Prometheus + Grafana 대시보드
| 졸리운_곰 | 2020.12.17 | 2487 |
| 2 |
Grafana란?
| 졸리운_곰 | 2020.12.17 | 2157 |
| 1 | Importing wikipedia dump to MySql | 졸리운_곰 | 2020.10.04 | 2494 |

