[ChatGPT] naver.com의 새 게시물을 키워드로 스크랩하고 mongodb를 저장하는 프로그래밍

Naver.com의 새 게시물을 키워드로 스크랩하고 결과를 Python을 사용하여 MongoDB에 저장하려면 다음 단계를 따르세요.

  1. 필요한 라이브러리를 설치합니다: beautifulsoup4, pymongo, requests.

  2. 필요한 라이브러리를 가져오고 MongoDB 연결을 정의합니다.

 
파이썬
from bs4 import BeautifulSoup from pymongo import MongoClient import requests client = MongoClient('mongodb://localhost:27017/') db = client['news'] collection = db['naver']
  1. 키워드로 새 게시물을 스크랩하고 MongoDB에 저장하는 기능을 정의합니다.
 
파이썬
def scrape_naver_news(keyword): url = f"https://search.naver.com/search.naver?where=news&sm=tab_jum&query={keyword}" response = requests.get(url) soup = BeautifulSoup(response.text, "html.parser") articles = soup.select(".news_wrap .news_area") for article in articles: title = article.select_one(".news_tit").text.strip() link = article.select_one(".news_tit a")["href"] summary = article.select_one(".news_dsc").text.strip() date = article.select_one(".info .info_time").text.strip() data = {"title": title, "link": link, "summary": summary, "date": date} collection.insert_one(data)

이 함수는 키워드를 매개변수로 받아 키워드를 사용하여 Naver.com에서 뉴스를 검색할 URL을 구성하고 HTML 응답을 검색하고 BeautifulSoup을 사용하여 응답을 구문 분석하고 뉴스 기사를 선택하고 관련 데이터(제목, 링크, 요약)를 추출합니다. , 및 날짜), 데이터로 사전을 구성하고 MongoDB 컬렉션에 저장합니다.

  1. 원하는 키워드로 함수를 호출하여 scrape_naver_news뉴스 기사 스크래핑을 시작하고 MongoDB에 저장합니다.
 
파이썬
scrape_naver_news("example")

이렇게 하면 Naver.com에서 키워드 "example"에 대한 새 게시물을 스크랩하고 결과 뉴스 기사를 MongoDB 컬렉션에 저장합니다. 애플리케이션에 필요한 대로 키워드 및 MongoDB 연결 세부 정보를 사용자 지정할 수 있습니다.

경축! 아무것도 안하여 에스천사게임즈가 새로운 모습으로 재오픈 하였습니다.
어린이용이며, 설치가 필요없는 브라우저 게임입니다.
https://s1004games.com

 

naver.com의 새 게시물을 키워드로 스크랩하고 mongodb를 저장하는 프로그래밍.png

naver.com의 새 게시물을 키워드로 스크랩하고 mongodb를 저장하는 프로그래밍.png

 

 

본 웹사이트는 광고를 포함하고 있습니다.
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
대표 김성준 주소 : 경기 용인 분당수지 U타워 등록번호 : 142-07-27414
통신판매업 신고 : 제2012-용인수지-0185호 출판업 신고 : 수지구청 제 123호 개인정보보호최고책임자 : 김성준 sjkim70@stechstar.com
대표전화 : 010-4589-2193 [fax] 02-6280-1294 COPYRIGHT(C) stechstar.com ALL RIGHTS RESERVED