커뮤니티
포인트
쿠폰
내 강의실
국비 신청 내역
증명서
계정
로그아웃
학습 질문
개발 일지
나의 활동
답변 완료
1주차 4강 네이버뉴스 스크래핑 관련입니다.
undefined주차
북마크
김*재
댓글
4
추천
0
조회수
27
조회수
27
답변 완료

* 겪고 있는 문제 상황을 최대한 자세하게 작성해주세요.

* 문제 해결을 위해 어떤 시도를 해보았는지 구체적으로 함께 알려주세요.


1-4강의 강의해 주신 내용으로 아래 코딩과 같이 뉴스스크래핑을 하는데 당일날짜의 뉴스검색이 아니고 4월 11일자 이전으로 나오는데요. 오늘기준일자로 뉴스스크래핑을 할 수 있을지요


!pip install bs4 requests

import requests

from bs4 import BeautifulSoup

from openpyxl import Workbook

from datetime import datetime


def get_news(keyword):


  wb= Workbook()

  sheet = wb.active


  headers = {'User-Agent' : 'Mozilla/5.0 (Windows NT 10.0; Win64; x64)AppleWebKit/537.36 (KHTML, like Gecko) Chrome/73.0.3683.86 Safari/537.36'}

  data = requests.get(f'http://13.125.227.101/finance_automation/?keyword={keyword}',headers=headers)


  soup = BeautifulSoup(data.text, 'html.parser')


  lis=soup.select('#main_pack > section.sc_new.sp_nnews._fe_news_collection._prs_nws > div.api_subject_bx > div.group_news > ul>li')


  for li in lis:

    a=li.select_one('a.news_tit')

    row=[a.text,a['href']]

    sheet.append(row)


  today=datetime.today().strftime("%Y-%m-%d")


  wb.save(f"news/{today}_{keyword}.xlsx")

  wb.close()


keywords=['POSCO홀딩스',  '하이브']


for keyword in keywords:


  print(keyword)

  get_news(keyword)



import datetime


today=datetime.date.today()

date_string=today.strftime("%Y%m%d")


!zip -r /content/files.{date_string}.zip /content/news










취소
 공유
취소
댓글 0
댓글 알림
나의얼굴