
* 겪고 있는 문제 상황을 최대한 자세하게 작성해주세요.
* 문제 해결을 위해 어떤 시도를 해보았는지 구체적으로 함께 알려주세요.
1-4강의 강의해 주신 내용으로 아래 코딩과 같이 뉴스스크래핑을 하는데 당일날짜의 뉴스검색이 아니고 4월 11일자 이전으로 나오는데요. 오늘기준일자로 뉴스스크래핑을 할 수 있을지요
!pip install bs4 requests
import requests
from bs4 import BeautifulSoup
from openpyxl import Workbook
from datetime import datetime
def get_news(keyword):
wb= Workbook()
sheet = wb.active
headers = {'User-Agent' : 'Mozilla/5.0 (Windows NT 10.0; Win64; x64)AppleWebKit/537.36 (KHTML, like Gecko) Chrome/73.0.3683.86 Safari/537.36'}
data = requests.get(f'http://13.125.227.101/finance_automation/?keyword={keyword}',headers=headers)
soup = BeautifulSoup(data.text, 'html.parser')
lis=soup.select('#main_pack > section.sc_new.sp_nnews._fe_news_collection._prs_nws > div.api_subject_bx > div.group_news > ul>li')
for li in lis:
a=li.select_one('a.news_tit')
row=[a.text,a['href']]
sheet.append(row)
today=datetime.today().strftime("%Y-%m-%d")
wb.save(f"news/{today}_{keyword}.xlsx")
wb.close()
keywords=['POSCO홀딩스', '하이브']
for keyword in keywords:
print(keyword)
get_news(keyword)
import datetime
today=datetime.date.today()
date_string=today.strftime("%Y%m%d")
!zip -r /content/files.{date_string}.zip /content/news
