
import requests
from bs4 import BeautifulSoup
headers = {'User-Agent' : 'Mozilla/5.0 (Windows NT 10.0; Win64; x64)AppleWebKit/537.36 (KHTML, like Gecko) Chrome/73.0.3683.86 Safari/537.36'}
data = requests.get('https://movie.naver.com/movie/sdb/rank/rmovie.naver?sel=pnt&date=20210829',headers=headers)
soup = BeautifulSoup(data.text, 'html.parser')
#old_content > table > tbody > tr:nth-child(3) > td.title > div > a
#old_content > table > tbody > tr:nth-child(4) > td.title > div > a
movies = soup.select('#old_content > table > tbody > tr')
for movie in movies:
a = movie.select_one('td.title > div > a')
if a is not None:
print(a.text)
여기에서 :nth-child(3) 이 부분은 뭐길래 뺐는지 궁금해요.
나중에 순위랑 평점 가져오는거 혼자 하려고 했지만 어느 부분이 어떤 정보를 말하는 건지 혼자 판단하기 어려워서, 강사님이 하시는걸 봤는데, 그래도 어떤 기준인지 모르겠어요.
