커뮤니티
포인트
쿠폰
내 강의실
국비 신청 내역
증명서
계정
로그아웃
학습 질문
개발 일지
나의 활동
답변 완료
웹스크래핑 질문
undefined주차
북마크
신*혁
댓글
6
추천
0
조회수
11
조회수
11
답변 완료
import requests
from bs4 import BeautifulSoup


# URL을 읽어서 HTML를 받아오고,
headers = {'User-Agent' : 'Mozilla/5.0 (Windows NT 10.0; Win64; x64)AppleWebKit/537.36 (KHTML, like Gecko) Chrome/73.0.3683.86 Safari/537.36'}
data = requests.get('https://www.genie.co.kr/chart/top200?ditc=M&rtm=N&ymd=20210701',headers=headers)

# HTML을 BeautifulSoup이라는 라이브러리를 활용해 검색하기 용이한 상태로 만듦
soup = BeautifulSoup(data.text, 'html.parser')

musics = soup.select('#body-content > div.newest-list > div > table > tbody > tr')

for music in musics:
    rank = music.select_one('td.number').text[0:2].strip()
    title = music.select_one('a.title.ellipsis').text.strip()
    artist = music.select_one('a.artist.ellipsis').text.strip()
    print(title)


이렇게 하면 title에 19금 아이콘 때문에 19금 text와 공백이 나서 그런데 19금아이콘을 지우는 방법이 있을까요?

취소
 공유
취소
댓글 0
댓글 알림
나의얼굴