커뮤니티
포인트
쿠폰
내 강의실
국비 신청 내역
증명서
계정
로그아웃
학습 질문
개발 일지
나의 활동
답변 완료
3-16 지니 크롤링 관련 질문
undefined주차
북마크
윤*식
댓글
3
추천
0
조회수
22
조회수
22
답변 완료


지니에서 가져 왔을 때 19금 곡은 앞쪽 아이콘 형식에 텍스트가 있어서 그런지 이상하게 나와서 밑과 같이 수정을 해봤는데 이게 맞는 형식인가요?

뭔가 strip()이 중복 사용 되는게 이상한 것 같고 " strip('19금') "이 위치에 따라서 공백이 안사라지거나 19금이 안사라지는게 왠지 모르겠어서 질문드립니다.

title = music.select_one('td.info > a.title.ellipsis').text.strip()


title = music.select_one('td.info > a.title.ellipsis').text.strip().strip('19금').strip()




스파르타 즉문즉답스파르타 즉문즉답





작성한 코드 및 에러 메세지

import requests
from bs4 import BeautifulSoup

headers = {'User-Agent' : 'Mozilla/5.0 (Windows NT 10.0; Win64; x64)AppleWebKit/537.36 (KHTML, like Gecko) Chrome/73.0.3683.86 Safari/537.36'}
data = requests.get('https://www.genie.co.kr/chart/top200?ditc=M&rtm=N&ymd=20210701',headers=headers)

soup = BeautifulSoup(data.text, 'html.parser')

musics = soup.select('#body-content > div.newest-list > div > table > tbody > tr')

for music in musics:
    title = music.select_one('td.info > a.title.ellipsis').text.strip()
    rank = music.select_one('td.number').text[0:2].strip()
    artist = music.select_one('td.info > a.artist.ellipsis').text

    print(rank, title, artist)


import requests
from bs4 import BeautifulSoup

headers = {'User-Agent' : 'Mozilla/5.0 (Windows NT 10.0; Win64; x64)AppleWebKit/537.36 (KHTML, like Gecko) Chrome/73.0.3683.86 Safari/537.36'}
data = requests.get('https://www.genie.co.kr/chart/top200?ditc=M&rtm=N&ymd=20210701',headers=headers)

soup = BeautifulSoup(data.text, 'html.parser')

musics = soup.select('#body-content > div.newest-list > div > table > tbody > tr')

for music in musics:
    title = music.select_one('td.info > a.title.ellipsis').text.strip().strip('19금').strip()
    rank = music.select_one('td.number').text[0:2].strip()
    artist = music.select_one('td.info > a.artist.ellipsis').text

    print(rank, title, artist)


취소
 공유
취소
댓글 0
댓글 알림
나의얼굴