커뮤니티
포인트
쿠폰
내 강의실
국비 신청 내역
증명서
계정
로그아웃
학습 질문
개발 일지
나의 활동
답변 완료
1주차 diabetes 숙제 질문입니다.
undefined주차
북마크
이*수
댓글
5
추천
0
조회수
18
조회수
18
답변 완료

* 겪고 있는 문제 상황을 최대한 자세하게 작성해주세요.

* 문제 해결을 위해 어떤 시도를 해보았는지 구체적으로 함께 알려주세요.



Diabetes.csv 파일에서 Blood pressure, Skin thickness, Insulin, Glucose가 0인 행들이 있는데,

이 데이터도 빼고 분석해야하는 것 아닌가요?

혈압, 피부두께, 인슐린, 혈당 모두 제대로 측정했다면 0이 나올 수 없는 값들인데 0으로 표기되어있다는 것은 결측치라는 뜻인 것 같아서요.


+) 강의에서 알려주신 방법대로 이 0인 값들을 빼기 위해 필터를 걸어서 분석을 돌려도 필터링된 값이 빠지지 않고 분석되는거 같아요. 필터를 걸었을때랑 안걸었을 때랑 xlminer로 돌렸을때 결과값이 같게 나옵니다. 그러면 필터로 데이터를 다듬는건 의미없는 과정 아닌가요?



데이터에 있는 0인 값들

스파르타 즉문즉답


필터로 0인 값은 빼고 돌렸음에도 결과는 같음

스파르타 즉문즉답

혹시 0을 뺐을때만 결과가 똑같은건가 해서 무작위로 몇개 데이터를 더 빼고 돌렸는데도 결과는 완전히 동일하게 나옵니다. 필터로 제거한 것은 XLMiner에서 인식하지 못하는 듯 해요.





취소
 공유
취소
댓글 0
댓글 알림
나의얼굴