
안녕하세요,
이진 논리회귀 실습-타이타닉 생존자 예측 예제에서 질문이 있어 글 남깁니다.
예제에서 x_data를 표준화 하여 논리회귀를 하였는데, 데이터를 표준화하기 위해서
scaler = StandardScaler()
x_data_scaled = scaler.fit_transform(x_data)
print(x_data.values[0])
print(x_data_scaled[0])
위의 코드에서 표준화된 x_data를 x_data_scaled 라는 변수에 저장된 것 같은데 training set을 만들 때
x_train, x_val, y_train, y_val = train_test_split(x_data, y_data, test_size=0.2, random_state=2021)
print(x_train.shape, x_val.shape)
print(y_train.shape, y_val.shape)
표준화된 데이터, x_data_scaled가 아닌 x_data가 사용된 것 같아 제가 제대로 이해하지 못한 부분이 있는지 궁금하여 질문드립니다.
scaler.fit_transform()이라는 함수 자체가 입력된 변수 자체를 표준화 시켜서 x_data라는 변수 자체가 표준화 된 것 인가요?
