inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

피처 엔지니어링

3-4 민맥스스케일링에 대해 다시질문할게용 ㅠㅠ

해결된 질문

266

jms717958

작성한 질문수 9

0

  1. 강의에서 코딩하셨던 민맥스스케일링 코드에서 범주형 수치형데이터 분리없이 바로 X_train[cols]로 써도되나요? )

2,. 코딩 옆에 n_train[cols]=scaler.fit_transform[cols] 라고 적혀있었는데 여기서 왼쪽의 n_train[cols]를 n_train으로 바꿔적어도될까요? 안되면 그 이유가 궁금합니다

 

python 머신러닝 빅데이터 pandas 빅데이터분석기사

답변 2

1

Kyewon(은서.후.채)

LabelEncoder도 혹시 수치형, 범주형 안나누고 그냥 사용해도 되나요?

0

퇴근후딴짓

네 분리하지 않고 진행하면 됩니다.

시험이 어려워질 경우를 대비해 분리하는 방법을 처음부터 알려드렸는데

작업형2는 난이도가 유지되고 있어 아무런 문제가 없을 것 같아요!

0

퇴근후딴짓

당장 내일이 7회 시험이니 결론만 내려드리겠습니다.

수치형과 범주형 데이터를 나누지 말고 한번에 처리하는 방향으로 진행해주세요!

예시 코드는 아래와 같습니다.

from sklearn.preprocessing import MinMaxScaler
import pandas as pd

# 임시 데이터셋 생성
data_train = {
    'Age': [25, 35, 45, 55],
    'Salary': [40000, 50000, 60000, 80000]
}
data_test = {
    'Age': [30, 40, 50, 60],
    'Salary': [45000, 55000, 65000, 85000]
}
df_train = pd.DataFrame(data_train)
df_test = pd.DataFrame(data_test)


# MinMaxScaler 
scaler = MinMaxScaler()
# 스케일링을 적용할 컬럼 선택
cols = ['Age', 'Salary']


# Train 데이터셋에 fit_transform 적용
df_train[cols] = scaler.fit_transform(df_train[cols])
# Test 데이터셋에 transform 적용
df_test[cols] = scaler.transform(df_test[cols])

# 결과 출력
print("Train Data:")
print(df_train)
print("\nTest Data:")
print(df_test)

강의 연장 문의

0

6

1

수강 신청 연장 문의드립니다.

0

18

1

작업형 1번문제... 환경관련

0

24

2

12회 기출은 언제 업데이트 될까요??

0

34

2

8/6 작성한 연장문의 질문글에 대한 재요청

0

36

2

수강기간 연장 문의

0

33

2

수강기간 연장문의

0

35

2

수강기간 연장 요청 문의드립니다

0

35

2

수강 기간 연장 문의

0

44

2

수강연장 가능 문의 (기간 약 한달반)

0

57

2

수강기간 연장 가능할까요 선생님

0

72

2

Section15. 수업에 사용하는 데이터 주소가 다 보이지 않아서 실습을 위한 데이터를 다운 받지 못하고 있습니다.

0

50

3

수강연장요청 문의

0

84

2

아무래도 다음 시험 연장은 어렵겠죠?

0

104

2

빅분기 12회 결과 관련 문의

0

110

1

책이랑 강의랑 순서나 예제가 다른것 같네요

0

79

2

수강연장 문의

0

102

2

재검토 요청 방법 좀 알려주셔요...-.-;;

0

102

2

12회 실기 질문(작업형 2)

0

89

2

뒤로가기 버튼 같은 것이 있나요?

0

63

1

강의 연장 문의

0

97

2

출력값 질문

0

69

2

수업노트가 어디에 있나요?

0

62

1

실기시험 제출관련

0

224

3