inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

모델링 및 평가(분류)

모델링 및 평가(분류) 강의에서

해결된 질문

217

뚜디니

작성한 질문수 13

0

아래 보시면 학습용 데이터와 검증용 데이터로 구분하는 것은 이해가 되는데, y부터 마지막까지의 식이 왜 나오는지 이해가 안됩니다...다시 설명 부탁드립니다.

# 학습용 데이터와 검증용 데이터로 구분
from sklearn.model_selection import train_test_split
y = (y_train['income'] == '>50K').astype(int)
X_tr, X_val, y_tr, y_val = train_test_split(X_train, y, test_size=0.1, random_state=2000)

python 머신러닝 빅데이터 pandas 빅데이터분석기사

답변 1

1

퇴근후딴짓

문자를 0과 1로 변환하기 위해 사용했어요!

y는

'income'이 '>50K'인 경우 1,

그렇지 않은 경우 0인 이진(target) 변수로 변환하기 위해 작성한 코드에요

 

그럼 무조건 문자일때 변경해야 하느냐?

아니요!

모델 학습까지는 변환하지 않더라도 정상 작동 됩니다.

선택의 문제인데

일부 평가지표에서 추가적인 설정이 필요할 때가 있어 0과 1로 변환했습니다. (타겟이 문자일 때 평가지표 강의 영상 확인 요청)

 

어떤 의미냐?

1 조건: y_train['income'] == '>50K' -> True 또는 False가 나옴

2 자료형 변경: .astype(int) -> 논리 연산의 결과(True/False)를 정수형(int)으로 변환 True 1, False0

 

기출에서 사용된적 있냐?

없습니다. 어렵다면 일단은 패스하고 넘어가주세요!

난이도가 올라갔을 때를 가정했습니다.

원핫인코딩과 레이블 인코딩에서 concat

0

12

2

제2유형 질문입니다.

0

23

2

C()

0

19

2

작업형 2에서 strafity 적용 유무

0

27

2

수강 기간 연장 가능 여부 문의드립니다.

0

21

1

ols

0

22

2

2유형 작성관련 질문(일반 심화)

0

22

2

2유형 작성관련 질문

0

19

2

2유형 object컬럼 개수 다르면

0

23

2

코딩팡질문이요ㅠㅠ

0

23

2

관찰값과 기대값의 개념이 헷갈립니다.

0

13

2

작업형2 ID 컬럼 삭제 질문

0

23

2

2유형 작성관련 질문

0

21

2

memoryerror 질문

0

18

2

작업형 유형2 이렇게 고정 템플릿으로 가져가도 될까요?

0

22

1

ID 삭제 필수 인가요?

0

19

3

7회 기출문제 작업형1번 df 변환 후 저장되는 방식 질문

0

17

2

3 유형 귀무가설, 대립가설

0

21

2

인코딩 관련 질문 있습니다

0

24

2

작업형3 이원분산분석 sm에서불러오기 / anova_lm 차이

0

29

2

2유형 원핫인코딩 오류

0

24

2

시험장에서 주석 단축키 안될 때 많나요?

0

29

2

라벨인코딩 방식

0

29

2

test 재학습 관련

0

19

2