inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

작업형2 모의문제1

fit할때 X_tr,Y_tr 이 아닌 train으로 할경우 문제

해결된 질문

149

빅분기가자

작성한 질문수 9

0

일단 실기가 명확한 풀이과정이 없기는 하기는 하나저는 X_tr, y_tr로 accuracy_score, precision_score, recall_score, f1_score, roc_auc_score 비교한 뒤에점수가 높은것을 바탕으로 다시 train을 fit시키는게 일반적으로 더 나은 전략이 아닌가싶은데(양이 더많으니까)혹시 이게 크게 리스크가 있다거나 혹은 의미가 없다고 볼수있을까요? 강의에서는 X_tr, y_tr로만 하고 끝내길래 궁금해서 여쭤봅니다.

python 머신러닝 빅데이터 pandas 빅데이터분석기사

답변 1

0

퇴근후딴짓

  1. 평가지표

서로 다른 머신러닝 모델은 비교하는 것은 좋으나 평가지표간에 비교는 할 필요 없습니다.

문제에서 평가지표는 1개로 지정해요.

 

  1. train 전체를 fit

     

    네 이 전략도 좋습니다. 방법중 하나 입니다. 말씀한대로 데이터 전체를 사용할 수 있어요! 알려드리지 않은 이유는 혼란스러워 할 것 같아서 제외했어요.

     

    (다만 실제로 적용해보면 항상 성능이 좋아지진 않아요! )

     

     

     

    더불어 좀 더 명확하게 진행하려면

     

    홀드아웃(train, val 나누는 방식)이 아닌 k-fold 방식으로 크로스 밸리데이션으로 체크후에

     

    train 전체를 fit하는 것이 더 좋습니다. (심화학습)

질문 드립니다.

0

38

2

강의 내용 관련 질문드립니다~

0

34

2

수강 연장 문의

0

32

1

강의자료 일괄 다운로드

0

41

2

수강기간 연장 문의드립니다

0

28

1

list 문제 질문드립니다~

0

29

2

빅분기 실기 12회 재도전

0

39

1

강의 기간 연장 가능여부 검토 요청건

0

30

1

수강기간 연장 문의 드립니다

0

36

2

수강기간 연장 문의드립니다

0

47

2

질문이요

0

51

2

수강기간 연장 문의드립니다.

0

50

2

문제 3-2 질문드립니다

0

44

2

수강기간 연장 문의 드립니다.

0

58

2

변수, 칼럼 , df 구분

0

49

2

수강기간 연장 문의드립니다.

0

49

2

수강기간 연장 문의

0

48

2

수강기간 연장 문의드립니다.

0

41

2

수강기한 연장 문의

0

79

2

수강기간 연장 문의드립니다

0

57

2

결정트리에서 적절한 깊이 선택 후 시각화 과정에서 학습 데이터만 사용하는 이유

0

44

2

수강기간 연장 문의드립니다.

0

71

2

수강연장 문의

0

77

2

수강연장문의

0

53

2