inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

예시문제 작업형2(ver. 2023)

예시문제 작업형2(신 버전)

해결된 질문

477

작성자 없음

작성한 질문수 0

0

문제 지문에서알려주는 제출 CSV 파일 형식은 0, 1, 1, 0 ... 이런 predict 결과값인데

0.11385 와 같이 predict_proba 확률값으로 결과를 제출해도 괜찮은 이유가 궁금합니다!

roc_auc가 predict_proba 로 해야한다면 predict_proba로 모형 성능테스트를 하고 제출은 predict로 해야하는 것이 아닌가... 라는 의문이 들어서 문의드립니다

 

 

python 머신러닝 빅데이터 pandas 빅데이터분석기사

답변 2

1

dhguseo

저도 이 부분이 궁금했는데.. 그러면 문제에서의 예시 파일은 무시하고 roc_aur_score이면 predict_proba로 성능평가 및 결과 출력하고 f1_score인 경우에는 predict으로 성능평가 및 결과를 출력하면 된다는 말씀이신거죠?

0

퇴근후딴짓

네 회귀에서도 예측한 결과가 예시 파일과 달리 소수점으로 나올거에요~

그대로 제출하면 됩니다.

예시 파일은 무시는 아니고 형태는 참고해서 제출합니다.

0

퇴근후딴짓

이진분류에서 평가지표 roc-auc는 각 예측에 대한 1이 속할 확률정보로 계산합니다. 따라서 1확률값을 제출하는 것이 맞아요!

predict_proba로 모형 성능테스트를 하고 제출은 predict로 해야하는 것이 아닌가

-> 잘못된 방식입니다. predict로 제출하려면 모델 성능평가도 predict로 평가 해야 합니다. predict으로 제출해도 roc-auc를 채점하는 것에는 문제는 없습니다. 다만 성능이 조금 떨어집니다.

 

회귀 평가 지표에서도 동일합니다.

회귀 모델 예측결과에서 소수점이 나온다고 해서 정수처리할 필요 없습니다.

작업형 2 기출7회분에서

0

14

1

작업형2 모의문제1 (30강)

0

22

2

수강 기간 연장 문의 드립니다.

0

27

2

수강 계획과 관련해 문의 드립니다.

0

24

2

작업형1 - 연습문제 16~39 풀이는 몇강을 보면 되나요?

0

47

2

작업형 1 -연습문제 4-6

0

34

2

작업형 1 유형 부분

0

42

2

작업형 1 (삭제예정, 구 버전)

0

51

2

수강기간 연장 문의드립니다.

0

37

2

2유형 레이블 인코딩 VS 원핫 인코딩

0

37

3

수강기간 연장 문의드립니다.

0

42

2

인덱스 슬라이싱

0

36

2

질문 드립니다.

0

50

2

강의 내용 관련 질문드립니다~

0

46

2

수강 연장 문의

0

63

2

강의자료 일괄 다운로드

0

58

2

수강기간 연장 문의드립니다

0

48

2

list 문제 질문드립니다~

0

38

2

빅분기 실기 12회 재도전

0

63

2

강의 기간 연장 가능여부 검토 요청건

0

50

2

수강기간 연장 문의 드립니다

0

46

2

수강기간 연장 문의드립니다

0

52

2

질문이요

0

57

2

수강기간 연장 문의드립니다.

0

60

2