작성한 질문수
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
4회 기출 유형(작업형2)
해결된 질문
작성
·
316
0
강의를 듣다보니 범주형 데이터일 때, Label Encoding을 하는 방법이 2가지가 있더라고요
from sklearn.preprocessing import LabelEncoder
astype('category').cat.codes
2가지 경우가 결과물에 어떻게 영향을 미치게 될까요?
일단 한 문제로 두 방법으로 인한 roc_auc_score를 검증했을 땐, 유의차가 없었습니다.
답변 1
네 현재 기출 문제에서 출제된 데이터로는 차이가 없습니다. 인코딩하는 방식은 매우 다양하고 어떤 방식으로던 인코딩하면 됩니다.
다만 train과 test 카테고리(종류)가 다르다면 합쳐서 인코딩 진행해 주세요!