인프런 커뮤니티 질문&답변

스툼님의 프로필 이미지
스툼

작성한 질문수

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

4회 기출 유형(작업형2)

Label Encoding 방법에 대한 차이

해결된 질문

작성

·

316

0

강의를 듣다보니 범주형 데이터일 때, Label Encoding을 하는 방법이 2가지가 있더라고요

  1. from sklearn.preprocessing import LabelEncoder

  2. astype('category').cat.codes

2가지 경우가 결과물에 어떻게 영향을 미치게 될까요?

일단 한 문제로 두 방법으로 인한 roc_auc_score를 검증했을 땐, 유의차가 없었습니다.

답변 1

0

퇴근후딴짓님의 프로필 이미지
퇴근후딴짓
지식공유자

네 현재 기출 문제에서 출제된 데이터로는 차이가 없습니다. 인코딩하는 방식은 매우 다양하고 어떤 방식으로던 인코딩하면 됩니다.

다만 train과 test 카테고리(종류)가 다르다면 합쳐서 인코딩 진행해 주세요!

스툼님의 프로필 이미지
스툼

작성한 질문수

질문하기