train값과 test값 unique값이 다를 경우에는 어떻게 하면 되나요?
0
train값과 test값 unique값이 다를 경우에는 어떻게 하면 되나요? 저번 수업영상에서 두개를 합친 다음에 인코딩을 진행한다고 하셨던거 같은데 다시 한번 질문드립니다.
답변 1
0
이렇게 코딩할 수 있어요💪
train 데이터 길이는 shape이나 len으로 확인할 수 있고
데이터를 나눌때는 아래와 같이 작업하거나 loc/iloc를 활용할 수도 있어요!
combined = pd.concat([train, test]) # 데이터 합치기
combined_dummies = pd.get_dummies(combined) # 원핫 인코딩
n_train = len(train) # train길이 확인
train = combined_dummies[:n_train] # train데이터 나누기
test = combined_dummies[n_train:] # test데이터 나누기
test = test.drop('target', axis=1) # test데이터에 target컬럼 제거
작업형 2 기출7회분에서
0
13
1
작업형2 모의문제1 (30강)
0
22
2
수강 기간 연장 문의 드립니다.
0
26
2
수강 계획과 관련해 문의 드립니다.
0
24
2
작업형1 - 연습문제 16~39 풀이는 몇강을 보면 되나요?
0
47
2
작업형 1 -연습문제 4-6
0
34
2
작업형 1 유형 부분
0
41
2
작업형 1 (삭제예정, 구 버전)
0
51
2
수강기간 연장 문의드립니다.
0
37
2
2유형 레이블 인코딩 VS 원핫 인코딩
0
36
3
수강기간 연장 문의드립니다.
0
42
2
인덱스 슬라이싱
0
36
2
질문 드립니다.
0
50
2
강의 내용 관련 질문드립니다~
0
46
2
수강 연장 문의
0
63
2
강의자료 일괄 다운로드
0
58
2
수강기간 연장 문의드립니다
0
48
2
list 문제 질문드립니다~
0
38
2
빅분기 실기 12회 재도전
0
63
2
강의 기간 연장 가능여부 검토 요청건
0
50
2
수강기간 연장 문의 드립니다
0
46
2
수강기간 연장 문의드립니다
0
52
2
질문이요
0
57
2
수강기간 연장 문의드립니다.
0
60
2





