기출3회 작업형2
혹시 수치형과 범주형데이터를 분리했다가 합치지 말고,
바로 원핫인코딩을 진행해서 해도 괜찮을까요?
또, max_depth도 꼭 필요한지, 어디서 적용해야하는지도 궁금합니다
답변 3
0
3회 기출유형 작업형2
Q1. 범주형 변수 인코딩에서 원핫인코딩을 했는데, 원핫인코딩 전과 후가 동일해보여요! 왜그러는 걸까요?
display(c_train.head(), c_test.head())
c_train = pd.get_dummies(c_train)
c_test = pd.get_dummies(c_test)
display(c_train.head(), c_test.head())
Q2. 랜덤포레스트를 활용한 모델 학습 및 예측에서 [:,1] 은 왜 사용하는 건가요?
pred = rf.predict_proba(X_val) [:,1]
Q3. 데이터 예측 및 생성에서 test.index 부분에서 에러가 발생된다고 떠요, 왜 그러는 걸까요?
pd.DataFrame({
'index' : test.index
'y_pred' : pred
})
0
범주형만 할 필요 없으니 전체로 해보시죠
train = pd.get_dummies(train)
test = pd.get_dummies(test)
확률값으로 예측되기 때문이에요 이진 분류인 경우 0확률과 1확률이고
[:,1]은 두번째인 1확률을 이야기 합니다.
https://inf.run/rBx8rtest.index는 10회에서는 필요가 없긴한데
기출 3회에서는 필요했어요 어떤 에러인가요?
0
max_depth는 사용하지 않아도 됩니다 🙂 생략하시죠!
네 수치형, 범주형 분리 없이
한 번에 인코딩 해도 됩니다!!
꿀팁 섹션에 한 가지 방법으로 풀기 보셔도 됩니다.
0
안녕하세요, 인프런 AI 인턴입니다. 최혜인님.
수치형과 범주형 데이터를 분리하지 않고 바로 원핫인코딩을 적용하는 것은 가능합니다. pd.get_dummies() 함수는 데이터프레임 내에서 자동으로 범주형 변수만 선택하여 인코딩을 진행하기 때문에, 이는 편리하고 오류를 줄이는 방법입니다. 따라서 데이터 전체에 대해 원핫인코딩을 적용해도 대부분의 경우 문제가 발생하지 않습니다. 이 방법은 수치형 데이터는 그대로 유지되며, 대부분의 머신러닝 모델에서 사용 가능합니다.
max_depth는 트리 기반 모델의 훈련에서 매우 중요한 하이퍼파라미터입니다. 이 파라미터는 트리의 최대 깊이를 지정하며, 모델의 복잡성을 조절합니다. 일반적으로 max_depth는 너무 작으면 과소적합(underfitting), 너무 크면 과적합(overfitting)을 초래할 수 있습니다. 따라서 데이터에 맞춰 적절히 설정해야 합니다. max_depth는 주로 결정 트리(decision tree), 랜덤 포레스트(Random Forest), 그리고 그레디언트 부스팅(Gradient Boosting) 모델에 적용됩니다.
원핫인코딩 및 max_depth 사용에 대한 추가적인 설명이나 사례를 원하시면, 아래 유사한 질문과 답변을 참조해보세요:
- 원핫인코딩 적용 예제
- 트리 기반 모델에서 max_depth 활용하기
저는 질문자님의 이해를 돕고자 지식공유자님의 기존 답변을 참고하여 유사한 답변 링크를 추천해드리고 있습니다.
현재 베타 기능으로 답변이 만족스럽지 않을 수 있는 점 양해 부탁드립니다. 🙏
추가적으로 궁금한 점이 있으시면, 이어서 질문해 주세요. 곧 지식공유자께서 답변해 주실 것입니다.
작업형 2 기출7회분에서
0
14
1
작업형2 모의문제1 (30강)
0
22
2
수강 기간 연장 문의 드립니다.
0
27
2
수강 계획과 관련해 문의 드립니다.
0
24
2
작업형1 - 연습문제 16~39 풀이는 몇강을 보면 되나요?
0
47
2
작업형 1 -연습문제 4-6
0
34
2
작업형 1 유형 부분
0
42
2
작업형 1 (삭제예정, 구 버전)
0
51
2
수강기간 연장 문의드립니다.
0
37
2
2유형 레이블 인코딩 VS 원핫 인코딩
0
37
3
수강기간 연장 문의드립니다.
0
42
2
인덱스 슬라이싱
0
36
2
질문 드립니다.
0
50
2
강의 내용 관련 질문드립니다~
0
46
2
수강 연장 문의
0
63
2
강의자료 일괄 다운로드
0
58
2
수강기간 연장 문의드립니다
0
48
2
list 문제 질문드립니다~
0
38
2
빅분기 실기 12회 재도전
0
63
2
강의 기간 연장 가능여부 검토 요청건
0
50
2
수강기간 연장 문의 드립니다
0
46
2
수강기간 연장 문의드립니다
0
52
2
질문이요
0
57
2
수강기간 연장 문의드립니다.
0
60
2





