inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

172만명의 커뮤니티!! 함께 토론해봐요.

실기 체험 제2유형 에러 문의

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

빅데이터분석기사 실기체험에서 작업형 제2유형을 회귀 실습해보고 있는데. 에러가 나는데 이유를 전혀모르겠어요. import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") target = train.pop('총구매액') train = pd.get_dummies(train) test = pd.get_dummies(test) from sklearn.ensemble import RandomForestRegressor model = RandomForestRegressor() model.fit (train, target) p = model.predict(test) submit = pd.DataFrame({'pred':p}) submit.to _csv("result.csv", index=False) print(submit.head()) 에러) Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 38, in <module> p = model.predict(test) ^^^^^^^^^^^^^^^^^^^ File "/usr/local/lib/python3.12/site-packages/sklearn/ensemble/_ forest.py ", line 1063, in predict X = self._validate_X_predict(X) ^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/usr/local/lib/python3.12/site-packages/sklearn/ensemble/_ forest.py ", line 641, in validate X_predict X = self._validate_data( ^^^^^^^^^^^^^^^^^^^^ File "/usr/local/lib/python3.12/site-packages/sklearn/ base.py ", line 608, in validate data self._check_feature_names(X, reset=reset) File "/usr/local/lib/python3.12/site-packages/sklearn/ base.py ", line 535, in check feature_names raise ValueError(message) ValueError: The feature names should match those that were passed during fit. Feature names seen at fit time, yet now missing: - 주구매상품_소형가전

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
윤나 댓글 1 좋아요 0 조회수 80

LIGHTGBM 으로 하면 pred값이 소수점 6자리까지 나오는게 맞나요

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

문제에서는 0.17 0.33 처럼 제출하라고 되어있는데. LIGHTGBM 으로 예측하면 소수점이 더 길게 나오자나요. 이렇게 제출해도 문제가 없는걸까요? 아니면 반올림처리해서 제출해야하나요.....

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
sexyguybhc 댓글 2 좋아요 0 조회수 70

3번문제 등분산 가정

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

1번 풀 때 구한 분산을 보면, 두 집단의 분산이 각각 0.37과 0.5 수준으로 분산이 다른데, 어떻게 등분산이라고 가정할 수 있나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
최유진 댓글 2 좋아요 0 조회수 64

작업형3 target 형 변환 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 작업형 2에서 target 변수가 n개의 지표로 이루어졌지만 (ex. 0: Low, 1: Mid, 2: High) info 결과 수치형이면 따로 object로 변환해주는 작업이 필요할까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김민성 댓글 2 좋아요 0 조회수 52

[작업형1] 연습문제 섹션1 ~ 10 의 section4

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

df['views']의 상위 10개에 중복이 있어서, 11번째를 최소값으로 보고 풀었는데, 어떻게 생각하시는지요? 10 15535.0 100 15535.0

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
yjukim96 댓글 3 좋아요 0 조회수 67

원핫인코딩과 레이블 인코딩에서 concat

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

drop하고 남은 train 과 test 데이터에서 유니크 수가 다른 컬럼이 있는데 레이블 인코딩에서는 concat으로 데이터를 합쳤다가 나누어주는 과정이 필요없나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
lisajimin 댓글 2 좋아요 0 조회수 76

제2유형 질문입니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 실기시험 응시 가이드를 보면 제2유형은 pred 컬럼 하나만 생성한다고 적혀있는데, 이러면 다중분류의 roc-auc 문제는 나올 확률이 거의 없다고 봐도 될까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
taek2aek 댓글 2 좋아요 0 조회수 60

C()

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

회귀와 로지스틱 회귀 문제에서 데이터가 숫자이지만 범주형 변수라고 지정할 때에만 C()를 붙여야 한다고 하셨는데 "일원분산분석"과 "이원분산분석"에서는 ols()에서 모든 독립변수에 C()를 붙여도 되는 것이 맞나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
토우마 댓글 2 좋아요 0 조회수 54

작업형 2에서 strafity 적용 유무

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 작업형 2에서 분류 문제 시, 범주끼리 수 차이가 크면 stratify나 class_weight를 설정하는데 분류문제에서는 무조건 설정하는 것이 좋을까요?? 아니면 다른 하이퍼파라미터 튜닝도 제외해야 할지 고민입니다.. 저번 시험 후기를 보니 오히려 아무것도 설정하지 않은 상태가 더 점수가 높게 나왔다고 하여 고민입니다 ㅜㅜ

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김민성 댓글 2 좋아요 0 조회수 66

수강 기간 연장 가능 여부 문의드립니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 현재 수강 중인 강의의 수강 기간 연장 가능 여부를 문의드립니다. 처음 강의를 신청했을 때는 이번 회차 시험에 맞춰 끝까지 수강하고 응시하는 것을 목표로 했으나 학업 일정과 개인 일정이 겹치면서 계획했던 만큼 충분히 수강하지 못했습니다. 그 결과 아직 진도율이 많이 부족하고 강의와 문제풀이를 제대로 정리하지 못한 상태라 이번 회차 시험에서는 합격이 쉽지 않을 것 같다고 판단하고 있습니다. 다만 수강한 부분만으로도 개념을 잡는 데 도움이 되었고 강의 흐름에 맞춰 끝까지 따라가면 혼자 준비하는 것보다 훨씬 체계적으로 정리할 수 있겠다는 생각이 들었습니다. 그래서 가능하시다면 이번 한 번만 다음 회차 시험 준비 기간까지 수강 기간을 연장해 주실 수 있을지 부탁드립니다. 물론 수강 기간 연장이 당연한 요청이 아니라는 점은 잘 알고 있습니다. 연장해 주신다면 남은 강의를 끝까지 수강하고 부족한 부분을 보완하여 다음 시험에는 좋은 결과를 낼 수 있도록 성실히 준비하겠습니다. 바쁘시겠지만 한 번만 검토해 주시면 정말 감사하겠습니다. 감사합니다. 메일 주소: kjm69451@naver.com

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김주현 댓글 2 좋아요 0 조회수 103

ols

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

6:27초에서 df_metl에 존재하는 variable 변수가 범주형 변수인데 ols('value ~ C(variable)', ~~~~) 이런 식으로 적지 않아도 되나요? 영상에서는 C로 감싸지 않았는데요

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
토우마 댓글 2 좋아요 0 조회수 55

2유형 작성관련 질문(일반 심화)

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

샘 일반에서 (3가지 돌렸을때 에러일때 작은숫자를 선택하라하셨느데요) 일반에서는 거의 (960, 1000) 이란 숫자가 심화에선(600, 700대 숫자가나왔으면) 이건 일반과 심화를 비교하는건 아니죠? 심화한사람들인 훨 점수가 더 높은건가요? 숫자가 훨씬 더 작은니까요??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
yeoun123 댓글 2 좋아요 0 조회수 45

2유형 작성관련 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

2유형 보내주신 메일 잘 받았습니다. 감사합니다 샘 3가지 유형을 돌리고 나서 가장 좋은거 선택하고 나머지 2개는 주석처리 하면 5번 새로생긴항목 안해도 되는거죠~~

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
yeoun123 댓글 2 좋아요 0 조회수 47

2유형 object컬럼 개수 다르면

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 2유형 object컬럼에서 개수 다르면 어떻게 해야하나요? 확인 안 하고 레이블인코딩, 랜덤포레스트, lgbm으로만 연습하고 있었는데 object 컬럼에서 안에 개수가 다르면 레이블인코딩을 못 쓰는게 아닐까요..?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
rosana8831 댓글 2 좋아요 0 조회수 55

코딩팡질문이요ㅠㅠ

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 코딩팡학습하다가 의문이 생겨서요 작업형2 문제에서 나머지문제는 다 40점 나오는데 3번문제만 어떤방법을 써도 25점 이상 안올라가요..ㅠㅠ 이유가 뭔지 알길이 없네요.. 문제 다 똑같은 형식으로 제출했습니다. train = pd.get_dummies ( train ) test = pd.get_dummies ( test ) from sklearn.model_selection import train_test_split X_tr , X_val , y_tr , y_val = train_test_split ( train , target , test_size= 0.2 , random_state= 0 ) from sklearn.ensemble import RandomForestRegressor rf = RandomForestRegressor ( random_state= 0 ) rf.fit ( X_tr , y_tr ) pred = rf.predict ( X_val ) from sklearn.metrics import root_mean_squared_error print ( root_mean_squared_error ( y_val , pred )) import lightgbm as lgb lg = lgb.LGBMRegressor ( random_state= 0 , verbose= -1 ) lg.fit ( X_tr , y_tr ) pred = lg.predict ( X_val ) print ( root_mean_squared_error ( y_val , pred )) import xgboost as xgb xg = xgb.XGBRegressor ( random_state= 0 , n_estimators = 400 ) xg.fit ( X_tr , y_tr ) pred = xg.predict ( X_val ) print ( root_mean_squared_error ( y_val , pred )) lg.fit ( train , target ) -> pred = lg.predict(test) 로도 해봤어요! pred = lg.predict ( test ) submit = pd.DataFrame ({ 'pred' : pred }) submit.to _csv ( 'result.csv' , index= False ) print ( pd.read _csv ( 'result.csv' ))

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
jeelf67 댓글 2 좋아요 0 조회수 53

관찰값과 기대값의 개념이 헷갈립니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

관찰값이라면 말그대로 실제로 관측된값이고 기대값은 관측이 되지않았지만 기대할 값이라는것 같은데 이문제에서는 이번회차를 관측값으로 두고 지난 3년을 기대값으로 뒀는데 왜 지난3년이 기대값이 되는건가요..?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이강현 댓글 2 좋아요 0 조회수 28

작업형2 ID 컬럼 삭제 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 작업형2에 대한 질문입니다. train, test 모두 id 컬럼이 있는 경우에 train, test 모두 id 컬럼을 제외해도 되는지 궁금합니다. 제외하려는 이유는 모델의 예측결과가 id 컬럼과는 무관할 것 같기 때문인데 test 셋을 건드는게 조심스러워 질문드립니다. 만약에 제거하게 된다면 train, test 모두에서 제거해야 하는지, train에서만 제거해야 하는지 궁금합니다. 데이터 예시는 아래와 같습니다. ID 연월 업종명 이용자구분 성별 이용자수 이용건수 0 ID_6105 202212 비알콜 음료점업 동남아 알수없음 151 173.0 1 ID_6125 202212 슈퍼마켓 기타외국 알수없음 66 71.0 2 ID_6773 202306 한식 음식점업 법인 알수없음 146682 165699.0 감사합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김민성 댓글 2 좋아요 0 조회수 49

2유형 작성관련 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

2유형 보내주신 메일 잘 받았습니다. 감사합니다 샘 3가지 유형을 돌리고 나서 가장 좋은거 선택하고 나머지 2개는 주석처리 하면 5번 새로생긴항목 안해도 되는거죠~~

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
yeoun123 댓글 2 좋아요 0 조회수 35

memoryerror 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 올려주신 모의문제 작업형 2유형 2번 문제를 푸는 도중 아래와 같은 에러가 발생했습니다. 코드 문법 관련된 오류는 아닌 것 같은데, 시험장에서도 이런 오류가 발생할 가능성이 있을까요? 감사합니다. Traceback (most recent call last): File "<exec>", line 22, in <module> File "/lib/python3.12/site-packages/sklearn/base.py", line 1389, in wrapper return fit_method(estimator, *args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/lib/python3.12/site-packages/sklearn/ensemble/_forest.py", line 487, in fit trees = Parallel( ^^^^^^^^^ File "/lib/python3.12/site-packages/sklearn/utils/parallel.py", line 77, in __call__ return super().__call__(iterable_with_config) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/lib/python3.12/site-packages/joblib/parallel.py", line 1918, in __call__ return output if self.return_generator else list(output) ^^^^^^^^^^^^ File "/lib/python3.12/site-packages/joblib/parallel.py", line 1847, in _get_sequential_output res = func(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^ File "/lib/python3.12/site-packages/sklearn/utils/parallel.py", line 139, in __call__ return self.function(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/lib/python3.12/site-packages/sklearn/ensemble/_forest.py", line 189, in _parallel_build_trees tree._fit( File "/lib/python3.12/site-packages/sklearn/tree/_classes.py", line 472, in _fit builder.build(self.tree_, X, y, sample_weight, missing_values_in_feature_mask) File "_tree.pyx", line 153, in sklearn.tree._tree.DepthFirstTreeBuilder.build File "_tree.pyx", line 268, in sklearn.tree._tree.DepthFirstTreeBuilder.build File "_tree.pyx", line 923, in sklearn.tree._tree.Tree._add_node File "_tree.pyx", line 892, in sklearn.tree._tree.Tree._resize_c File "_utils.pyx", line 29, in sklearn.tree._utils.safe_realloc MemoryError: could not allocate 63832064 bytes

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
2142073 댓글 2 좋아요 0 조회수 33

작업형 유형2 이렇게 고정 템플릿으로 가져가도 될까요?

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 시험이 얼마 남지 않은 상황에서 아래와 같은 템플릿을 작업형 2유형에 대한 고정 템플릿으로 가져가는게 괜찮은지 여쭤보고싶습니다. 올려주신 모의문제 기준으로는 25/40점을 기록하여 노파심에 여쭤봅니다. 감사합니다. *분류 문제는 RandomForestClassifier, 회귀문제는 RandomForestRegressor 쓸 예정이며, 평가지표가 roc-auc인 경우 predict()를 predict_proba로 바꿔야한다는 점까지는 인지하고 있습니다. import pandas as pd train = pd.read_csv('data/car_train.csv') test = pd.read_csv('data/car_test.csv') # print(train.head()) # print(test.head()) # target : target (분류) # 데이터 전처리 target = train.pop('target') temp = pd.concat([train, test]) temp = pd.get_dummies(temp) train = temp.iloc[:len(train)] test = temp.iloc[len(train):] # 모델 정의 및 훈련 from sklearn.ensemble import RandomForestClassifier model = RandomForestClassifier() model.fit(train, target) p = model.predict(test) # csv 파일 만들기 및 확인 submit = pd.DataFrame({'pred': p}) submit.to_csv("result.csv", index = False) result = pd.read_csv("result.csv") print(result.head())

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
2142073 댓글 1 좋아요 0 조회수 52

인기 태그

인프런 TOP Writers

주간 인기글