안녕하세요, 코딩팡 장업형2 베이스 라인에서 원-핫 인코딩만 사용하셨는데 인코딩 부분에 아래와 같이 추가해서 레이블 인코딩과 원-핫 인코딩 결과를 비교하는 식으로 해도 상관없나요? 원핫 인코딩만 사용하신 이유가 있을까요?? 1번 문제 import pandas as pd # 1) 데이터 불러오기 train = pd.read_csv('data/car_train.csv') test = pd.read_csv('data/car_test.csv') # 2) 범주형 변수 원-핫 인코딩 target = train.pop('target') print(train.shape, test.shape) train = pd.get_dummies(train) test = pd.get_dummies(test) print(train.shape, test.shape) # 레이블 인코딩 from sklearn.preprocessing import LabelEncoder cols = train.select_dtypes(include = 'object').columns for col in cols: le = LabelEncoder() train[col] = le.fit_transform(train[col]) test[col] = le.transform(test[col]) # 3) 검증용 분리 (제출 전 성능 비교) from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=0, stratify=target) # 4) 세 가지 모델 학습 from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit(X_tr, y_tr) pred = rf.predict(X_val) from sklearn.metrics import f1_score print(f1_score(y_val, pred, average='macro')) from lightgbm import LGBMClassifier lgb = LGBMClassifier(random_state=0, verbose=-1) lgb.fit(X_tr, y_tr) pred = lgb.predict(X_val) print(f1_score(y_val, pred, average='macro')) from xgboost import XGBClassifier xgb = XGBClassifier(random_state=0, verbosity=0) xgb.fit(X_tr, y_tr) pred = xgb.predict(X_val) print(f1_score(y_val, pred, average='macro')) # 5) 선택한 모델을 전체 train으로 다시 학습 후 test 예측 (선택) # lgb.fit(train, target) # pred = lgb.predict(test) # 6) 제출 파일 저장 (pred 컬럼 1개만, index 제거) result = pd.DataFrame({'pred': pred}) result.to_csv('result.csv', index=False) # 제출파일 확인 print("\n ===== 제출파일 (샘플) =====") print(pd.read_csv("result.csv").head()) print("\n ===== 제출파일 (크기 확인) =====") print(pd.read_csv("result.csv").shape)
강사님 uv setting 대로 실습을 진행하는 도중에 아카이브 tool 호출 시 아래의 에러가 발생했습니다. AttributeError: 'Search' object has no attribute 'results' uv add "arxiv<2.4.1" 로 다운그레이드 해서 해결했습니다. 혹시나 동일한 에러가 나시는 분들을 위해 남겨둡니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 기출 풀어보면 C를 안 붙이고, object도 자연스럽게 변환된다고 하셨는데, 연습할 때 gender에 C를 붙였던 경험이 있습니다. 혹시 언제 붙이고 언제 안 붙이는지 알 수 있을까욤..?
이 강의에서는 그러 github 코드를 클론에서 그거 토대로 그대로 실습해보는건가요? 저는 제로에서 혹은 next.kit프로젝트 폴더에 이어서 셋팅해서 연습하는 줄 알았는데.. 두서 설명없이 바로 넘어가니 조금 이상하네요. 전 처음부터 새로 해서 prd생성하고해서 이 프로젝트를 직접 완성해보는건줄알앗느데 그게 아니면 .이미 프롬프트로 만들어진 이걸 클론해서 따라해보는 용도인가요?
빅데이터분석기사 실기체험에서 작업형 제2유형을 회귀 실습해보고 있는데. 에러가 나는데 이유를 전혀모르겠어요. import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") target = train.pop('총구매액') train = pd.get_dummies(train) test = pd.get_dummies(test) from sklearn.ensemble import RandomForestRegressor model = RandomForestRegressor() model.fit (train, target) p = model.predict(test) submit = pd.DataFrame({'pred':p}) submit.to _csv("result.csv", index=False) print(submit.head()) 에러) Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 38, in <module> p = model.predict(test) ^^^^^^^^^^^^^^^^^^^ File "/usr/local/lib/python3.12/site-packages/sklearn/ensemble/_ forest.py ", line 1063, in predict X = self._validate_X_predict(X) ^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/usr/local/lib/python3.12/site-packages/sklearn/ensemble/_ forest.py ", line 641, in validate X_predict X = self._validate_data( ^^^^^^^^^^^^^^^^^^^^ File "/usr/local/lib/python3.12/site-packages/sklearn/ base.py ", line 608, in validate data self._check_feature_names(X, reset=reset) File "/usr/local/lib/python3.12/site-packages/sklearn/ base.py ", line 535, in check feature_names raise ValueError(message) ValueError: The feature names should match those that were passed during fit. Feature names seen at fit time, yet now missing: - 주구매상품_소형가전
여기에 올라온 install command 관련 문의를 다 훑어보았는데, 해결이 되지 않고 있습니다. 'cursor' 대신 'code' 도 안나오고 VS code 지웠다가 다시 깔고, 관리자 권한으로 실행해도 안나옵니다. 클로드에게 직접 물어보라 하셔서 물어봤는데 문제가 없다고 나옵니다.
안녕하세요. 좋은 강의 잘 들었습니다. 몇가지 문의 드립니다. aevaluate 이 정상적이지 않아서 evaluate를 사용하는데, evaluate를 사용할때 wrapper 를 안쓰면 최종결과를 얻지 못할수 있어서 wrapper 를 사용한다고 하셨는데요. evaluate 의 첫번째 파라미터는 함수를 넘겨야 하니 run_agent_to_completion 를 자연스럽게 만들게 되지 않나요? run_agent_to_completion 를 안쓴다면 어떤식으로 evaluate 코드를 작성하게 되는지 궁금합니다. agent 에 따라, 질문에 대해 바로 답을 주는게 아니라 HITL 을 발생시키고, 사용자의 추가 정보에 따라 최종 답변을 주는 agent 가 있을수 있습니다. 이 경우 어떤식으로 평가를 하면 좋을까요? 강의에 사용하셨던 영상에서 몇몇 부분 링크를 참고하라고 하셨는데, 링크 정보를 어디서 얻을수 있을까요? 예를들면 아래와 같은 부분 입니다. (강의소개에 적어주신 노션과 깃헙에서는 못찾아서 여쭤봅니다.) 2강 - 4분 10초 경 Amazon 링크 4강 - 1분 8초 경 세일즈포스트 링크 " '운영에 배포할만한 가치가 있는 agent 인가?'를 평가한다 "는 말이 기억에 남습니다. 감사합니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 실기시험 응시 가이드를 보면 제2유형은 pred 컬럼 하나만 생성한다고 적혀있는데, 이러면 다중분류의 roc-auc 문제는 나올 확률이 거의 없다고 봐도 될까요?