안녕하세요. 강의 수강 중인 학생입니다. 강의에서 사용하는 Replit의 UI가 현재 버전과 많이 달라져서(실행 버튼 위치, 파일 생성 방식 등) 강의를 그대로 따라가기가 조금 어려운 상황입니다. 혹시 강의 내용을 Replit 대신 Visual Studio Code(VS Code)를 사용해서 진행해도 학습이나 실습에 큰 문제는 없을까요? 단순 파이썬 문법 학습 및 실습 목적이라면 VS Code 환경으로 따라가도 되는지 궁금합니다. 확인 부탁드립니다. 감사합니다.
수고하십니다.^^ 12회 빅분기 시험을 보고 왔는데, 통과 되는 선까지는 풀었는데,... 문제는 정답을 푼 문제별로 제출버튼을 클릭은 했는데, 풀 수 있을거 같은 문제가 하나 있어서 그걸 가지고 끝까지 씨름을 하다가 시험 종료가 돼서 자동으로 아웃이 됐는데... 최종버튼이 있었던거 같기도 하고... 각 문제별로 제출버튼을 클릭하면 제출된건가요?
안녕하세요~ 강의 덕분에 시험 잘 본 것 같습니다 작업 유형 2에서 train 타켓컬럼.describe 에서 이상치가 있는 것 같아서 iqr로 해서 이상치 대략 410개정도(전체 train 데이터 5000개) 제거하고 lgb랑 랜덤포레스트로 돌렸더니 rmse lgb 기준 71정도 나와서 제출했는데 생각해보니 과적합 위험이 클 것 같아서 점수 괜찮게 나올까요? 이상치 제거 안하고 그냥 onehot 인코딩으로 해서 했을때는 410 정도 나왔습니다ㅠㅠ
나머지 다 잘되었는데 start 에서 . fail이 뜨네요. Searching for connected devices... Found 1 device. Using: emulator-5554 Starting Iris service in the background... Failed to start Iris service.
안녕하세요, 코딩팡 장업형2 베이스 라인에서 원-핫 인코딩만 사용하셨는데 인코딩 부분에 아래와 같이 추가해서 레이블 인코딩과 원-핫 인코딩 결과를 비교하는 식으로 해도 상관없나요? 원핫 인코딩만 사용하신 이유가 있을까요?? 1번 문제 import pandas as pd # 1) 데이터 불러오기 train = pd.read_csv('data/car_train.csv') test = pd.read_csv('data/car_test.csv') # 2) 범주형 변수 원-핫 인코딩 target = train.pop('target') print(train.shape, test.shape) train = pd.get_dummies(train) test = pd.get_dummies(test) print(train.shape, test.shape) # 레이블 인코딩 from sklearn.preprocessing import LabelEncoder cols = train.select_dtypes(include = 'object').columns for col in cols: le = LabelEncoder() train[col] = le.fit_transform(train[col]) test[col] = le.transform(test[col]) # 3) 검증용 분리 (제출 전 성능 비교) from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=0, stratify=target) # 4) 세 가지 모델 학습 from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit(X_tr, y_tr) pred = rf.predict(X_val) from sklearn.metrics import f1_score print(f1_score(y_val, pred, average='macro')) from lightgbm import LGBMClassifier lgb = LGBMClassifier(random_state=0, verbose=-1) lgb.fit(X_tr, y_tr) pred = lgb.predict(X_val) print(f1_score(y_val, pred, average='macro')) from xgboost import XGBClassifier xgb = XGBClassifier(random_state=0, verbosity=0) xgb.fit(X_tr, y_tr) pred = xgb.predict(X_val) print(f1_score(y_val, pred, average='macro')) # 5) 선택한 모델을 전체 train으로 다시 학습 후 test 예측 (선택) # lgb.fit(train, target) # pred = lgb.predict(test) # 6) 제출 파일 저장 (pred 컬럼 1개만, index 제거) result = pd.DataFrame({'pred': pred}) result.to_csv('result.csv', index=False) # 제출파일 확인 print("\n ===== 제출파일 (샘플) =====") print(pd.read_csv("result.csv").head()) print("\n ===== 제출파일 (크기 확인) =====") print(pd.read_csv("result.csv").shape)
강사님 uv setting 대로 실습을 진행하는 도중에 아카이브 tool 호출 시 아래의 에러가 발생했습니다. AttributeError: 'Search' object has no attribute 'results' uv add "arxiv<2.4.1" 로 다운그레이드 해서 해결했습니다. 혹시나 동일한 에러가 나시는 분들을 위해 남겨둡니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 기출 풀어보면 C를 안 붙이고, object도 자연스럽게 변환된다고 하셨는데, 연습할 때 gender에 C를 붙였던 경험이 있습니다. 혹시 언제 붙이고 언제 안 붙이는지 알 수 있을까욤..?
빅데이터분석기사 실기체험에서 작업형 제2유형을 회귀 실습해보고 있는데. 에러가 나는데 이유를 전혀모르겠어요. import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") target = train.pop('총구매액') train = pd.get_dummies(train) test = pd.get_dummies(test) from sklearn.ensemble import RandomForestRegressor model = RandomForestRegressor() model.fit (train, target) p = model.predict(test) submit = pd.DataFrame({'pred':p}) submit.to _csv("result.csv", index=False) print(submit.head()) 에러) Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 38, in <module> p = model.predict(test) ^^^^^^^^^^^^^^^^^^^ File "/usr/local/lib/python3.12/site-packages/sklearn/ensemble/_ forest.py ", line 1063, in predict X = self._validate_X_predict(X) ^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/usr/local/lib/python3.12/site-packages/sklearn/ensemble/_ forest.py ", line 641, in validate X_predict X = self._validate_data( ^^^^^^^^^^^^^^^^^^^^ File "/usr/local/lib/python3.12/site-packages/sklearn/ base.py ", line 608, in validate data self._check_feature_names(X, reset=reset) File "/usr/local/lib/python3.12/site-packages/sklearn/ base.py ", line 535, in check feature_names raise ValueError(message) ValueError: The feature names should match those that were passed during fit. Feature names seen at fit time, yet now missing: - 주구매상품_소형가전