AA.py 책점 에러
미해결
파이썬 알고리즘 문제풀이 입문(코딩테스트 대비)
왜 에러가 나는 것일까요?
- python
- 코딩-테스트
172만명의 커뮤니티!! 함께 토론해봐요.
미해결
파이썬 알고리즘 문제풀이 입문(코딩테스트 대비)
왜 에러가 나는 것일까요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
컴퓨터 공학에 아예 문외한이기도 하고 시험 준비 기간도 짧아 최대한 문제를 풀 수 있는 정도만 준비해가려고 합니다 작업형 2번은 타겟 분리 트레인, 테스트 합쳐서 원핫인코딩 후 재분리 검증데이터 분할 랜덤포레스트(Classifier/Regressor) 적용하여 피팅 pred로 바로 테스트 데이터 예측(predict 또는 predict_proba) DataFrame 생성 후 제출 제출물 shape가 test와 맞는지 확인 이정도로 준비해가려고 합니다 어차피 한가지 타입으로 해서 낼거면 평가는 별도 안해봐도 괜찮을까요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
model = logit('gender ~ weight', data=train).fit() pred = model.predict(test) from sklearn.metrics import accuracy_score score = accuracy_score(pred, test['gender']) print(1-score) 이 코드를 실행하면 ValueError: Classification metrics can't handle a mix of continuous and binary targets 이렇게 연속된 값과 이진분류를 혼용했다는 오류가 뜨는데, model = LogisticRegression() model.fit(X_train, y_train) # 3) 테스트 데이터를 사용해 예측 pred = model.predict(X_test) # 4) 실제 값과 예측값을 사용하여 정확도 계산 acc = accuracy_score(y_test, pred) # 5) 오류율 계산 print(round(1 - acc, 3)) 강사님의 두번째 풀이 코드(위 코드)를 실행하면 아무런 문제가 없어서, 두 코드 전부 accuracy_score에 실제 값과 예측값을 넣어주었음에도 실행 결과가 차이가 나는 이유가 궁금합니다. 혹시 LogisticRegression()으로 모델을 생성하면 결과가 0,1의 이진값으로 나오고, logit()으로 모델을 생성하면 결과가 0과 1 사이의 확률값으로 나와서, 모델 생성에 logit()을 사용했다면 accuracy score를 구해야 하는 경우 확률값이 0.5보다 큰지 작은지를 구분하는 후처리를 해줘야 하는 것인 걸까요? 감사합니다.
미해결
파이썬/장고 웹서비스 개발 완벽 가이드 with 리액트
예전에 강의사놓고 사정상 못보다가 지금 다시 공부할려고하는데, 지금봐도 괜찮은을까요?
미해결
파이썬 무료 강의 (기본편) - 6시간 뒤면 나도 개발자
오른쪽위 실행버튼을 누르면 터미널에 보라색으로 뜨고 컨트롤+F5를 하면 터미널에 정상적으로 잘떠요. 오른쪽 위 run버튼을 누르면 안되는 이유가 뭘까요?
미해결
나도! 스프링으로 인공지능을 할 수 있다(인프1탄)
안녕하세요 강사님. 혹시 상품 관련 추천을 구현하기 위해 pgvector를 구현하고 싶은 취준생입니다. 상품 데이터 안에 브랜드, 카테고리, 가격, 이전에 조회한 상품들, 이후에 조회한 상품들 등 이러한 필드를 이용해서 이걸 Document로 만든 다음 코사인 유사도를 구해도 괜찮을까요 아니면 Document는 text만 가능한가요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
시험에서 '사분위 범위를 이용해서 이상치를 구하라'는 문제가 나올경우 대체로 Q1 - 1.5*IQR보다 작거나 Q3 + 1.5*IQR보다 큰 값 이라는 것을 명시해주는지 궁금합니다.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
유니크 확인하고 합쳐서 인코딩하고 인덱싱하는 방식은 어떨 때 사용하는 건가요? 첫 번째 문제는 확인 과정도 없는 거 같아서 헷갈리네요
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
min_co = df['co'].min() max_co = df['co'].max() df['co'] = (df['co'] - min_co) / (max_co - min_co) min_nmhc = df['nmhc'].min() max_nmhc = df['nmhc'].max() df['nmhc'] = (df['nmhc'] - min_nmhc) / (max_nmhc - min_nmhc) std_co = df['co'].std() std_nmhc = df['nmhc'].std() round(std_co - std_nmhc, 3) 제가 MinMaxScaler라는 것의 존재를 아예 까먹고 있었어서 이런 식으로 박치기(?)해서 문제를 풀었는데, 혹시 실제 시험문제에서도 코랩에서의 설명처럼 "Min-Max 스케일링 = (X - min_X) / (max_X - min_X)" 이 설명이 주어졌나요? 시험에서도 이런 설명이 주어진다면 어떻게든 풀어낼 것 같은데, 주어지지 않는다면 이런 스케일링 기법같은 것들을 미리 외워놓는 게 좋을 것 같아서 여쭤봅니다! 감사합니다.
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
전처리부분은 어떻게 나올지 모르겠지만 여태까지 난이도로나온다면 (결측치는 나오는대로 한다고 가정하겠습니다) 강의를 다보고 연습문제도 다해보았습니다 작업형3도 다돌려보았고 작업형1이 잘 안되어서 남은시간동안 작업형1에 집중해보려고 여쭙니다 이정도 치면 40점을 맞을 수 있다고생각하는데 어떻게 생각하실까요?ㅠ (타겟값분리) target=train.pop('종속변수') (데이터합쳐서 원핫인코딩 후 분해) n1=len(train) df=pd.concat([train,test]) df=pd.get_dummies(df) train=df.iloc[:n1] test=df.iloc[n1:] 데이터분할 from sklearn.model_selection import train_test_split X_tr,X_val,y_tr,y_val=import train_test_split(train,target,test_size=0.2,random_state=0) X_tr.shape,X_val.shape,y_tr.shape,y_val.shape #평가지표 from sklearn.metrics import root_mean_squared_error # f1_score , roc_auc_score 등등나오는대로 #랜덤포레스트 from sklearn.ensemble import RandomForestClassifier # 분류 #from sklearn.ensemble import RandomForestRegressor #회귀 rf=RandomForestClassifier() rf.fit(X_tr,y_tr) pred=rf.predict(X_val) print(root_mean_squared_error(y_val,pred) # macro일때는 average='macro' #lightgbm import lightgbm import lgb lgb=lgb.LGBMClassifier(random_state=0,verbose=-1) # 회귀면 Regressor lgb.fit(X_tr,y_tr) pred=lgb.predict(X_val) print(root_mean_squared_error(y_val,pred) test예측 pred=rf.predict(test) #rf와lgbm중 선택 submit=pd.DataFrame({'pred':pred)} # roc_auc인경우 pred[,:1] submit.to_csv('result.csv',index=False) print(pd.read_csv('result.csv'))
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요 챗지피티때문에 헷갈리는데 정리 한 번만 부탁드려요 그냥 df['after'],df['before']로 쓰면 ud = after-before(앞-뒤)이 되는거고 stat.ttest_rel(df['before'],df['after'],alternative='less')를 쓰면 ud = before-after(앞-뒤)가 되는 것이죠?? ㅡㅡㅡㅡㅡㅡㅡㅡㅡㅡㅡㅡ
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
궁금한 점이 몇가지 있는데 만약 작업형 2에서 EDA에서 info를 해봤을때 object 컬럼이 없다면 인코딩을 진행 안하는것이 맞을까요? 2. 평가 과정에서 precision과 recall은 해보지 않았던것 같은데 불러올때 from sklearn.metrics import precision_score from sklearn.metrics import recall_score 이렇게 불러온다음 나머지 과정은 accuracy와 동일하게 진행해주면 될까요? 감사합니다.
미해결
[리뉴얼] 처음하는 파이썬 머신러닝 부트캠프 (쉽게! 실제 캐글 문제 풀며 정리하기) [데이터분석/과학 Part2]
안녕하세요. 강의를 수강하면서 한 가지 오류가 반복적으로 발생하여 질문드립니다. 현재 아래 코드를 실행하는 과정에서 문제가 발생하고 있습니다. score = cross_val_score(knn, X_train, y_train.values.ravel(), cv=k_fold, n_jobs=-1, scoring='accuracy') print(score) 셀을 실행하면 다음과 같은 오류 메시지가 지속적으로 출력됩니다. UnicodeEncodeError: 'ascii' codec can't encode characters in position 18-20: ordinal not in range(128) 이 오류는 예전에도 Jupyter Notebook을 사용할 때 동일하게 발생하여 해결에 어려움을 겪었고, 이번 강의를 따라가는 과정에서도 같은 문제가 반복되고 있습니다. 구글링과 GPT 등을 통해 여러 해결 방법을 시도해보았으나, 환경 변수 설정, 터미널 인코딩 변경, 관련 코드 수정 등 어떤 방법도 효과가 없었습니다. (제가 방법을 잘못 이해한 것일 수도 있습니다.) 혹시 이 문제가 발생하는 원인과 해결 방법에 대해 조언을 주실 수 있을까요? 항상 좋은 강의 제공해주셔서 감사드립니다. - 강의 영상에 대한 질문이 있으시면, 상세히 문의를 작성해주시면, 주말/휴일 제외, 2~3일 내에 답변드립니다 (이외의 문의는 평생 강의이므로 양해를 부탁드립니다.) - 강의 답변이 도움이 안되셨다면, dream@fun-coding.org 로 메일 주시면 24시간 내에 재검토하겠습니다. - 괜찮으시면 질문전에 챗GPT 와 구글 검색을 꼭 활용해보세요~ - 잠깐! 인프런 서비스 운영(다운로드 방법포함) 관련 문의는 1:1 문의하기를 이용해주세요.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
# 컬럼 삭제 train = train.drop('flight', axis=1) test = test.drop('flight', axis=1) 안녕하세요 선생님! 고생많으십니다! 한번씩 train.pop을 진행하고 난 후에 컬럼을 하나씩 drop하는 경우가 있던데 이런건 어떻게 판단해서 진행을 해야할까요?
해결됨
포트폴리오 어나더레벨 | 합격하는 이력서 작성법
안녕하세요 혹시 신입개발자의 경우 자신을 표현하는수단(프로젝트,어워드 등)같은 부분이 많이 없어서 자기소개와 같은 부분을 하나의 섹션으로 작성하여 좀 더 자신을 드러내는 건 어떻게 생각하시나요?
미해결
[리뉴얼] 처음하는 파이썬 머신러닝 부트캠프 (쉽게! 실제 캐글 문제 풀며 정리하기) [데이터분석/과학 Part2]
안녕하세요. 정말 좋은 강의 잘 듣고 있습니다:) 문득, 강의를 듣다가 궁금한 점이 생겨 질문 남깁니다. 현재 실습으로 진행하고 있는 타이타닉 데이터 같은 경우에는 컬럼 값이 많지 않은 데이터로 EDA 분석 후에 feature engineering, 모델링, 예측 순으로 진행하게 되는데 만약 컬럼 값이 수백개 또는 수천개 정도의 고차원 데이터 같은 경우에는 각각의 컬럼과 타겟변수와의 관계, 컬럼과 컬럼과의 연관성 등 EDA를 진행하기에는 어려움이 있지 않을까하는 의문점이 들었습니다. 이런 고차원 데이터의 경우에는 PCA와 같은 차원축소 기법을 먼저 적용하여 컬럼의 수를 줄인 후에 EDA를 진행하는 것이 맞는건지 질문드립니다.
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
선생님, 분산분석과 회귀모형에서 ols()나 logit() 입력할 때 , 숫자로 이뤄진 범주형 독립변수 앞에는 C를 붙여서 입력하는 것으로 알고 있는데 10회 기출 1번 overtime 변수에 C를 붙이지 않은 이유가 무엇인가요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
왜 저는 원핫인코딩할떄 bool로나오죠? 이번 한번이 아니라 전에도 강의에서는 int로 나오던데 왜 저만 bool로나오는지 이해가안가더라구요
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요, 기출(작업형2) 한 가지 방법으로 풀기 듣다가 기출 유형에는 결측치가 있는 경우가 없었어서 질문드립니다. 기출에서는 타겟이 범주형 자료일 때를 감안하여 전처리 전에 target =train.pop('타겟컬럼') 을 입력하고 이후 에 원-핫 인코딩 진행 하는걸 추천한다 하셨는데요, 만약 결측치가 존재하여 전처리 과정에 결측치 처리가 추가된다면 이때도 pop 함수를 먼저 사용한 후에 결측치 처리를 해야하나요?? pop 함수가 시험 환경의 train 데이터를 x_train ,y_ train 으로 나눠주는 것과 같은 기능을 하는 것으로 이해했는데 만약 train data 와 target column data 둘 다에 결측치가 있다면 먼저 결측치를 처리한다음에 pop 함수 처리를 하는게 맞지 않나요???
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
여기 문제들처럼 홀수행, 짝수행별로 값이 필요할때 사용할수 있는 함수는 따로 없을까요? unstack을 사용하거나 조건을 만들어 사용해서 구하는 방법밖엔 없을까요