df['출동시간'] = pd.to_datetime(df['출동시간']) df['도착시간'] = pd.to_datetime(df['도착시간']) df.info() df['걸린시간(분)'] = df['도착시간'] - df['출동시간'] df['걸린시간(분)'] = df['걸린시간(분)'].dt.total_seconds() / 60 df.head(2) result = df.groupby('소방서')['걸린시간(분)'].mean() result # 여기서 result 말고 df 에 넣으면 오류뜨는데 이유를 모르겠음. result 말고 df 넣으면 오류뜨는데 이 기준을 잘 모르겠습니다..!
안녕하세요. 작업형2 지문에 보면 문제마다 아래와 같은 평가 지표들이 있는데. 여러 처리를 통해 평가지표가 높은 모델이나 처리등으로 수정을 하겠지만 혹시 해당 평가지표는 꼭 구하지 않아도 되는건지 궁금합니다. 즉, 해당 평가 지표는 구하지 않고 그냥 결과 파일(result.csv)만 제출하는 코드를 작성해도 되는건지요. 평가 지표: RMSE (Root Mean Squared Error) 평가 지표: ROC-AUC
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 (sklearn.metrics) 이 패키지에 RMSE, RMSLE, MAPE 등 다 추가 됐다고 말씀하셨던 것 같은데 작업형2 모의문제2 에서는 직접 수식을 계산해야 한다고하셔서 혹시 어떤게 맞는건가요? 패키지에 추가 됐긴했는데 시험장에선 업데이트가 안됐다고 이해하면 될까요??
다중분류 평가지표(f1_score) 에서 문자인 경우 pos_label = ' ' 을 적용해서 검증 자료에 대해 평가 결과를 확인하는데, 이후 test 자료를 저장할때는 문제에서 요구하는 히나의 값을 (A,B,C 중에서 B선택) 고르는게 아니라 pred로 왜 저장해야 하는지 긍금합니다~! 다중분류 평가지표(roc_auc) 에서 0,1,2 중에서 2를 선택해야 할 경우 pred_prob( , pred[ : ,2] ) 이렇게 2를 적용해야 되는것이 맞는지 문의드립니다~!
작업형1 모의문제3 문제7 [질문1] 풀이과정에서 2001행의 평균 조건을 cond로 사용하고 2003행의 평균 조건도 cond로 사용하셨는데, 왜 cond1, cond2 구분이 없어도 각각의 값이 출력이 되는건가용!?ㅠㅠ [질문2] df.head() df=df.T df.head() print('2001 평균:', df[2001].mean()) print('2003 평균:', df[2003].mean()) print('A :', sum(df[2001]>df[2001].mean())) print('B :', sum(df[2003]<df[2003].mean())) print('A+B :', sum(df[2001]>df[2001].mean()) + sum(df[2003]<df[2003].mean())) 혼자 먼저 풀어보는 과정을 해봤는데요 이전에 행/열 트랜스폼 하는 거 알려주셔서~! df.T로, 행/열 트랜스폼하구 mean()으로, 각 열(컬럼)에 대해 평균 구하고 sum으로, 크거나 작은 수의 개수를 구했는데.. 2001 평균: 100.735 2003 평균: 97.215 A : 100 B : 102 A+B : 202 요렇게 나왔어요.. loc로 풀은 내용과 왜 다를까요?ㅠ 꼭 loc써야 하는 문제였을까요?!ㅠㅠ
EDA 과정 중에 # 기초통계 train(object) train.describe(include='O') # 기초통계 test(object) test.describe(include='O') train과 test 데이터의 unique 값이 동일하다면 실제 카테고리 값 자체 비교 없이 바로 인코딩 해도 문제 없나요? 카테고리 값을 비교해서 안전하게 하고 싶지만, 굳이 안 그래도 되는 거면 안 하려고 합니다!!
가설검정의 독립표본 검정과 카이제곱 적합도 검정을 서로 대체하여 사용할 수 있는지 문의드립니다! 독립표본도 서로 다른 2개의 집단 (표본)의 차이를 확인하는 것 처럼 카이제곱 적합도 또한 서로 다른 2개의 집단 (관측, 기대치)의 차이를 구하게 되는데, 그럼 이때 서로 대체하여 쓸 수 있는지 해서 여쭤봅니다! (물론 카이제곱 적합도 예제에서 독립표본 구하는 맨휘트니를 적용하니깐 값이 다르게 나오긴 합니다...^^)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 다름이 아니라 작업형 1, 3번은 답변을 적는 페이지가 따로 있는데 코드 적는 풀이도 채점을 받게 되는 건가요? 강의에서 보면 중간 print들은 지워주라는 말씀을 몇 번 하셨는데 꼭 답변 부분만 print로 출력해야 하는지, 중간 과정은 출력하면 안되는지, 또 혹시라도 답변 부분을 print로 확인 후 주석 처리 시 감점 요인인지 궁금합니다. 저는 제출한 답안만 평가 대상이라고 생각했는데 저의 풀이과정 코드도 평가 대상일까요??