inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

173만명의 커뮤니티!! 함께 토론해봐요.

가설검정 (t-test)

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

커리큘럼으로 게시해주신 t-test 영상에서 다룬 귀무가설, 대립가설은 모두 평균에 대한 가설이었습니다. kaggle에서 추가 문제를 풀어보는 중인데, 다음과 같은 문제가 있더군요. # 베스킨라빈스는 쿼트(Quart) 아이스크림의 중앙값이 620g이라고 주장하고 있습니다. # 저는 실제로 이 아이스크림의 중앙값이 620g보다 무겁다고 주장합니다. # 다음은 20개의 쿼트 아이스크림 샘플의 무게 측정 결과입니다. # 이 측정 결과를 바탕으로 나의 주장이 사실인지 비모수 검정(Wilcoxon Signed-Rank Test)을 통해 검정해보십시오. # p-value값을 반올림하여 소수점 둘째 자리까지 계산 # 귀무가설: "베스킨라빈스 쿼트 아이스크림의 중앙값은 620g이다." # 대립가설: "베스킨라빈스 쿼트 아이스크림의 중앙값은 620g보다 무겁다." 평균에 대한 검증만 해봤더니 중앙값에 대해선 어떤 코드가 필요할지 몰라서 풀이를 봤는데, 평균에 대한 가설검증 코드와 동일하더라고요. import pandas as pd from scipy.stats import wilcoxon # 설정값 med = 620 # Wilcoxon Signed-Rank Test 수행 result = wilcoxon(df["weight"] - med, alternative='greater') p_value = round(result.pvalue, 2) print(p_value) 검증하려는 통계값이 다른데, 왜 가설검증 절차는 동일한지 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김선혁 댓글 1 좋아요 0 조회수 94

캐글 타이타닉

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

# X_train.head() # y_train.head() # X_ train.info () # y_ train.info () # X_train.isnull().sum() # y_train.isnull().sum() # y_train['Survived'].value_counts() # print(X_train.shape, y_train.shape) # X_train = pd.get_dummies(X_train) # y_train = pd.get_dummies(y_train) # print(X_train.shape, y_train.shape) # target = y_train.pop('Survived') # from sklearn.model_selection import train_test_split # X_tr, X_val, y_tr, y_val = train_test_split(X_train, target, test_size=0.2, random_state=0) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit (X_tr, y_tr) pred = rf.predict(X_val) 다음과 같이 풀이했는데 오류가 뜨는 이유가 뭘까요? 그리고 target = y_train.pop['Survived']를 데이터 전처리 때 하는 게 좋을까요 데이터 분리를 할 때 하는 게 좋을까요? 한 셀에서 풀이를 하면 target = ~ 이 셀이 두 번 반복되는데 그럼 다시 오류가 떠서 미리 실행시키고 다음 단계 전에는 숨기기 처리하는게 맞겟죠?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
shs4166 댓글 2 좋아요 0 조회수 64

작업형2 제출 형식

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

선생님 항상 친절한 답변 감사합니다. 작업형2 연습 중에 있는데 EDA도 하고 여러 과정을 거치면서 print문으로 여러줄을 출력해가면서 중간 과정을 확인하며 풀이를 하고 있습니다. 실제 시험에서는 작업형2 코드를 제출할 때 중간 과정에서 확인하기 위한 print문을 주석처리하고 제출을 해야할까요?? 아니면, "result.csv" 파일만 잘 생성이 되어 제출한다면 문제가 없는 걸까요??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
dlwnstmd705 댓글 2 좋아요 0 조회수 79

kruskal 관련

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

비 모수 검정 시 kruskal 분석 사용해서 p value 값은 어떠한 것을 확인하는 건가요? stats.kruskal(df['A'], df['B'], df['C'], df['D']) 에서 나오는 p value는 어떤걸 의미하는건지 궁금합니다. 그리고 해당 p value의 가설 귀무 가정을 알수있을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김치현 댓글 2 좋아요 0 조회수 77

기출2회와 3회 작업형 2의 차이

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 작업형 2 기출2회 에서는 범주형변수의 컬럼이름만 찾았는데 기출3회에서는 범주형변수와 수치형변수를 분리하는 이유가 무엇인가요?ㅠㅠ

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
란따 댓글 2 좋아요 0 조회수 92

수치형 데이터, 범주형 데이터 분리 기준

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요, 수치형 데이터, 범주형 데이터 분리해서 스케일링 및 인코딩을 하셨는데요! 수치형 데이터, 범주형 데이터 분리를 할때와 안할때의 차이가 무엇이고, 기준이 무엇일까요? 다시 말씀드리면, 수치형 데이터, 범주형 데이터 분리를 할때와 안할때의 장단점이 궁금하고, 어떤 상황에서 분리를 해야하고, 어떤 상황에서 분리를 하지 않아도 되나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
reverq 댓글 3 좋아요 0 조회수 308

작업형2 모의문제2 질문입니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

r2 score에 경의 테스트가 거의 0.3이하로만 계속 출력되는것으로 강의에서 확인되는데 제가 알기로 0.3이하면 굉장히 낮은수준의 모델로 알고있습니다. 시험장에서 0.3이하가 나오더라도 제출하는데 문제없을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김호준 댓글 2 좋아요 0 조회수 109

csv 파일 만들 때 인코딩 옵션 필요 여부

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요, to_csv로 csv 파일을 만들어서 제출할 때 encoding=‘utf-8’ 옵션을 안넣어도 괜찮을까요? 시험문제에서 결과 컬럼명은 항상 영문으로만 출제되나요? (한글로 출제될 때도 인코딩 옵션 따로 안넣어도 되는지 궁금합니다ㅜ)

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
grace Park 댓글 2 좋아요 0 조회수 116

작업형 1 제출 결과 제출 방법 관련하여

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

선생님, 작업형 1을 진행하다가 코드로 어떤 방식으로든 문제 풀다가 정답을 알았지만 본 의도대로 코드를 이용해서 print 를 내기가 생각이 안날 때 단순이 그냥 print('정답') 이라는 식으로 print 되게 처리를 하여도 점수를 다 받을 수 있나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
CallMeJYM 콜미짐 (Cal 댓글 2 좋아요 0 조회수 117

작업형 2 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

시험 일주일을 남기고, 벼락치기를 하는 중이라 너무 헷갈려서 질문 남깁니다. 어떤 풀이를 보면 수치형데이터만 사용하고, 어떤 풀이를 보면 수치형과 범주형을 각각 train과 test를 나눠서 사용하기도 하고, 또 X_tr,y_tr을 분리해서 사용하는 풀이가 있는 한편 어떤건 그냥 train, test로 사용하기도 하던데 이런것들은 문제에 따라 다르게 사용해야할까요? 아니면 알고있는만큼 작성하는걸까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
최혜인 댓글 2 좋아요 0 조회수 124

7회 기출 작업형1, 문제 1번 질문입니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

영상 7분쯤 3) 과목 점수 스탠다드 스케일 부분에서 df[["score"]]=scaler.fit_transform(df[["score"]]) 과 #데이터프레임 강사님이 작성하신 df["score"]=scaler.fit_transform(df[["score"]]) #시리즈 와 같은 결과가 뜨는데 왜 그런걸까요...? 보통 df[cols]=scaler.fit_transform(df[cols]) 썼던거 같아서요.. 그럼 전자가 맞는 표현 아닌가요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김진영 댓글 2 좋아요 0 조회수 117

캐글

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

캐글에서 문제를 풀고자하는데 copy&edit 버튼을 눌러도 위의 형식대로 표시가 됩니다! 어떻게 해결하면 될까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
shs4166 댓글 1 좋아요 0 조회수 74

작업형2 모의고사2

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 시험에서 작업형2문제가 결측값이 있는 문제가 나오면 value_counts()를 통해 가장많이 있는값을 찾아서 fillna() 해주려합니다. train['name'].value_counts() #Hillside Hotel train['name'] = train['name'].fillna('Hillside Hotel') test['name'].value_counts() #Brooklyn Apartment test['name'] =test['name'].fillna('Brooklyn Apartment') 그런데 train과 test의 value_counts()값이 달라서 train과 test에 다른값(Hillside Hotel 와 Brooklyn Apartment) 을 넣어도 되나요??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이진혁 댓글 2 좋아요 0 조회수 98

xgb warning

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

시험환경에서 XGB는 warning이 뜨는게 맞는거죠?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
인옥 댓글 2 좋아요 0 조회수 90

기출4회-시험환경(캐글)

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

캐글에 시험환경으로 풀어보기로 풀어보려하는데 shift+enter로 실행이 원래 안되는걸까요? 그리고 df.head()를 해도 아래 출력이 안됩니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
shs4166 댓글 2 좋아요 0 조회수 61

소수점 버림, 올림, 부분 문자 일치 질문입니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

기출유형 4회 작업형 1 관련 1번 문제소수점을 버려 정수형으로 표현을 할 때 소수점을 버리거나 올리는 함수(예 : round)와 같은 함수가 있나요? 마지막답인 경우엔 int로 쓰면 될 것은데 혹시나 목록에 있는 데이터를 수정할 때 쓸수 있는 방법이 궁금합니다. 3번 문제 United Kingdom 단독을 찾으라고 하였는데 문제에서는 United Kingdom 만 나와 있는데 country가 만일 United Kingdom & Korea와 같이 공동 제작이 섞여 있다면 조건을 어떻게 주어야 하나요? 일치하는 문자(==가 아니라 일부 일치하는 것 찾는 조건)

  • python
  • 머신러닝
  • 빅데이터
  • pandas
jinhakeun 댓글 1 좋아요 0 조회수 85

시험환경 코드 실행 방법

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 시험환경에서 실행 버튼을 눌러야 코딩이 실행되나요? Colab, 쥬피터 노트북에서 shift+ enter로 코드를 실행했었는데 시험환경에서는 실행이 되지 않네요. 시험 환경에서 코드 실행 방법이 불편해서 혹시 다른 방식이 있나 여쭤봅니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
최주원 댓글 2 좋아요 0 조회수 204

fit_transform 관련 질문

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

from sklearn.preprocessing import MinMaxScaler mms = MinMaxScaler() df['co'] = mms.fit_transform(df[['co']]) MinMaxScaler에서 fit_transform에 [] 를 두번 쓰는 이유가 무엇인가요? 강의에서는 문법이라 외워야되는 것처럼 이야기하셨는데 그냥 문법 만든 사람이 저렇게 쓰도록 해서 그런 건가요? 시험에 쓰는 함수 중에 저런 특이한 것들이 더 있나요? [], (), [[]] 쓰는 게 헷갈리는데 쉽게 외울 수 있는 기준이나 공식이 있나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
jinhakeun 댓글 3 좋아요 0 조회수 121

최종모델 확률값 소수점 범위 다른 경우

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

최종 모델의 확률 값의 소수점 자리수가 다른경우는 어떻게 해야할까요..?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김치현 댓글 2 좋아요 0 조회수 88

최종 모델 선택 후, 같은 조건으로 validation까지 학습해도 되나요?

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요, 강의 듣던 중 궁금한 점이 생겨 질문드립니다 ! 강의에서 모델링 및 평가를 할 때 보면 순서가 피처 엔지니어링 여러 회귀/분류 모델 학습 성능 평가 위의 세 단계를 반복하며 제일 성능이 좋은 조건과 모델을 선택하는 것으로 이해했습니다. 위의 과정을 통해 성능 좋은 모델과, 피처 엔지니어링 방법을 알았다면, 검증 데이터로 나눈 것을 다시 학습 데이터로 합쳐서 해당 모델과 조건으로 다시 학습 시켜서 제출하는 방법이 가능한가요? 더 많은 데이터셋으로 학습하는 것이 좋지 않을까 하여 질문 드렸습니다 !

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
송예진 댓글 2 좋아요 0 조회수 98

인기 태그

인프런 TOP Writers

주간 인기글