안녕하세요, 섹션 9 일원분산분석 강의 8:34 경 질문있습니다. 사후검정으로 일원분산분석시에도 어떤 집단에서 유의미한 차이가 있는지를 학습하고 이해했는데요. # Bonferroni(본페로니) mc = MultiComparison(df_melt['value'], df_melt['variable']) bon_result = mc.allpairtest(stats.ttest_ind, method='bonf') print(bon_result[0]) (질문1) 마지막줄에 bon_result[0] 왜 0이 들어가게 된 건지 설명 부탁드리겠습니다. (질문2) 혹시 가설검정 H0 채택/기각 여부 외에 이런부분까지도 출제될 수 있는건가요? (다른 강의를 듣다가 넘어왔는데, 이 부분은 완전 처음들어봤습니다..) 시간이 얼마 없어서, 다른 부분(2유형 코드짜는걸) 집중해서 암기하려고 하는데 조언 부탁드립니다.
캐글 작업형 1 T1 - 20 b1와 b3 데이터를 f4 기준으로 병합하기 위해서 df = pd.merge(left = b1, right = b3, how = 'left', on = 'f4') 식을 사용하셨는데 혹시 여기서 how = 'left'의 의미는 무엇인가요?? 이 문제를 pd.concat으로도 풀 수 있는지 궁금합니다.
학습하는 분들께 도움이 되고, 더 좋은 답변을 드릴 수 있도록 질문전에 다음을 꼭 확인해주세요. 1. 강의 내용과 관련된 질문을 남겨주세요. 2. 인프런의 질문 게시판과 자주 하는 질문(링크)을 먼저 확인해주세요. (자주 하는 질문 링크: https://bit.ly/3fX6ygx) 3. 질문 잘하기 메뉴얼(링크)을 먼저 읽어주세요. (질문 잘하기 메뉴얼 링크: https://bit.ly/2UfeqCG) 질문 시에는 위 내용은 삭제하고 다음 내용을 남겨주세요. ========================================= [질문 템플릿] 1. 강의 내용과 관련된 질문인가요? 예 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? 예 3. 질문 잘하기 메뉴얼을 읽어보셨나요? 예 [질문 내용] 오라클에서 하려고 하니까 안 되는 것 같습니다 ㅠㅠ 임베디드 DB 사용 방법이 테스트 클래스에 @Transactional 넣기 test/resources/schema.sql 파일 작성 test/resouces/ application.properties 파일 작성 맞지않나요?!
선생님 캐글 작업형1 19번 문제에서 "events컬럼이 '1'인경우 80%의 Salse값만 반영함" 을 def event_sales(x): if x['Events'] == 1: x['Sales2'] = x['Sales']*0.8 else: x['Sales2'] = x['Sales'] return x df = df.apply(lambda x: event_sales(x), axis=1) #1일 경우 row, 0일 경우 컬럼 df.head() 이 풀이방식 외에 좀 더 간단한 식은 없을까요? 이해하기가 좀 어려워서요 ㅜㅜ
주어진 데이터는 4가지 다른 교육 방법을 적용한 대학생들의 학점 결과이다. 이 실험에서는 비슷한 실력을 가진 학생 40명을 무작위로 4개(A, B, C, D)그룹으로 나누었고, 각 그룹은 다른 교육 방법을 적용했다. 학생들의 학점 결과에는 교육 방법에 따른 차이가 있는지 유의수준 0.5하에서 검정하시오. 귀무가설(H0): 네 가지 교육 방법에 의한 학생들의 학점 평균은 동일하다. 대립가설(H1): 적어도 두 그룹의 학점 평균은 다르다. 해당 문제의 사후분석에서, stats.ttest_ind는 4개의 그룹이 독립표본이라 그런건가요? 만약 대응표본이라면 mc.allpairtest(stats.ttest_rel, method='bonf')이라고 쓰면 될까요? # Bonferroni(본페로니) mc = MultiComparison(df_melt['value'], df_melt['variable']) bon_result = mc.allpairtest(stats.ttest_ind, method='bonf') print(bon_result[0])
작업형2 평가지표 검증하면 나오는 결과값이 강의답안 결과값이랑 다른경우에도 오답이 아니라고 생각하면 될까요? 예를 들어 강의답안은 1411.223 인데, 제 답안의 경우 1399.1234 등으로 타입,소수점 등은 같은데 실제 수치가 다른 경우에요 (같은 모델을 쓴 경우에) 같은 데이터셋으로 작업해도 random_state? test_size등 개인의 설정값에 따라 지표값이 달라지는 것인지도 궁금합니다.
학습하는 분들께 도움이 되고, 더 좋은 답변을 드릴 수 있도록 질문전에 다음을 꼭 확인해주세요. 1. 강의 내용과 관련된 질문을 남겨주세요. 2. 인프런의 질문 게시판과 자주 하는 질문(링크)을 먼저 확인해주세요. (자주 하는 질문 링크: https://bit.ly/3fX6ygx) 3. 질문 잘하기 메뉴얼(링크)을 먼저 읽어주세요. (질문 잘하기 메뉴얼 링크: https://bit.ly/2UfeqCG) 질문 시에는 위 내용은 삭제하고 다음 내용을 남겨주세요. ========================================= [질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예/아니오) 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예/아니오) [질문 내용] 테스트시 @Transactional 을 붙이고 , 객체 A(1) - B(N)간 다대일 양방향 참조를 설정 (일쪽에 mappedby Casecade ALL, orphanRemoval = true) 한 상태에서 부모객체의 참조를 끊으면 자연스레, 자연스레 N쪽에서 데이터가 사라지는 코드를 구현했었는데, @Transactional 적용 테스트시에 변경감지나, orphanRemoval = true 같은 경우 트랜잭션이 롤백되어서 orphanRemoval = true 작동이 되지 않는 문제가 있습니다. 이럴경우 테스트는 어떻게 해야하나요?? 실제 구현은 잘동작하지만, 테스트시에 동작 X @Transactional로 인해 orphanRemoval = true가 작동 안해서 , 떼고 테스트 코드를 작성할경우 검증로직에서 N쪽에서 데이터가 잘 들어갔거나, 삭제되는걸 검증하는 경우에는, 이미 트랜잭션이 서비스로직에서 detached 된 에러로, no session 에러를 만나게 되었습니다. 이럴 경우 어떻게 테스트 하시는지 여쭙고 싶습니다. 1쪽만 테스트 해야하는지, 본 강의에서와 같이 @Commit으로 해결하나요??
안녕하세요 강사님 캐글의 공유해주신 작업 1유형 문제 중 아래 링크의 문제 관련 질문드립니다. # 상관관계 구하기 # 주어진 데이터에서 상관관계를 구하고, quality와의 상관관계가 가장 큰 값과, 가장 작은 값을 구한 다음 더하시오! # 단, quality와 quality 상관관계 제외, 소수점 둘째 자리까지 출력 처음 지문을 보고 문제를 혼자 풀이 하였을 땐, 상관관계가 가장 큰 값과 작은 값에 대해 절대값으로 확인하라는 내용이 없어서 절대값을 고려하지 않고 문제를 풀이했습니다. 이후 풀이 코드를 확인했을 땐 절대값으로 확인하고 풀이한 내용이 들어있어 질문드립니다. 제가 비전공자라 기본 지식이 부족해서 조금 헷갈리는데, 위와 같은 맥락의 문제에서는 지문에 따로 '절댓 값' 이라는 언급이 없어도 기본적으로 절대값으로 구해야한다는 전제를 깔고 풀이해야하나요? (절댓값 유무의 따라 결과값 달라짐) 문제 지문에서는 '소수점 둘째 자리까지 출력' 이라고 적혀있었는데 풀이 코드에서는 round() 함수를 사용해서 정답을 출력하고 있습니다. 해당 문제에서의 정답에는 큰 영향은 없었지만 풀이중 궁금해서 질문드립니다. 별도의 버림, 올림, 반올림 등의 조건이 없는 지문에 대해서는 기본적으로 round() 함수를 사용하면 될까요? https://www.kaggle.com/code/agileteam/py-t1-13-expected-questions
2회 기출 작업형2 하다가 오류가 나서 문의드립니다. 랜덤포레스트 부분입니다. # 랜덤포레스트 from sklearn.ensemble import RandomForestClassifier model = RandomForestClassifier(random_state=0)model.fit(X_tr,y_tr) pred = model.predict_proba(X_val) 이렇게 오류가 나는데 ㅠㅠ 왜그런걸까요.....
작업형 1의 세번째 문제를 혼자 풀고 풀이를 보며 비교해보니 답이 조금 달라 질문드립니다. import pandas as pd df = pd.read_csv("members.csv") a= df.isnull().sum() # print(a) print(a.sort_values(ascending=False).index[0]) 저는 위처럼 풀어 f1이라는 답을 냈지만 풀이의 답은 'f1'입니다. ( 작은 따옴표의 차이) 이 같은 경우에는 제 풀이가 오답이 되는 것인지 궁금합니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 제목 그대로 다중선형 회귀 분석 시에 from statsmodels.formula.api import ols model=ols('종속~독립1+유형(범주형)',data=df).fit() 하고 summary() 했을 때 유형[T.C] ,유형[T.B] 이것의 의미는 뭘까요?
안녕하세요 수치형 변수 결측치를 채울 때 X_test 데이터에는 X_test의 age 평균값이 들어가야 한다고 생각했는데 X_test['age'] 에 X_train['age']의 평균값을 넣는데 이유가 있을까요? 주당 근무시간에 대해서도 test 데이터에 train 데이터의 중앙값을 넣어주던데 같은 질문입니다!