이번 10회 실기시험 1유형 3번 문제가 띄어쓰기 제외하고 단어 수 세는거였는데 저는 (띄어쓰기 전 문장의길이 - replace로 띄어쓰기 지운 문장의길이) + 1 해줬는데 단어 개수가 이렇게해도 세어질까요?? 10개정도 확인했을땐 다 맞아서 그냥 그렇게 풀었는데 저처럼 푼 사람이 없는 것 같아 여쭤봅니다
안녕하세요 우선 늦게 질문 남기는 점 죄송합니다 다름이 아니라 시험환경 관련해서 질문이 있습니다. 기존 강의에서 코랩에서 코딩을 할 때 이전 셀 실행 기능이 있어 유용하게 사용했는데 시험 환경에서 같은 기능을 사용하려면 어떻게 해야하는지 궁금합니다. 추가적으로 코드 라인별 실행 불가라고 되어있는데 순차적으로 실행하면서 진행하는건 가능할까요? 예를 들어 2유형이라고 치면 전처리 하고 결과 보고 이후 그 밑에 코드 이어서 인코딩 진행한 후 결과 보고 모델 돌리고 결과 보고 이런식으로 순차적으로 코드 작성하면서 실행 결과 확인하는게 가능한지 궁금합니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 3과목 공부할 시간이 너무 없어서그러는데 강의에서 심화라고 나오는건 일단은 건너뛰어도 될까요? 3과목은 한문제라도 맞추는게 목표입니다.ㅠㅠ
아래 문제를 제가 혼자 다시 풀었을 때, 처음에 model = logit(formula,test).fit() 이라고 test데이터로 모델을 학습해서 답이 안나왔었습니다. 작업형2에서 배웠던 머신러닝의 train, test의 개념이 동일하게 적용되어 학습은 무조건 test가 아니라 train데이터로 진행하는 걸 대전제로 이해하면 될까요? 기출7회 작업형3 / 문제1-3. 독립변수 weight 만 사용해 학습한 로지스틱 회귀모델에서 test데이터의 gender를 예측하고, error rate(오류율)를 구하시오. (반올림하여 소수 셋째자리까지 계산) import pandas as pd df = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/refs/heads/main/p4/7_3/clam.csv") # train test 나누기 train = df.iloc[:210] test = df.iloc[210:] # print(train.shape, test.shape) (210, 6) (90, 6) # logit from statsmodels.formula.api import logit formula = 'gender ~ weight' model = logit(formula,train).fit() # test데이터의 gender 예측 pred = model.predict(test) print(pred) pred_ver2 = pred > 0.5 from sklearn.metrics import accuracy_score AS = accuracy_score(test['gender'],pred_ver2) ER = 1 - AS print(round(ER,3))
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요 퇴근후딴짓님 강의 잘 듣고 있습니다 🙂 다름이 아니라 2유형 코드 제출 시 제가 확인하려고 써둔 코드인 1) 평가 지표 코드 ROC_AUC / RMSE 등등 from sklearn.metrics import roc_auc_score 2) 생성 csv파일 확인 코드 print(pd.read_csv("r.csv").head() 위의 두 코드를 주석처리하거나 지운 후 맨 마지막 코드가 submit.to_csv가 되도록 하여 제출해야하는지 궁금합니다 ! 감사합니다 !!
logit에서 독립변수를 쓸 때 HasPhoneService와 HasTechInsurance에 C를 붙여주지 않는 건 그저 문제에 범주형이라고 나오지 않았기 때문인가요? 그럼 데이터가 범주형으로 나와있어도 문제에 범주형이라고 써져 있지 않다면 C를 쓰면 안되는건가요? 학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 부연설명도 조금 해주세요. 전화서비스를 받지 않은 고객이 이탈할 확률 대비, 전화 서비스를 받은 고객이 이탈할 확률에 대한 오즈비가 단순히 HasPhoneService에 대한 회귀계수 집어넣는 이유가 뭐에요? 나중에 또 이런문제가 나왔을때 그걸 판단하는 방법을 알려주세요... ㅠ
안녕하세요. 질문이 있습니다. 기출 7회 작업형 1-3 문제에서 저는 강사님처럼 gender 컬럼을 pop하지 않고 그냥 바로 test 데이터를 넣어 예측하였습니다. 강사님이랑 결과는 동일하게 나오는데 혹시 gender 컬럼을 꼭 분리해야 할까요? 사실 test 안에는 weight 말고도 다른 독립변수들이 같이 있잖아요. 근데 모델이 독립변수로 weight을 사용하여 종속변수 gender를 예측하는 모델이니까 자동으로 test 안의 weight 변수만 사용한다고 생각하고 있는데 틀린 생각인가요? from statsmodels.formula.api import logit # 1) 로지스틱 회귀모델 적합 model = logit('gender ~ weight', data = train).fit() # 2) test 데이터의 gender 예측 (남자로 분류되는 기준을 0.5로 임의 설정) pred = model.predict(test) > 0.5 # print(sum(pred)) # 3) error rate 구하기 from sklearn.metrics import accuracy_score acc = accuracy_score(test['gender'], pred) er = 1 - acc print(round(er, 3)) # 0.478
nodes[0] = Node(3)->v3,c[Node(5),Node(8)]로 갑자기 되는게 이해가 안됩니다... 질문은 동영상 강의에 들어가서 오른쪽에 커뮤니티 버튼을 통해 해주세요. 그래야 어떤 강좌에서 질문하셨는지 알 수 있습니다. 영상에서 몇 분 몇 초 대를 알려주셔야 제가 한 번에 질문 내용 확인이 가능합니다. 이미 다른 누군가가 질문을 한 이력 이 있을 수 있습니다. 질문 게시판을 한 번 확인 부탁드립니다. 학교의 과제나 타 강사의 코드 등 외부 수업 자료에 대해서는 답변하지 않습니다. 제가 다루는 커리큘럼 외의 이론이나, 너무 디테일한 컴퓨터 이론에 대해서는 답변 드리지 않습니다. 시험에 안 나오는 경우가 많고, 나와 봤자 1문제 나오는데 외워야 할 부분이 많은 것 등 (예시: 서브넷 마스크 계산) 질문을 올릴 때 이 글은 모두 지우고 내용을 입력해주세요.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 공부 시간이 많아서 2과목을 강의대로 하면 좋겠지만 시간이 없어서 1.데이터 전처리(결측치 제거 정도) 2.인코딩(데이터 별로 없을 시 원핫 or 많을 때 레이블인코딩) 3.랜덤포레스트 학습 이렇게 제출 했을 경우 보통 몇점 정도 나오는지 혹시 수강생들 후기가 있으신가요..? 30점 정도만 나와도 다행일 것 같긴합니다..
문제 1-2 에서는 소수 둘째짜리까지 구하라고 하여 함수 llf 를 구해서 소주 셋째짜리까지 구한 후, 반올림했는데 문제 2-2에서는 셋째짜리까지 구하라고 했으니, 넷째짜리까지 보고서 답을 적어야 하는데 선생님은 summary() 표에서 나오는 결정계수(소수 셋째짜리) 로 우선 답을 적으셨는데요. (이후에 rsquared 함수로 더 많이 소수자리를 보긴했지만) 문제 2-2에서 결정계수 값이 0.226 인데, 만약 0.2253 이였으면 반올했을때 0.225 가 되잖아요..? 그럼 틀린건가요? 선생님 풀이를 보면 1-2와 2-2의 차이가 분명히 있는데, 1-2 문제에서는 구하라고 하는 소수자리보다 더 많이 구한후 답을 적엇고, 문제 2-2에서는 그냥 표에있는 값으로 답을 적었는데요.. 한가지 방법으로 정리가 필요할듯 합니다.
선생님은 잔차이탈도 계산은 함수를 써서 로그 우드 값을 추출 후 곱하기 -2를 해서 = 286.93267518507366 여기서 반올림해서 286.93이 되고 저는 summary() 로 알게된 로그우드 값에 곱하기 -2를 해서 = 286.94 이 됩니다. 이럴경우 제가 한 답을 작성시 틀리게 되는건가요? summary 에서 -143.47 이렇게 애초에 소수 둘째짜리 까지만 나타내줫는데.. 틀리면 억울할거같은데 답변 부탁드립니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 풀이 코드에는 print(a.sum(axis=1)) 이렇게 작성이 되어있는데 print(a.T.sum()) 이렇게 해도 되나요?