from sklearn.metrics import roc_auc_score roc_auc = roc_auc_score(y_val, pred[:, 1]) print('roc_auc: ', roc_auc) 11:19 즈음에 나오는 해당 코드에 궁금한 점이 있어 질문 드립니다. roc_auc_score() 메서드에 전달할 두 번째 아규먼트는 양성(positive)에 대응하는 클래스일 확률 리스트를 전달하는 것으로 알고 있습니다. 그런데 roc_auc_score() 메서드의 첫 번째 아규먼트에 전달하려는 값(y_val)이 0 또는 1로 이루어지지 않고 지금과 같이 '<=50K' 또는 '>50K'와 같은 문자열로 이루어진 리스트라면 roc_auc_score() 메서드 입장에서 도대체 어떻게 '<=50K'가 양성인지 '>50K'가 양성인지 판단할 수 있는 것인지 궁금합니다. 다른 수강생의 질문에서 print(rf.classes_)를 통해 보여지는 리스트의 인덱스 번호로 0이면 양성 X, 1이면 양성으로 판단한다라고 본 것 같은데, 해당 정보를 알고 있는 것(해당 정보를 저장한 주체)은 rf, 즉 랜덤포레스트 모델 객체 아닌가요? roc_auc_score() 입장에서는 rf.classes_ 속성에 직접 접근하지 않는 한, 해당 정보를 알지 못할 것 같은데 어떻게 '>50K'를 양성으로 판단하는지 궁금합니다.
안녕하십니까 2분18초 부터 나오는 재귀연산법을 그동안 제가 이전 강의에서는 연산조건이 한가지만 나오는 단순재귀 같은 경우는 그냥 눈에 보이는 코드 흐름상 파라미터 -> 리턴값 순으로 재귀연산을 해서 풀었는데 (ex:5+4+3+2+1) 이번에는 조건재귀같은 경우는 똑같이 풀다가 값이 다른 결과가 나오는 참사가 발생했습니다. 그래서 조건이든, 단순이든 재귀연산법은 리턴값부터 차근차근 파라미터 순으로 가는게 안전한 건가요?
작업형 2유형 연습문제를 풀면서 랜덤포레스트와 LGBM 모델을 둘 다 적용해 보고 있는데, 대부분의 경우 LGBM의 성능이 더 좋게 나옵니다. 혹시 실제 시험에서도 LGBM을 주력 모델로 사용해도 괜찮을까요? 아니면 데이터에 따라 랜덤포레스트가 더 유리한 경우도 있어서 두 모델을 모두 비교해 보는 것이 좋을까요? 시험장에서 모델 선택 시 어떤 기준으로 판단하면 좋을지 궁금합니다. 감사합니다! 😊
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요 질문합니다. 문제1-1에서는 p-value가 0.05보다 작은 이라고 적어져 있고 문제1-2에서는 p-value가 0.05 이하라고 적어져 있어요 답에는 차이가 없지만 '보다 작은'으로 봐야하나요? 이하라고 봐야하나요?
안녕하세요 9회 시험을 볼 때, 강의를 작업형 2까지만 듣고 갔다가 60점으로 떨어졌습니다. 그동안 바쁘다고 시험을 치루지 못하다가 마지막 기회라 이번에 접수했는데요. 이번에도 시간이 없던 중에 반갑게도 [94. 빅이사] 강의가 있어서 작업형 2를 [기초편]으로 rf로 외웠는데 [96. 오징어게임]에서 Q&A 시간에 하나만 하면 LightGBM라고 하셔서요 그럼 lgb 기초편 버전을 알려주실 수 있을까요? 2년 전에는 정식으로 검증데이터 분할해서 했는데, 1주일동안 작업형 1/2/3을 다 외우려니 쉽지 않아 기초편으로 가보려 합니다. 금요일 휴가는 냈는데 열심히 해보고 합격소식 올려볼게요...ㅠㅠ
학습하다보니, (), [], {} 각 괄호의 사용이 너무 헷갈려서 문의드립니다. 때로는 두개를 같이 사용하기도 하던데, 정확하게 세 가지 괄호를 각각 어떤 기준으로 괄호를 사용하면 될까요? 예1) ['칼럼명'] # 지역별 평균 계산 df = df.groupby(['city']).mean(numeric_only=True) 예2) ("칼럼명") ->여기서는 왜 []를 안 쓰는건지.... # 'f2'컬럼이 가장 큰 지역 출력 print(df.sort_values("f2", ascending = False).index[0])
새로운 컬럼 cancel_TF 생성: 주문번호가 'C' 로 시작하면 True , 아니면 False ( 'C' 는 취소 주문) 라고 문제에 작성되어있는데 str.contains('c')가 아니라 str.startswith('c')로 해야하는거 아닌가요? contains는 c가 포함이되었는가를 판단하는걸로 알고 있고 startswith는 c로 시작하는지를 판단하는걸로 알고있는데 말이죠
[질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예/아니오) 예 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 예 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예/아니오) 예 [질문 내용] 13:00즈음에 동일성 비교가 필요한 경우에만 equals()를 재정의하면 된다라고 되어있는데 동등성 아닌가요..?
안녕하세요. 선생님, 배경지식없이 본강의만 듣기 시작한 수강생입니다. cursor 도 사용해본적 없는데요, 실습을 들어가자 막혀서 문의드립니다 ㅠㅠ 하단 사진과 같이 구글에서 cursor 검색해서 설치후 실행시킨다음에 오픈 폴더로 다운받은 폴더를 선택했는데, 강의내용과 같이 왼쪽 탭에 폴더내 파일들이 안보이네요.. 혹시 다른 툴을 사용하고 있는 걸까요? 선생님 화면이랑 일부 다른것 같기도 해서요..
안녕하세요. 수업을 듣다가 replace와 map의 차이를 찾아보니 map은 딕셔너리 형태에 적여 있지 않은 모든 키값을 null로 만들고 replace는 그대로 손대지 않는다고 하는데, 그러면 1과목에서 자세한 EDA가 전제 되지 않는다고 가정했을때 왠만하면 map을 피하고 replace를 해야하지 않을까? 하는 생각이 들었는데 수업에는 map을 조금 권장하는거 같기도 하여 혹시나 여기에 대해서 제가 어떻게 생각을 정리해야할지 질문드립니다.