드리는 말씀 안녕하세요, 김판다 강사입니다. 바쁜 일상 속에서도 학습을 지속하는 여러분은 정말 대단합니다. 학습에 진지하게 임하면 자연스럽게 궁금증이 생기고, 더 깊이 알고 싶은 순간이 올 것입니다. 이는 학습에 대한 진정성을 보여주는 방증이기도 합니다. 다만, 현재 코딩 입문자가 가장 빠르고 효율적으로 코딩을 정복하는 방법은 생성형 AI를 습관화 하는 것입니다. 코딩 관련 의문은 대부분 ChatGPT나 Gemini에 단지 질문하는 것만으로 해결됩니다. 의문이 생긴 지금이 ChatGPT 활용을 훈련할 기회 입니다. 귀찮음이나 두려움 등을 이유로 사용을 망설이지 마세요. 지금 가진 의문을 생성형 AI에 질문하는 용기 있는 시도가 여러분의 코딩 미래를 바꿉니다. 저는 여러분이 코딩과 생성형 AI 모두 능숙하게 다룰 수 있을 것이라 믿습니다! ChatGPT URL 👉 https://chatgpt.com 구글 Gemini URL 👉 https://gemini.google.com 학습 관련 질문 을 남겨주세요! 자주 묻는 질문 을 참고하시고, 유사한 질문이 있는지 검색해 보시면 여러분의 시간을 아낄 수 있어요! 인프런 서비스 운영 관련 문의는 1:1 문의하기 를 이용해 주세요.
작업형2의 다중분류 같은 경우에는 평가 시 f1 = f1_score(y_val, pred, average='macro'를 입력해줘야 하는데 평가지표가 f1_score일때만 해당되나요? 만약 다중분류인데 평가 방법이 다른 방법이어도 똑같은 방식으로 뒤에 average='macro를 붙여주면 되는건가요?
1)혹시 현재 범주형 컬럼에 대해 라벨인코딩 한 후, 인코딩한 컬럼만 따로 학습에 사용하는 것이 아니라, 수치형 컬럼과 함께 전체 데이터(총 10개 컬럼)를 모델에 넣어 학습했습니다. 이때 오히려 성능이 더 잘 나왔는데, 이런 방식이 괜찮은지 확인 받고 싶습니다. from sklearn.preprocessing import LabelEncoder cols = list( train.select _dtypes(include = 'O')) for col in cols: le = LabelEncoder() train[col] = le.fit _transform(train[col]) test[col] = le.transform(test[col]) 이후 전체 데이터를 사용해 모델 학습을 진행했습니다. X_train, X_val, y_train, y_val = train_test_split(train.drop('성별',axis=1), train['성별'], test_size = 0.2, random_state = 0) print(X_train.shape, X_val.shape, y_train.shape, y_val.shape) #(2800, 10) (700, 10) (2800,) (700,) 범주형데이터 인코딩한 상태로 10개 컬럼 그대로 가지고 학습 from sklearn.ensemble import RandomForestClassifier from sklearn.metrics import roc_auc_score rf = RandomForestClassifier(random_state = 0, max_depth =5) rf.fit (X_train,y_train) rf_predpro = rf.predict_proba(X_val) rf_rocauc = roc_auc_score(y_val,rf_predpro[:,1]) print(rf_rocauc) # train data 전체 데이터 사용 시 약 0.63, 범주형 컬럼 두 개만 썼을 때는 약 0.60 감사합니다
안녕하세요. 퇴근 후 딴짓 교재도 같이 공부를 하고 있습니다! 혹시 작업형2에서 연습문제에서 코딩을 할 때마다 ‘베이스라인’파트와 ‘심화’ 파트가 있는데 시험 볼 때 ‘베이스라인’과 ‘심화’파트 모두 제출해야 하나요..? ‘베이스라인’도 조금 벅차서 시험 볼 때 ‘베이스라인‘ 코드만 제출할 수 있나 해서요..
a=3 b=5 print(a+b) print(type(a)) 죄송합니다. Python용 IntelliCode 지원을 활성화하는 동안 문제가 발생했습니다. 자세한 내용은 "Python" 및 "VS IntelliCode" 출력 창을 확인하세요. 라는 메세지가 뜨면서 안되는데 왜 그럴까요..
안녕하세요! 강의 너무 잘 듣고있습니다. 강의를 들으면서 궁금했던 점이 조합이나 순열 같은 경우 라이브러리가 존재하는데 이를 적극적으로 사용하는 것이 좋은지 아니면 조합이나 순열 관련 문제를 풀때마다 직접 구현해서 사용하는 것이 좋은지 궁금해서 이렇게 질문 남기게 되었습니다.
저는 본업의 변경, 혹은 본업 외의 수익을 위해 부업을 알아보며 인프런에서 블렌더나 자바 등 다른 강의를 듣다가 중도에 어려움이나, 지루함 , 자신에 대한 불확실성으로 인해 전부 중도에 포기를 했었습니다. 지금 강사님 강의는 듣는 중인데, 완강 전에 메일을 보내드리는 이유는, 지루하지 않고, 어려움도 쉽게 풀어서 설명해주시고 , 불확실성도 확실성으로 바꿔주심에 진심으로 즐겁게 강의를 듣고 있고, 완강할거란 확신이 "처음으로 강하게"들어서 입니다 (본으로 인해 하루에 많은 양을 듣진 못하지만 매일 들어요 ㅎㅎ) 자료형 강의 말미에, 강사님이 "데이터 분석가가 되실수 있다"라고 말씀을 해주셨는데, 강의를 수강하기 전 부터 사실 관심이 있었습니다. 프리랜서로 데이터 분석가 일을 하는 분들도 있다 하고, 전업으로 하시는 분들도 있다고 하는데, 유능한 데이터 분석가가 되기 위해선, 판다스 외에 어떤걸 학습해야할지 로드맵이 궁금합니다. 판다스 외에 제가 익혀야할 것들이 있다면, 꼭 다 익히겠습니다. (aws도 공부하면 데이터 분석가가 되는데 좋다고 듣기도 했습니다) 이 부분 제가 혼자 알아보려 했지만, 워낙 자료가 제한적이더군요,, ㅠㅠ 하여 전문가이신 강사님께 조언을 구합니다. 무언가를 성취하고자 가슴이 이렇게 뛰는건 정말 오랜만이기에 참 설렙니다.
결측치 제거할 때 test는 처리하면 안된다고 하셨는데 다음과 같은 상황들에서 어떻게 처리해야 하나요? 1)train, test 둘다 결측치 있는 경우 train만 train = train.dropna()하면 되는지 2) train은 없고 test만 결측치가 있는경우 둘다 안 하면 되는지 3) train만 있고 test는 결측치가 없는 경우 train만 처리하면 되는지
Qt Designer는 매매프로그램 전문 인건가요? Streamlit을 소개하는 강의에서는 Chat GPT에 Streamlit코드를 물어보기보다 직접 사용되는 코드를 설명하고 강의에서 파일을 제공해주었는데, 특별히 이렇게 하신 이유가 있을까요? (이 코드들도 ChatGPT에 물어보면 되지 않았나해서요) 강의에서는 모의로 매수/매도 였는데 만약 실제 계좌에서 매수/매도를 하려면 어떤 부분에서 변화가 필요한가요? 일별 매수 매도의 다양한 종목의 매매일지를 생성해보기 위해서는 몇일간 장시작-장종료 시간동안 매매 UI를 돌려야 하는게 맞나요?
늦었지만 감사인사드립니다! 이번 강의 정말 잘 들었습니다. 이후 강의를 기다리며 질문 드립니다. 다른 질문에서 강사님께서 말씀하신 것처럼, 책을 천천히 혼자 보며 강사님의 판다스 강의를 기다리고 있습니다. 이와 관련해서 궁금한 점이 있습니다. 강사님의 판다스 책을 마스터하면 어느 정도 수준까지 가능한가요? 강사님의 판다스 책으로 도달 가능한 학습 수준이 궁금합니다!
28:48 초 swap 으로 함수 선언으로 하고 temp 에 a 주소의 값 203 대입 / a 주소에 b주소의 값 1004 대입 /다시 temp 를 b 주소 값을 대입 후 return 값을 다시 주지 않았는데 어떻게 두번 째 print 에서 바뀌어서 나올 수 가 있는거죠 ? return 값을 주지 않으면 void swap 내 블록에서 변경된 값은 그대로 종료되고 두번째 print는 첫번째 출력값 교환전: x=203, y=1004 랑 동일 하지 않나요?
강사님 풀이를 보면 수치형 데이터와 범주형 데이터를 분리해 전처리 한 후 다시 합치는 과정으로 진행하셨는데 저는 select.dtypes(inclde='object')와 select.dtypes(exclude='object')를 이용해 전처리 후 머신러닝을 진행하였습니다. roc_auc_score로 평가해보니 비슷하게 0.809가 나옵니다. 저는 수치형과 범주형을 따로 분리하고 전처리 하는게 헷갈려서 그런데 저처럼 과정을 진행해도 문제 없는거죠??
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 df.groupby(['부서','성과등급'])['근속연수'].transform('mean') 이라는 코드로 부서와 성과등급 기준 평균값을 구하신 부분에서 질문입니다. df.groupby(['부서','성과등급'])['근속연수'].mean() 위 코드와 같이 transform('mean')과 mean()이 어떤 차이점이 있는지 궁금해요.
강사님 덕분에 비전공자인데도 정말 빠르게 완주할 수 있었습니다. 군더더기 없는 내용, 깔끔한 설명, 덜 중요한 내용은 가지치기까지 해주는 정말 훌륭한 강의였습니다. 덕분에 강사님의 판다스 강의에도 관심이 생겼습니다. 다른 분들의 질문을 보니 온라인 강의는 조금 기다리면 열릴 것 같고, 오프라인 강의도 진행하시는 것 같네요! 혹시 강사님의 판다스 오프라인 강의를 들으려면 어떻게 신청하면 될까요?
재성님 유투브에서 처음 뵙고 현재 ERP 및 백엔드 현업에서 근무중입니다 현업에 도움이 될까 해서 강의를 결제해서 들었는데 현재 저의 협업 수준에서는 다소 너무나 거리가 있는 강의 입니다....ㅠㅠ 기초를 좀 다지고 싶은 마음에 결제해서 약간 수강을 해보았는데 너무 낮은 수준의 강의 결제한것 같습니다 제 업무 난이도와 비교하여 낮은 수준이지 강의는 입문자들에게 매우 좋다고 생각합니다 해서... 동일한 가격대인 비전공자도 이해할 수 있는 AWS 입문/실전 으로 교환할수 있는지 문의드리고 싶습니다 약간의 강의 수강기록이 있지만.... 현재로서는 제가 도움을 받을수있는 부분이 없는 강의라서 .... 이렇게 어려운 부탁을 드립니다 혹시나 따로 소통에 필요할 경우를 대비해 메일을 첨부합니다 guswnd1380@naver.com
결측 값을 가진 데이터는 바로 뒤에 있는 값으로 대체한 후 (바로 뒤가 결측값이라면 뒤에 있는 데이터 중 가장 가까운 값) city와 f2 컬럼 기준으로 그룹합을 계산한 뒤 views가 세번째로 큰 city(도시) 이름은? 문제를 푸는데.. df = df.fillna(method='bfill') 라고 치면 <ipython-input-43-5b45f8741ad5>:7: FutureWarning: DataFrame.fillna with 'method' is deprecated and will raise in a future version. Use obj.ffill() or obj.bfill() instead. df = df.fillna(method='bfill') 과 같은 메시지가 뜨네요. 이제 df = df.fillna(method='bfill') 대신 obj.bfill() 라고 쓰는걸 익혀야 하나요? 아니면 당분간은 괜찮을런지요. 늘 감사합니다.
안녕하세요 딩코님! 현재 4주차 숙제부분까지 강의를 완료하고 5주차는 실전문제풀이과정이라 해당 과정 들어가기전에 질문이 있습니다. 4주차 까지 들으면서 이전까지는 숙제문제는 바로 코드로 작성하진 못해도 어 이렇게 풀면 되지않을까 하는 구상이 가능했는데 3주차 숙제인 멜론 베스트 앨범뽑기부터 해서 4주차 숙제들은 전부다 문제를 봐도 해당 주차에 배웠던 알고리즘들을 이용해서 풀어보려해도 시작점 조차 생각이 나질않아 바로 해설영상을 보고 따라치는 정도로밖에 하질못해 다시 반복해서 공부할 예정입니다. 5주차 영상부터는 4주차까지의 숙제로 주신 알고리즘 문제를 전부 이해하고 시청하는게 좋을까요 아니면 일단 문제들을 최대한 풀어서 익숙해질떄까지 계속 풀면서 이해하는게 좋을지 궁금합니다. 또 알고리즘 문제를 풀면서 정답이나 해설영상을 몇분까지 풀다가 보면 좋을까요 지금까지는 문제를 풀다가 '아 나 더이상 이 이상은 작성 못하겠어' 할떄 정답과 해설영상을 봐왔는데 이렇게 하니 어려운 문제를 풀때는 시간이 너무 소모되는거 같아 이게 맞나? 싶을떄도 있어 제가 잘못 공부하고있는건지도 궁금합니다!