안녕하세요! 먼저 수업 잘 듣고 있습니다 :) 현재 section 6까지 완강하였습니다. 32강 varible 실습 코드부터 airflow에 올라오지 않는 것 같습니다. git push와 git pull 완료 후, wsl에 dags 폴더 내에 해당 코드들이 있는 건 확인했습니다. 하루에 정해진 작업량이 있어서 그런건지 여쭤보고 싶습니다. compose down 시키고 다시 airflow 올려도 똑같이 현시가 안되는 상황입니다....ㅠ
드리는 말씀 안녕하세요, 김판다 강사입니다. 바쁜 일상 속에서도 학습을 지속하는 여러분은 정말 대단합니다. 학습에 진지하게 임하면 자연스럽게 궁금증이 생기고, 더 깊이 알고 싶은 순간이 올 것입니다. 이는 학습에 대한 진정성을 보여주는 방증이기도 합니다. 다만, 현재 코딩 입문자가 가장 빠르고 효율적으로 코딩을 정복하는 방법은 생성형 AI를 습관화 하는 것입니다. 코딩 관련 의문은 대부분 ChatGPT나 Gemini에 단지 질문하는 것만으로 해결됩니다. 의문이 생긴 지금이 ChatGPT 활용을 훈련할 기회 입니다. 귀찮음이나 두려움 등을 이유로 사용을 망설이지 마세요. 지금 가진 의문을 생성형 AI에 질문하는 용기 있는 시도가 여러분의 코딩 미래를 바꿉니다. 저는 여러분이 코딩과 생성형 AI 모두 능숙하게 다룰 수 있을 것이라 믿습니다! ChatGPT URL 👉 https://chatgpt.com 구글 Gemini URL 👉 https://gemini.google.com 학습 관련 질문 을 남겨주세요! 자주 묻는 질문 을 참고하시고, 유사한 질문이 있는지 검색해 보시면 여러분의 시간을 아낄 수 있어요! 인프런 서비스 운영 관련 문의는 1:1 문의하기 를 이용해 주세요.
작업형2의 다중분류 같은 경우에는 평가 시 f1 = f1_score(y_val, pred, average='macro'를 입력해줘야 하는데 평가지표가 f1_score일때만 해당되나요? 만약 다중분류인데 평가 방법이 다른 방법이어도 똑같은 방식으로 뒤에 average='macro를 붙여주면 되는건가요?
1)혹시 현재 범주형 컬럼에 대해 라벨인코딩 한 후, 인코딩한 컬럼만 따로 학습에 사용하는 것이 아니라, 수치형 컬럼과 함께 전체 데이터(총 10개 컬럼)를 모델에 넣어 학습했습니다. 이때 오히려 성능이 더 잘 나왔는데, 이런 방식이 괜찮은지 확인 받고 싶습니다. from sklearn.preprocessing import LabelEncoder cols = list( train.select _dtypes(include = 'O')) for col in cols: le = LabelEncoder() train[col] = le.fit _transform(train[col]) test[col] = le.transform(test[col]) 이후 전체 데이터를 사용해 모델 학습을 진행했습니다. X_train, X_val, y_train, y_val = train_test_split(train.drop('성별',axis=1), train['성별'], test_size = 0.2, random_state = 0) print(X_train.shape, X_val.shape, y_train.shape, y_val.shape) #(2800, 10) (700, 10) (2800,) (700,) 범주형데이터 인코딩한 상태로 10개 컬럼 그대로 가지고 학습 from sklearn.ensemble import RandomForestClassifier from sklearn.metrics import roc_auc_score rf = RandomForestClassifier(random_state = 0, max_depth =5) rf.fit (X_train,y_train) rf_predpro = rf.predict_proba(X_val) rf_rocauc = roc_auc_score(y_val,rf_predpro[:,1]) print(rf_rocauc) # train data 전체 데이터 사용 시 약 0.63, 범주형 컬럼 두 개만 썼을 때는 약 0.60 감사합니다
안녕하세요. 퇴근 후 딴짓 교재도 같이 공부를 하고 있습니다! 혹시 작업형2에서 연습문제에서 코딩을 할 때마다 ‘베이스라인’파트와 ‘심화’ 파트가 있는데 시험 볼 때 ‘베이스라인’과 ‘심화’파트 모두 제출해야 하나요..? ‘베이스라인’도 조금 벅차서 시험 볼 때 ‘베이스라인‘ 코드만 제출할 수 있나 해서요..
a=3 b=5 print(a+b) print(type(a)) 죄송합니다. Python용 IntelliCode 지원을 활성화하는 동안 문제가 발생했습니다. 자세한 내용은 "Python" 및 "VS IntelliCode" 출력 창을 확인하세요. 라는 메세지가 뜨면서 안되는데 왜 그럴까요..
안녕하세요! 강의 너무 잘 듣고있습니다. 강의를 들으면서 궁금했던 점이 조합이나 순열 같은 경우 라이브러리가 존재하는데 이를 적극적으로 사용하는 것이 좋은지 아니면 조합이나 순열 관련 문제를 풀때마다 직접 구현해서 사용하는 것이 좋은지 궁금해서 이렇게 질문 남기게 되었습니다.
저는 본업의 변경, 혹은 본업 외의 수익을 위해 부업을 알아보며 인프런에서 블렌더나 자바 등 다른 강의를 듣다가 중도에 어려움이나, 지루함 , 자신에 대한 불확실성으로 인해 전부 중도에 포기를 했었습니다. 지금 강사님 강의는 듣는 중인데, 완강 전에 메일을 보내드리는 이유는, 지루하지 않고, 어려움도 쉽게 풀어서 설명해주시고 , 불확실성도 확실성으로 바꿔주심에 진심으로 즐겁게 강의를 듣고 있고, 완강할거란 확신이 "처음으로 강하게"들어서 입니다 (본으로 인해 하루에 많은 양을 듣진 못하지만 매일 들어요 ㅎㅎ) 자료형 강의 말미에, 강사님이 "데이터 분석가가 되실수 있다"라고 말씀을 해주셨는데, 강의를 수강하기 전 부터 사실 관심이 있었습니다. 프리랜서로 데이터 분석가 일을 하는 분들도 있다 하고, 전업으로 하시는 분들도 있다고 하는데, 유능한 데이터 분석가가 되기 위해선, 판다스 외에 어떤걸 학습해야할지 로드맵이 궁금합니다. 판다스 외에 제가 익혀야할 것들이 있다면, 꼭 다 익히겠습니다. (aws도 공부하면 데이터 분석가가 되는데 좋다고 듣기도 했습니다) 이 부분 제가 혼자 알아보려 했지만, 워낙 자료가 제한적이더군요,, ㅠㅠ 하여 전문가이신 강사님께 조언을 구합니다. 무언가를 성취하고자 가슴이 이렇게 뛰는건 정말 오랜만이기에 참 설렙니다.
결측치 제거할 때 test는 처리하면 안된다고 하셨는데 다음과 같은 상황들에서 어떻게 처리해야 하나요? 1)train, test 둘다 결측치 있는 경우 train만 train = train.dropna()하면 되는지 2) train은 없고 test만 결측치가 있는경우 둘다 안 하면 되는지 3) train만 있고 test는 결측치가 없는 경우 train만 처리하면 되는지
Qt Designer는 매매프로그램 전문 인건가요? Streamlit을 소개하는 강의에서는 Chat GPT에 Streamlit코드를 물어보기보다 직접 사용되는 코드를 설명하고 강의에서 파일을 제공해주었는데, 특별히 이렇게 하신 이유가 있을까요? (이 코드들도 ChatGPT에 물어보면 되지 않았나해서요) 강의에서는 모의로 매수/매도 였는데 만약 실제 계좌에서 매수/매도를 하려면 어떤 부분에서 변화가 필요한가요? 일별 매수 매도의 다양한 종목의 매매일지를 생성해보기 위해서는 몇일간 장시작-장종료 시간동안 매매 UI를 돌려야 하는게 맞나요?
늦었지만 감사인사드립니다! 이번 강의 정말 잘 들었습니다. 이후 강의를 기다리며 질문 드립니다. 다른 질문에서 강사님께서 말씀하신 것처럼, 책을 천천히 혼자 보며 강사님의 판다스 강의를 기다리고 있습니다. 이와 관련해서 궁금한 점이 있습니다. 강사님의 판다스 책을 마스터하면 어느 정도 수준까지 가능한가요? 강사님의 판다스 책으로 도달 가능한 학습 수준이 궁금합니다!
28:48 초 swap 으로 함수 선언으로 하고 temp 에 a 주소의 값 203 대입 / a 주소에 b주소의 값 1004 대입 /다시 temp 를 b 주소 값을 대입 후 return 값을 다시 주지 않았는데 어떻게 두번 째 print 에서 바뀌어서 나올 수 가 있는거죠 ? return 값을 주지 않으면 void swap 내 블록에서 변경된 값은 그대로 종료되고 두번째 print는 첫번째 출력값 교환전: x=203, y=1004 랑 동일 하지 않나요?
강사님 풀이를 보면 수치형 데이터와 범주형 데이터를 분리해 전처리 한 후 다시 합치는 과정으로 진행하셨는데 저는 select.dtypes(inclde='object')와 select.dtypes(exclude='object')를 이용해 전처리 후 머신러닝을 진행하였습니다. roc_auc_score로 평가해보니 비슷하게 0.809가 나옵니다. 저는 수치형과 범주형을 따로 분리하고 전처리 하는게 헷갈려서 그런데 저처럼 과정을 진행해도 문제 없는거죠??
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 df.groupby(['부서','성과등급'])['근속연수'].transform('mean') 이라는 코드로 부서와 성과등급 기준 평균값을 구하신 부분에서 질문입니다. df.groupby(['부서','성과등급'])['근속연수'].mean() 위 코드와 같이 transform('mean')과 mean()이 어떤 차이점이 있는지 궁금해요.
강사님 덕분에 비전공자인데도 정말 빠르게 완주할 수 있었습니다. 군더더기 없는 내용, 깔끔한 설명, 덜 중요한 내용은 가지치기까지 해주는 정말 훌륭한 강의였습니다. 덕분에 강사님의 판다스 강의에도 관심이 생겼습니다. 다른 분들의 질문을 보니 온라인 강의는 조금 기다리면 열릴 것 같고, 오프라인 강의도 진행하시는 것 같네요! 혹시 강사님의 판다스 오프라인 강의를 들으려면 어떻게 신청하면 될까요?
결측 값을 가진 데이터는 바로 뒤에 있는 값으로 대체한 후 (바로 뒤가 결측값이라면 뒤에 있는 데이터 중 가장 가까운 값) city와 f2 컬럼 기준으로 그룹합을 계산한 뒤 views가 세번째로 큰 city(도시) 이름은? 문제를 푸는데.. df = df.fillna(method='bfill') 라고 치면 <ipython-input-43-5b45f8741ad5>:7: FutureWarning: DataFrame.fillna with 'method' is deprecated and will raise in a future version. Use obj.ffill() or obj.bfill() instead. df = df.fillna(method='bfill') 과 같은 메시지가 뜨네요. 이제 df = df.fillna(method='bfill') 대신 obj.bfill() 라고 쓰는걸 익혀야 하나요? 아니면 당분간은 괜찮을런지요. 늘 감사합니다.