[추가 질문] 똑같은 브랜치를 다시 pull request하는 경우.
해결됨
Git & GitHub, 원리부터 차근차근 - 근본깃
기존 브랜치를 풀 리퀘스트하고 또다시 풀 리퀘스트를 하게 된다면 어떤 문제점이 생길 수 있나요? 기존의 브랜치가 누락되는 경우가 생길 수 있나요?
- git
- github
172만명의 커뮤니티!! 함께 토론해봐요.
해결됨
Git & GitHub, 원리부터 차근차근 - 근본깃
기존 브랜치를 풀 리퀘스트하고 또다시 풀 리퀘스트를 하게 된다면 어떤 문제점이 생길 수 있나요? 기존의 브랜치가 누락되는 경우가 생길 수 있나요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
rf.fit( train,target )에 들어가는 값과 pred = rf.predict( test )에 들어가는 값이 train,target, test가 들어가는 이유가 있나요? 저기 들어가는 값의 기준이 궁금합니다. # 모델 선택 및 학습 from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit(train, target) pred = rf.predict(test) pred
해결됨
Git & GitHub, 원리부터 차근차근 - 근본깃
대상 브랜치를 잘못된 브랜치로 설정했는데 이를 취소할 수 있나요? 예를 들어 main 브랜치로 머지해야 하는데 Develop 브랜치로 잘못 머지하게 된 경우입니다.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
sementation과 id를 삭제하는 이유가 뭔가요? 그리고 id를 복사할 때 train 데이터가 아닌 test 데이터를 사용하는 이유도 뭔가요 ?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
영상 위치) 21:25 결과 예측 관련 질문입니다. 1) 랜덤포레스트랑 XGB로 평가한 후, 마지막에 예측은 XGB로 했는데 어떤 기준으로 XGB를 선택하는건가요?? 2) pred랑 pred_proba 중에 pred_proba를 사용한 이유가 있나요? pred_proba = xgb.predict_proba(test)
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
강사님은 0부터 496이 나오는데 저는 1489까지 나옵니다. 그리고 답도 차이가 많이 납니다. 괜찮은 것 인가요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
predict를 사용할때와 predict_proba를 사용할때의 차이가 무엇인가요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
원핫 인코딩을 했을때 강의에는 0또는 1로 나오는데 제가 했을땐 True와 False로 나옵니다. 괜찮은가요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
수치형 변수 스케일링을 할때 cols 에서 왜 TravelInsurance 는 제외시키나요? 그리고 display함수가 print함수와 다른 점은 무엇인가요? # 수치형 변수 스케일링 from sklearn.preprocessing import RobustScaler scaler = RobustScaler() cols = ['Age','AnnualIncome','FamilyMembers','ChronicDiseases'] display(a_train.head()) a_train[cols] = scaler.fit_transform(a_train[cols]) a_test[cols] = scaler.transform(a_test[cols]) a_train.head()
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
# 시험환경 세팅 (코드 변경 X) import pandas as pd import numpy as np from sklearn.model_selection import train_test_split def exam_data_load(df, target, id_name="", null_name=""): if id_name == "": df = df.reset_index().rename(columns={"index": "id"}) id_name = 'id' else: id_name = id_name if null_name != "": df[df == null_name] = np.nan X_train, X_test = train_test_split(df, test_size=0.2, random_state=2021) y_train = X_train[[id_name, target]] X_train = X_train.drop(columns=[target]) y_test = X_test[[id_name, target]] X_test = X_test.drop(columns=[target]) return X_train, X_test, y_train, y_test df = pd.read _csv("../input/titanic/train.csv") X_train, X_test, y_train, y_test = exam_data_load(df, target='Survived', id_name='PassengerId') #print(X_train.shape, X_test.shape, y_train.shape, y_test.shape) X_train = X_train.drop(['Cabin','Name','Ticket'],axis=1) X_test = X_test.drop(['Cabin','Name','Ticket'],axis=1) X_train['Age']=X_train['Age'].loc[X_train['Age']>=1] X_train['Age']=X_train['Age'].fillna(X_train['Age'].mean()) X_test['Age']=X_test['Age'].loc[X_test['Age']>=1] X_test['Age']=X_test['Age'].fillna(X_test['Age'].mean()) X_train['Embarked']=X_train['Embarked'].fillna(X_train['Embarked'].mode()[0]) X_test['Embarked']=X_test['Embarked'].fillna(X_test['Embarked'].mode()[0]) cond=pd.get_dummies(X_train['Sex']) cond2=pd.get_dummies(X_test['Sex']) X_train['female']=cond.iloc[:,0] X_train['male']=cond.iloc[:,1] X_test['female']=cond2.iloc[:,0] X_test['male']=cond2.iloc[:,1] X_train = X_train.drop('Sex',axis=1) X_test = X_test.drop('Sex',axis=1) from sklearn.preprocessing import LabelEncoder le=LabelEncoder() cols=['Embarked'] for col in cols: le = LabelEncoder() X_train[col]= le.fit _transform(X_train[col]) X_test[col]=le.transform(X_test[col]) from sklearn.model_selection import train_test_split X_tr,X_val,y_tr,y_val=train_test_split(X_train,y_train['Survived'],test_size=0.2,random_state=42) from sklearn.metrics import accuracy_score from sklearn.ensemble import RandomForestClassifier model = RandomForestClassifier(random_state=42) model.fit (X_tr,y_tr) pred = model.predict(X_val) accuracy_score(y_val,pred) pred=model.predict(X_test) submit = pd.DataFrame( { 'PassengerId' : X_test['PassengerId'], 'Survived' : pred } ) submit.to _csv("003000000.csv",index=False) submit.head() pd.read _csv("/kaggle/working/003000000.csv") accuracy_score(y_test['Survived'],submit['Survived']) 베이스라인 안보고 혼자 해봤습니다. 이렇게 작성했는데 마지막줄에서 점수는 나오는데 타이타닉 캐글 대회에는 제출이 안되서요 혹시 어느부분이 잘못된건지 알수있을까요?? 그리고 이렇게 실행해도 맞는건지도 답변 부탁드립니다
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형 결측치 포함된 columns들 삭제하는 과정에서, 영상에서는 host_id는 결측치가 존재하지 않는데 drop으로 삭제하였습니다. 따로 이유가 있는걸까요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
32. 캐글(kaggle) 필사 전략 강의에서 노션 정리하신 것을 수업 노트에 올려 주신다고 하셨는데, 확인이 안되어 문의드립니다! (18:10)
해결됨
Git & GitHub, 원리부터 차근차근 - 근본깃
rectangle 파일을 버전 관리에서 제외하려고 했지만 버전 관리에서 제외되지 않습니다. .gitignore rectangle 이 문제는 어떻게 해결할 수 있나요?
미해결
Airflow 마스터 클래스
안녕하세요, 최근에 airflow를 공부해보려고 해당 인강을 구매했는데, airflow3버전 인강 업데이트 예정이라는 공지를 보고, 대기 중에 있습니다. 혹시 언제쯤 업데이트 될 예정인지 알 수 있을까요? 아니면 우선 airflow2 버전으로라도 보는게 나을까요?
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
첫 번째, 두 번째 둘 다 groupby(컬럼명)했는데 왜 첫번째는 에러가 나고 두번째는 정사적으로 작동하나요??
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
인덱스 값이 2001인 데이터(행)을 선택할 때 df.loc[2001] df.loc[2001].mean() loc 대신 df.iloc[1,:].mean() 위처럼 iloc 함수를 사용해도 되나요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세 위와 같이 실행했는데 baseline roc_auc가 높게 나옵니다 그리고 y_test 실행결과 label과 점수가 비슷합니다. 어떤 이유일때문일까요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
선생님 9회 기출유형 원본파일은 깃허브상에 없던데 업데이트 예정인가요?
해결됨
Git & GitHub, 원리부터 차근차근 - 근본깃
commit 메시지를 잘못 입력했는데 이걸 다른 내용으로 수정할 수 있는 방법이 있을까요? 예를 들어 "rectangle 을 수정함."을 "rectangle에 빨간색을 추가함."으로 변경할 수 있나요?
해결됨
Git & GitHub, 원리부터 차근차근 - 근본깃
언제 checkout을 사용하고 언제 switch를 사용해야 되나요? 브랜치를 이동할 때 이 둘은 동일한 원리로 작동하나요?