type 확인 후 cols = ['age', 'fnlwgt', 'education.num', 'capital.gain', 'capital.loss', 'hours.per.week'] 이렇게 수치형 데이터의 열만 복사하는 거 말고 cols = X_ train.select _dtypes(exclude='object').copy()를 사용해도 되나요?
스케일링, 인코딩 등 데이터 작업후에 위로 올라가서 다시 실행하면 처음이라 결과값이 달라지고 오류가 생기는데 한 번 실행한 작업은 다시 건드리면 안되나요? 라벨인코딩, 원핫인코딩 모두 실행하고 분리한 데이터 다시 합쳤을 때 컬럼이 107로 나와야하는데 처음이랑 그대로인 15가 나오더라구요 다시 올라가서 실행하니 전부 오류가 뜹니다 ㅜㅠ!!
섹션3. Bash operator DAG 만들기 & DAG 디렉토리 셋팅 안녕하세요, 에어플로우에 dags_bash_operator를 올리면 사진과 같이 몇 번을 시행해도 사진과 같이 실패합니다. sudo docker ps로 상태 확인해보면 별다른 문제가 없는 것 같은데, 문제의 원인이 무엇일까요?
일원, 이원 분산 분석에서 정규성 & 등분산성 가정을 위반될 때 에 대한 질문이 있습니다. 일원 분산 분석에서 정규성 검정은 충족하는데 등분산 가정이 충족되지 못하면 일원 분산 분석을 진행하지 못하나요? 이원 분산 분석에서 정규성 검정 혹은 등분산 검정 둘중 하나라도 충족되지 못하면, 이원 분산 분석을 진행하지 못하나요? 위의 1, 2 번 질문은 강사님이 다뤄주신 프로세스에 없는 부분인데 이러한 부분이 시험 출제 가능성이 있는지 궁금합니다. 감사합니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 마크다운, 단축키를 이용해서 편리하게 글을 작성할 수 있어요. 먼저 유사한 질문이 있었는지 검색해보세요. 서로 예의를 지키며 존중하는 문화를 만들어가요. 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요. 안녕하세요 DB를 회사에서 MSSQL을 쓰는데 혹시 강의에서 쓰는 DB말고 이걸 써도 괜찮을까요?
강의내용 5분 34초에서 "item-tags" : [1] 을 입력하니깐 Error 422 타입 에러가 생겼는데 이유가 무엇인지 궁금합니다. 제 생각에는 List[str]이므로 List 안에 문자형이 와야 올바르지 않을까 라는 생각을 했습니다. 그리고 1을 입력한 이유도 궁금합니다. 혹시 최신 버전의 Pydantic의 타입 검증이 더 엄격해진 이유일까요??
# age 컬럼 평균값으로 채우기 value = int(X_train['age'].mean()) print("채울 값:", value) X_train['age'] = X_train['age'].fillna(value) X_test['age'] = X_test['age'].fillna(value) 강의에서는 value 함수와 print 사용해서 평균값 채우셨는데 X_train['age'] = X_train['age'].fillna(X_train['age'].mean()) X_train.isnull().sum() 이렇게 간단하게 채우고 isnull().sum()으로 결측치가 0인지 확인하는 방법도 괜찮나요? value랑 print 부분이 이해하기 어렵고 실제로 적용하기도 어려울 것 같아서요 ㅜㅜ!!
영상에서 X_train 데이터 결측치 처리 하실 때 X_train['workclass'] = X_train['workclass'].fillna(X_train['workclass'].mode()[0]) X_train['native.country'] = X_train['native.country'].fillna(X_train['native.country'].mode()[0]) X_train['occupation'] = X_train['occupation'].fillna('X') 이렇게 해주셨는데 m1 = X_train['workclass'].mode()[0] m2 = X_train['native.country'].mode()[0] X_train['workclass'] = X_train['workclass'].fillna(m1) X_train['native.country'] = X_train['native.country'].fillna(m2) X_train['occupation'] = X_train['occupation'].fillna('X') 이렇게 저만의 방식으로 기호 만들어서 활용해도 되나요?
안녕하세요 ! 수업 들으면서 열심히 실기 준비하고 있습니다 섹션5. 라이브러리 및 데이터 불러오기 강의에서 #상관관계 코드를 입력할 때 아래와 같이 뜨는데 corr(numeric_only=True) 형식으로 바뀐건가요?? # 상관관계 X_train.corr() # 판다스 버전이 최신으로 변경될 경우 에러 발생할 수 있습니다. 아래와 같이 numeric_only=True를 사용해주세요! sum(), mean()등도 모두 포함 # X_train.corr(numeric_only=True)
안녕하세요. 지금 하는 프로젝트가 Azure Cloud DB 데이터를 불러와서 웹 대시 보드로 구현하고자 하는데요. 강의 수강 후 몇 가지 궁금한 사항이 생겨서 질문 드립니다. DBFisrt 방식으로 Azure Cloud DB에 있는 데이터를 로드 하는 방법 문의드립니다. DBFirst방식으로 구현하는 게 맞다고 생각은 하는데 CodeFirst 방식으로도 구현이 가능한지, 아니면 MSSQL 이랑 방법이 다른 건지 궁금합니다. MemberShip View에서 보면 로그인 박스 위치를 따로 지정하지 않았는데 어떻게 그 위치에 생성 되는건지 궁금합니다. UI 구성도 View 화면에서 가능한지 아니면 다른 방법이 있는지 문의 드립니다. 관련하여 참고할 만한 자료가 있을까요??
강의에서는 수치형 변수 스케일링 부분을 cols = [ 수치형 변수들] 변수 선언 후에 적용하셨는데 제 생각에는 이미 그 위에서 n_train, c_train, n_test, c_test 로 구분해 놓았기 때문에 불필요하다 생각해서 아래와 같이 작성했는데, 오류가 발생합니다. 왜그러는 걸까요? from sklearn.preprocessing import RobustScaler scaler = RobustScaler() n_train = scaler.fit_transform(n_train) n_test = scaler.transform(n_test) n_train.head() #오류내용 AttributeError: 'numpy.ndarray' object has no attribute 'head'