결측 값을 가진 데이터는 바로 뒤에 있는 값으로 대체한 후 (바로 뒤가 결측값이라면 뒤에 있는 데이터 중 가장 가까운 값) city와 f2 컬럼 기준으로 그룹합을 계산한 뒤 views가 세번째로 큰 city(도시) 이름은? 문제를 푸는데.. df = df.fillna(method='bfill') 라고 치면 <ipython-input-43-5b45f8741ad5>:7: FutureWarning: DataFrame.fillna with 'method' is deprecated and will raise in a future version. Use obj.ffill() or obj.bfill() instead. df = df.fillna(method='bfill') 과 같은 메시지가 뜨네요. 이제 df = df.fillna(method='bfill') 대신 obj.bfill() 라고 쓰는걸 익혀야 하나요? 아니면 당분간은 괜찮을런지요. 늘 감사합니다.
안녕하세요! 10회 시험 대비 강의 업데이트 관련해서 문의드립니다. 기왕이면 업데이트 완료된 강의를 수강하고 싶어서요..! ‘작업형2’의 최종 업데이트 예정일이 어떻게 될까요? ‘작업형3’도 업데이트 예정이실까요? 그렇다면 업데이트 일정이 어떻게 될까요? 1,2번 문의 외 업데이트 예정인 강의가 또 있을까요?
listbox = [15, 46, 78, 24, 56] def answer(listbox): result = max(listbox) - min(listbox) return result answer(listbox) 마지막 퀴즈 문제에서 저렇게 풀어도 문제는 없는건가요 ?? 저는 함수명을 answer로 설정하고 data 대신 listbox를 바로 받았는데 이렇게 풀어도 문제가 없는지 궁금합니다.
안녕하세요 168. TMDB5000 데이터 세트를 이용한 콘텐츠기반 필터링 구현 실습 - 02 강의에서 9:50 부분을 보면 find_sim_movie() 함수가 있습니다 강의 동영상에서는 The Godfather 와 유사도가 높은 순으로 결과가 나왔는데 The Godfather 가 유사도가 가장 높아야 되는데 The Godfatehr 가 아니고 다른 영화가 유사도가 가장 높은 것으로 나옵니다 왜 이런 결과가 나오는지 설명 부탁드립니다
다음과 같이 코드를 작성했는데, 결과값에 .0 이 붙어서 출력됩니다. 왜 그런 걸까요? df['출동시간'] = pd.to _datetime(df['출동시간']) df['도착시간'] = pd.to _datetime(df['도착시간']) df['time'] = df['도착시간'] - df['출동시간'] result = df.groupby('소방서')['time'].mean() result = result.sort_values(ascending=False) result = round( result.dt.total _seconds() / 60) # round 함수에 반올림 위치를 명시하지 않으면 정수를 반환해야 하지 않나요?) print(result[0])
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 2회 기출문제 작업형2에서 왜 쌤이 한거랑 다르게 결과가 나올까요,,,,,,,, # 검증 데이터 분리 아래는 쌤 풀이 입니다 ((7039, 11), (1760, 11), (7039,), (1760,)) 이건 제가 작성한 코드입니다 from sklearn.model_selection import train_test_split X_tr,X_val,y_tr,y_val = train_test_split ( X_train, y_train [ 'Reached.on.Time_Y.N' ] , test_size= 0.2 , random_state= 2022 ) X_tr.shape, X_val.shape, y_tr.shape, y_val.shape ((7039, 10), (1760, 10), (7039,), (1760,))
안녕하세요. 오징어게임 관련해서 문의사항이 있어 남깁니다. 5/12 미션 [2-a 도서] 작업형1 연습문제 - 섹션1, 섹션2 (p.164~165)의 경우 시나공 2026 버전으로 작성해주신 것 같은데 제가 갖고 있는 2025 버전의 경우는, 섹션을 기준으로 풀면 되는지 문의드립니다! 답변해주시면 감사하겠습니다^^
# test 예측 pred = rf.predict_proba(test) ValueError Traceback (most recent call last) <ipython-input-221-192ffa211ac4> in <cell line: 0>() 1 # test 예측 ----> 2 pred = rf.predict_proba(test) 3 3 frames /usr/local/lib/python3.11/dist-packages/sklearn/utils/validation.py in _check_feature_names(estimator, X, reset) 2775 message += "Feature names must be in the same order as they were in fit.\n" 2776 -> 2777 raise ValueError(message) 2778 2779 ValueError: The feature names should match those that were passed during fit. Feature names unseen at fit time: - TravelInsurance 이런 오류가 뜹니다 test가 예측값이니까 TravelInsurance 컬럼이 없어야 하는게 맞는건가요? 샘플 찍어봤을 때 train,test 둘 다 TravelInsurance 이 컬럼이 있었습니다. 코드 작성은 선생님과 동일하게 했는데 자꾸 저런 오류가 뜨네요 ㅠㅠ 검증 데이터 분리할 때 train.drop만 해줘서 그런건가요..?
안녕하세요! 기본적인 질문인데.. titanic_train.csv 로드하는 방법 중 아래 과정중 마지막 과정 다음으로 어떻게 해야하나요? 영상 상 별다른 버튼 클릭(Create Table with UI나 Create Table in Notebook) 및 저장 없이 진행 된 듯 보이는데, 그냥 두 번째 캡처본의 'Create Table in Notebook' 누르니까 코드가 실행 되며 display, show등 작동은 합니다. 기본 디폴트 데이터 경로가 /FileStore/tables/ 인 건가요?? 로드한 titani_train.csv 이런 데이터 목록을 어디에서 볼 수 있을 지도 여쭙니다. 좌측 메뉴에서 Catalog 누르면 캡처본처럼 Data라는게 뜨는데 아무런 테이블(데이터)가 없다고 뜨네요.. 근데 코드는 실행이 되니 어찌 된 건 지 잘 모르겠습니다ㅜㅡㅜ