전 아래 코드처럼 작성했는데 정답과 다르게 나오더라구요 어느 부분 때문에 다른 건지 알려주실 수 있을까요? df['CPU'] = df['CPU'] < 100 from statsmodels.formula.api import ols model = ols('ERP ~ Feature1 + Feature2 + Feature3 + CPU',data = df).fit() print(model.summary())
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 rmse를 사이킥런에서 지원하지 않아서, mse로 만들어줘야하는 걸로 알고있는데, 그냥 아래처럼 써도 값은 출력되더라고요. 혹시 이유 알수있을까요? from sklearn.ensemble import RandomForestRegressor rf = RandomForestRegressor(random_state=0) rf.fit(X_tr,y_tr) pred=rf.predict(X_val) root_mean_squared_error(y_val,pred) 이렇게 쓰면안되나요?
음, 데이터 전처리 과정에서 인코딩할 때, 1) 그냥 인코딩 하는 경우 2) 데이터를 concat으로 합쳐서 인코딩 하는 경우 3) 데이터를 합쳤다가 iloc로 쪼개서 인코딩 하는 경우 어떨 때, 위의 경우들이 구분되는지... 예시를 들어주실 수 있나요?ㅠ 자꾸 헷갈리네요..ㅠㅠㅠ
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 아래처럼 여러가지로 해봤는데, 활성화된 코드같은 경우 왜 228을 출력하는지 잘 모르겠어요.. ascending=False 안 쓰고, max() 써서 진행하는 방법 설명 부탁드립니다. df['순전입학생'] = df['전입학생수(계)'] - df['전출학생수(계)'] #df.head(3) #가장 많은 학교의 전체학생수를 cond1 = df['순전입학생'].max() #df.sort_values('순전입학생', ascending=False).head(3) #cond1 = df['순전입학생'] == 923 #정수로 출력하시오 print(df['전체학생수(계)'][cond1].sum()) #print(int(df.loc[cond1,'전체학생수(계)'])) #정수로 출력하시오
안녕하세요. 너무 좋은 강의 항상 잘 보고 있습니다. 궁금한 점은.. 로지스틱 회귀 문제의 경우 결과가 분류로 나오는 것으로 알고 있습니다. model = logit('gender ~ weight', data = train).fit() weight를 독립변수로 하고 gende를 독립변수로 하는 로지스틱 회귀 모델을 만들고, test 데이터의 gender를 예측하는 문제입니다. pred = model.predict(test) > 0.5 >0.5 로 명시하지 않으면 1일 확률값 이 나오기 때문에 true/false로 나타내도록 하라고 하셨습니다. 궁금한 점은 logit 함수를 만들 때 gender를 범주형으로 명시하지 않아도 되는지 입니다. C()로 gender를 묶어보니 에러가 나오더라구요. ㅎ 아직 모르는 게 많아 질문드리니 알려주시면 정말 감사하겠습니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 df.sort_values('순전입학생', ascending=False).head(1) 로 봤을때, 전체 학생수를 바로 알 수 있으니까 굳이 출력 코드 안짜고 바로 230으로 제출해도 되나요? 아니면 출력 코드도 짜야하나요?
제가 전에 섹션8 관련해서 한번에 모아주실순없냐라고 질문 했었는데요. 그부분에있어서 선생님께서 질문을 오독하신거같습니다. 제가 질문드렸던건 섹션8에있는 pdf문서들을 정답이 안써져있는버전으로 통합해서 올려주실순 없는지 여쭤본것이었습니다. 강의를 보기전 혼자 먼저 풀어보고싶습니다. 현재 올려져있는 문서들은 하단에 답이 적혀져있어서 학습하기에 불편합니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 2번문제를 len 안쓰고 이렇게 풀어도 되는가요? 결과값은 동일하게 144로 나오는데, sum쓰면서 갯수의 합인지? 각 값의 합인지? 헷갈렸습니다. 갯수의 합이 맞다면 각 값의 합도 구할수있나요? bmi = df['Weight']/((df['Height']*0.01)**2) normal = ((18.5 <= bmi) & (bmi <23)).sum() danger = ((23 <= bmi) & (bmi<25)).sum() result = int(abs(normal - danger)) print(result)
df['총범죄'] 구할 때 iloc[:, 1:-1] 이라고 풀이하셨는데 날짜 강력범죄 절도범죄 폭력범죄 지능범죄 풍속범죄 교통범죄 경찰서 마지막에서 바로 앞부분까지만 출력하려고 -1을 한 건 이해가 갔습니다 근데 기출 5회 작업형 1 -3 문제를 보면 전체학생수를 구하는 문제에서 전체학생수의 위치도 마지막 바로 앞인데 iloc[0,-2] 여기서는 왜 -2 인지 궁금합니다. 마지막 앞부분인 것은 동일한데 왜 하나는 -1 이고 하나는 -2 인지 혼동이 오네욥
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요 강사님, https://inf.run/w8sEV 위 링크에서 안내해주신 가이드에 작업형1에 대한 언급은 없으셔서 그런데, 작업형1은 했다는 가정하에 말씀 주신걸까요?
안녕하세요, 선생님. 시험이 얼마 안남았지만, 덕분에 잘 준비하고 있습니다!! 다름이 아니라, 문득 어쨋든 회귀분석 문제라면 OLS도 가능하지 않을까 싶어서 한번 시도해봤습니다. 레이블 인코딩 진행 후, OLS 회귀모델로 예측모델 만들어서 RMSE 체크해보니, 선생님 선형회귀 에러값 보다 약간 낮게 나오더라고요. 그래서 여쭙는 것은, 어쨋든 회귀분석 모델이니 OLS도 작업형 2유형에서 예측모형으로 사용해도 괜찮을지요? 그렇다면, 종속변수가 범주형일 때 logistic 회귀분석도 사용해서 예측모형을 만들어도 될지 여쭙니다!
공공데이터와 Folium(Python Library)으로 만드는 제주 오름 지도 안내 서비스
공공데이터에서 위도, 경도가 들어간 데이터 파일을 가져오긴 했는데, 일부 데이터는 위도, 경도 데이터가 없는 경우가 있고, 또한 저는 버스경로(실시간 도착시간) 이런 부분도 표시하고 싶은데, 잘 모르겠습니다. 질문은 다음과 같습니다. 공공데이터 중 일부 데이터가 없는 경우, 해당 '위도, 경도' 데이터를 일일이 수작업으로 확인하는 것이 아니라, 코드나 다른 방법으로 해당 데이터에 위도, 경도 데이터를 일괄 수집하는 방법이 있을까요? 오름 데이터(사실 전 다른 데이터 사용) + 버스경로(실시간 도착시간) 이런 것을 같이 표시하고 싶은데, 이 경우에는 어떤 방법을 사용해야하나요? 공공데이터포털에 '전국버스노선정보'나 'oo시 버스시간' 홈페이지 이런건 있는데, 이를 활용하는 방법이나 어떻게 해야하는지 잘 모르겠어요... 도와주세요.. 아니면, 추가적으로 더 들으면 좋을 강의를 추천해주세요~
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 ['ID', 'Age', 'Work_Experience', 'Family_Size', 'Segmentation'] #num_cols = ['Age', 'Work_Experience', 'Family_Size'] 위에 처럼 안하고 num_cols=train.select_dtypes(exclude='O').columns 이거 쓰고 싶은데, ID행만 삭제해서 쓰면되나요?
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 2-2번을 동일한 코드를 넣어도 저는 답이 0.692가 나오는데 데이터가 제가 틀리게 작성한부분이 있을까요? 2-1번까지는 답이 동일하게 나왔습니다.