inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

172만명의 커뮤니티!! 함께 토론해봐요.

인코딩 선택 기준!

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

선생님! 원핫 / 라벨 인코딩을 언제 써야할 지 기준이 있으신가요? 강의 언제쩍에 보면 라벨인코딩이 어지간하면 다 통한다고 언급하신적이 잇었는데... 사실 저는 제출이 목표라 둘중에 아무거나 쓰긴할꺼지만ㅠㅠㅠ 기준이 있으신지 궁금합니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
moonwrd 댓글 3 좋아요 0 조회수 326

[py] T1-13. 상관관계 구하기 Expected Questions

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강사님 캐글의 공유해주신 작업 1유형 문제 중 아래 링크의 문제 관련 질문드립니다. # 상관관계 구하기 # 주어진 데이터에서 상관관계를 구하고, quality와의 상관관계가 가장 큰 값과, 가장 작은 값을 구한 다음 더하시오! # 단, quality와 quality 상관관계 제외, 소수점 둘째 자리까지 출력 처음 지문을 보고 문제를 혼자 풀이 하였을 땐, 상관관계가 가장 큰 값과 작은 값에 대해 절대값으로 확인하라는 내용이 없어서 절대값을 고려하지 않고 문제를 풀이했습니다. 이후 풀이 코드를 확인했을 땐 절대값으로 확인하고 풀이한 내용이 들어있어 질문드립니다. 제가 비전공자라 기본 지식이 부족해서 조금 헷갈리는데, 위와 같은 맥락의 문제에서는 지문에 따로 '절댓 값' 이라는 언급이 없어도 기본적으로 절대값으로 구해야한다는 전제를 깔고 풀이해야하나요? (절댓값 유무의 따라 결과값 달라짐) 문제 지문에서는 '소수점 둘째 자리까지 출력' 이라고 적혀있었는데 풀이 코드에서는 round() 함수를 사용해서 정답을 출력하고 있습니다. 해당 문제에서의 정답에는 큰 영향은 없었지만 풀이중 궁금해서 질문드립니다. 별도의 버림, 올림, 반올림 등의 조건이 없는 지문에 대해서는 기본적으로 round() 함수를 사용하면 될까요? https://www.kaggle.com/code/agileteam/py-t1-13-expected-questions

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
mr.woong0926 댓글 1 좋아요 0 조회수 150

샤피로윌크, 윌콕슨 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

샤피로윌크 검정과, 윌콕슨 검정시에 어떨때는 df[~] 콤마 df[~]이 들어가고 어떨땐 df[~] - df[~]가 들어가는지 헷갈립니다..

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
빅분기1202 댓글 2 좋아요 0 조회수 267

2회 기출유형(작업형2) 오류가 나서요 ㅠ

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

2회 기출 작업형2 하다가 오류가 나서 문의드립니다. 랜덤포레스트 부분입니다. # 랜덤포레스트 from sklearn.ensemble import RandomForestClassifier model = RandomForestClassifier(random_state=0)model.fit(X_tr,y_tr) pred = model.predict_proba(X_val) 이렇게 오류가 나는데 ㅠㅠ 왜그런걸까요.....

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
유리시나 댓글 2 좋아요 0 조회수 240

데이터를 합쳤다가 인코딩한 후 분리

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 df.iloc[:,line] 이 부분에서 line이 갑자기 정의도 안하고 왜 튀어나오는지 궁금합니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
csms9870 댓글 1 좋아요 0 조회수 196

독립표본 검정 변수 순서

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

독립표본 T 검정시에 ttest_ind(A,B)를 통해 검정하는데 A,B순서에 따라 t_score값의 부호가 바뀌게됩니다 시험에서 t_score의 값을 물어보는 경우 변수 순서를 어떻게 정해야 정답이 될 수 있을까요? 아니면 절대값만 볼까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김주현 댓글 1 좋아요 0 조회수 156

공부방식에 질문있습니다.

해결됨

[코드캠프] 부트캠프에서 만든 고농축 프론트엔드 코스

일단 현재 라우팅수업 진행중입니다! 매 섹션 강의를 다 듣고나서 해당섹션 학습자료 복습 후 퀴즈와 포트폴리오 과제실습을 진행하는데 퀴즈와 포트폴리오를 진행할때마다 배웠던 코드구동원리는 이해는 했지만 실습할때마다 코드구성이 정확히 기억나지않아서 매번 이전 자료를 보면서 해당코드는 따라치고 조립하는 경향이있는데 이런식으로 공부해도 되는지 의구심이 들어서 질문드려요 가급적이면 코드구성도 다 외워서 아무것도 보지않고 해내는게 제일 바람직할까요?

  • react
  • node.js
  • seo
  • graphql
  • next.js
cyh1908 댓글 2 좋아요 0 조회수 232

3회 기출유형(작업형1)

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

작업형 1의 세번째 문제를 혼자 풀고 풀이를 보며 비교해보니 답이 조금 달라 질문드립니다. import pandas as pd df = pd.read_csv("members.csv") a= df.isnull().sum() # print(a) print(a.sort_values(ascending=False).index[0]) 저는 위처럼 풀어 f1이라는 답을 냈지만 풀이의 답은 'f1'입니다. ( 작은 따옴표의 차이) 이 같은 경우에는 제 풀이가 오답이 되는 것인지 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
최후일격 댓글 1 좋아요 0 조회수 186

다중 회귀 분석에서 유형[T.C]의 의미 (영상 37초)

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 제목 그대로 다중선형 회귀 분석 시에 from statsmodels.formula.api import ols model=ols('종속~독립1+유형(범주형)',data=df).fit() 하고 summary() 했을 때 유형[T.C] ,유형[T.B] 이것의 의미는 뭘까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
wanzy123 댓글 1 좋아요 0 조회수 190

결측치 채우기 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 수치형 변수 결측치를 채울 때 X_test 데이터에는 X_test의 age 평균값이 들어가야 한다고 생각했는데 X_test['age'] 에 X_train['age']의 평균값을 넣는데 이유가 있을까요? 주당 근무시간에 대해서도 test 데이터에 train 데이터의 중앙값을 넣어주던데 같은 질문입니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
현지원 댓글 2 좋아요 0 조회수 190

prevState 관련 질문드립니다

해결됨

[코드캠프] 부트캠프에서 만든 고농축 프론트엔드 코스

카운터만드는 부분은 이해가 갔는데 토글 만드는 부분에서 이런식으로 현재 state를 뒤집는것과 무슨 차이가 있는 건지 잘 이해가 가지 않습니다. const onToggleModal = () => { setIsOpen((perv) => !prev); }; const onToggleModal = () => { setIsOpen(!isOpen); };

  • react
  • node.js
  • seo
  • graphql
  • next.js
YJ J 댓글 2 좋아요 0 조회수 195

3회 기출유형(작업형2) 채점부분 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

채점부분 코드 돌리려는데, 이렇게 오류가 뜨네요. 제 풀이는 import pandas as pd from sklearn.ensemble import RandomForestClassifier from sklearn.model_selection import train_test_split from sklearn.metrics import accuracy_score from sklearn.metrics import precision_score from sklearn.metrics import recall_score from sklearn.metrics import f1_score from sklearn.metrics import confusion_matrix from sklearn.metrics import roc_auc_score df1 = pd.rea d_csv('/content/drive/MyDrive/bigdata(빅분기 놀이터)/기출문제/3회/train.csv') # print(df1.head()) # print (df1.inf o()) # print(df1.describe()) df2 = pd.rea d_csv('/content/drive/MyDrive/bigdata(빅분기 놀이터)/기출문제/3회/test.csv') # print(df2.head()) # print (df2.inf o()) # print(df2.describe()) df1['TravelInsurance'] = df1['TravelInsurance'].astype('category') x = df1.drop('TravelInsurance', axis=1) y = df1['TravelInsurance'] x_encoded = pd.get_dummies(x) x_train, x_valid, y_train, y_valid = train_test_split(x_encoded.drop('Unnamed: 0', axis=1), y, test_size=0.25) md = RandomForestClassifier(n_estimators=300) md.fi t(x_train, y_train) pred = md.predict(x_valid) cm = confusion_matrix(y_valid, pred, labels=[1,0]) print(cm) print(accuracy_score(y_valid, pred)) print(precision_score(y_valid, pred)) print(recall_score(y_valid, pred)) print(f1_score(y_valid, pred)) print(roc_auc_score(y_valid, pred)) x_test = df2 x_test_encoded = pd.get_dummies(x_test) md = RandomForestClassifier(n_estimators=300) md.fi t(x_encoded.drop('Unnamed: 0', axis=1), y) pred = md.predict_proba(x_test_encoded.drop('Unnamed: 0', axis=1)) # print(pred) result = pd.DataFrame({'y_pred' : pred[:, 1]}).reset_index() print(result) result.t o_csv('기출유형 3회 (작업형2) 답안.csv', index = False) 입니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
세린 댓글 1 좋아요 0 조회수 166

7회 3형 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

# 1) 학습 데이터와 테스트 데이터 분리 X_train = train[['weight']] y_train = train['gender'] X_test = test[['weight']] y_test = test['gender'] x_train, x_test는 대괄호가 2개고, y_train, y_test는 대괄호가 1개인 이유가 무엇인가여....

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
DataAnonymous 댓글 1 좋아요 0 조회수 141

API Routes를 사용하는 기준과 장/단점에 대해서 알고 싶습니다!

미해결

Next.js 시작하기

안녕하세요, 강사님 좋은 강의 감사합니다!! 시간 가는지 모르고 빠르게 완강을 하게 되었습니다.API Routes 부분이 조금 헷갈려, 이 부분에 대한 궁금증이 생겨 질문을 남기게 되었습니다.Next.js를 사용하여 API 라우트를 통해 클라이언트에서 서버로 직접 데이터베이스나 외부 서버에 접근하여 클라이언트 단에서 사용할 수 있다는 것을 알게 되었습니다. API 라우트를 통한 외부 서비스 URL 숨기기 서버의 env 사용, 외부 서비스 안전하게 접근. 일반, 서버 DB에 접근해서, 사용하는 것보다 어떤 부분에서 장점이 있는지 크게 와닿지 않아서, 혹시 조금 더 구체적인 실무에서의 API Routes를 활용하는 예시를 좀 더 자세하게 알 수 있을까요? 이를 사용했을 때 서버 DB에 직접 접근했을 때 얻는 것에 비해 가질 수 있는 장점과 단점에 대해 알고 싶습니다.

  • javascript
  • react
  • next.js
김용민 댓글 3 좋아요 1 조회수 946

6:58 mannwhitneyu 검정 시 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

p-value값이 0.4이므로 귀무가설을 채택한다는 것은 결국 대립가설을 기각한다는 뜻이므로 B점수가 더 높다는 것을 기각한다는 뜻인가요? 혹시나 해서 A 와 B각각 평균을 내보았더니 A는 60점대고 B는 80점대였습니다. 제가 잘못 이해했는지 모르겠는데, B의 평균이 더 높기 때문에 원래대로라면 p값이 0.05보다 작게 나왔어야 하는 것 같은데 왜 그런가요 ?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
hslee0216 댓글 2 좋아요 0 조회수 275

서버 로그인 방식과 결합

미해결

Next + React Query로 SNS 서비스 만들기

안녕하세요! 개인 프로젝트에서 백엔드 먼저 개발 후 프론트를 Next로 개발하면서 강의를 통해 next-auth를 접했는데요. 저는프론트에서 로그인을 하면 해당 로그인 request가 서버로 전달되고, 서버에서 jwt access, refresh token을 발급해프론트에 전달하고 저장하는 기존의 서버 로그인 방식으로 설계를 하였습니다. 또한 서버의 protected request에 대해 위에서 발급한 access token을 활용하여 유효한지 검증 후 진행하도록 하고자 하는데요. next-auth부분을 보며 현재의 공식 문서와도 조금 다르고 제가 원하는 방식과 통합하여 구현이 가능한지 잘 이해가 안가더라구요ㅠ 혹시 이러한 방식으로도 서버에서 얻은 jwt토큰을 next-auth에 삽입이 가능할까요? 대략적인 흐름은 어떻게 진행될까요?

  • react
  • next.js
  • react-query
  • next-auth
  • msw
성민최 댓글 2 좋아요 0 조회수 854

수치형 데이터 스케일링

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

수치형 데이터 스케일링 할때, 범주형 데이터 라벨 인코딩 하듯이, 아래와 같은 방법으로 해도 되는지요? 에러가 나서, 방법이 자체가 잘 못 된건지.. 아니면 방법은 틀리지 않은데, 부분적인 코드 작성에 실수가 있는건지 .... 여쭤보고 싶습니다. ^^;; from sklearn.preprocessing import MinMaxScaler n_cols = ['Age', 'AnnualIncome', 'FamilyMembers', 'ChronicDiseases'] for n_col in n_cols : scaler = MinMaxScaler() X_train[n_col] = scaler.fit _transform(X_train[n_col]) test[n_col] = scaler.transform(test[n_col])

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
garlic78 댓글 1 좋아요 1 조회수 224

캐글 관련 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

강의를 완강하고 캐글로 공부하려고 하는데 수업때 풀었던문제랑 겹치는 문제가 무엇인지 궁금합니다. 또는 우선순위랑 필수문제가 있는지, 수업이랑 겹쳐서 볼 필요 없는 문제는 무엇인지 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김성환 댓글 1 좋아요 0 조회수 210

작업형2, 예측값(타겟)

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 train = train.drop 할 때가 있고 target = train.pop 할 때있는데 방법이 다른 이유가 무엇인지

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
guddbs7763 댓글 1 좋아요 0 조회수 153

5회 2형 lightgbm질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

5회 2형 lightgbm으로 작성하면 아래와 같은 문구가 나타납니다. 혹시 어떤 부분이 잘못되었을까여?? < 코드 > x_train = pd.get_dummies(x_train) x_test = pd.get_dummies(x_test) from sklearn.model_selection import train_test_split xx_train, xx_test, yy_train, yy_test = train_test_split(x_train, y_train, test_size = 0.2, random_state = 42) import lightgbm as lgb model_g = lgb.LGBMRegressor(n_estimators = 150, max_depth = 4, random_state = 42) model_g.fit(xx_train, yy_train) pred_t_g = model_g.predict(xx_test) < 에러 메세지 > [LightGBM] [Warning] Found whitespace in feature_names, replace with underlines [LightGBM] [Info] Auto-choosing row-wise multi-threading, the overhead of testing was 0.000399 seconds. You can set force_row_wise=true to remove the overhead. And if memory is not enough, you can set force_col_wise=true . [LightGBM] [Info] Total Bins 395 [LightGBM] [Info] Number of data points in the train set: 3007, number of used features: 23 [LightGBM] [Info] Start training from score 12318.722980 [LightGBM] [Warning] No further splits with positive gain, best gain: -inf [LightGBM] [Warning] No further splits with positive gain, best gain: -inf

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
DataAnonymous 댓글 1 좋아요 0 조회수 372

인기 태그

인프런 TOP Writers

주간 인기글