inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

172만명의 커뮤니티!! 함께 토론해봐요.

점수차가 많이 나는데 따로 하신게 있으신가요?

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 선생님 선생님 인강 보면서 기출을 풀어보면서 시험에 대비하고 있습니다. 근데 기출 5회에서 2유형 선생님의 baseline과 제 baseline 수치가 너무 달라서 이렇게 Q&A를 보냅니다. 선생님 baseline(랜포)은 1296이 나오는데 제가 한 baseline(랜포)은 1400대가 나옵니다 혹시 제가 뭘 잘 못한게 있는지 궁금합니다 아래는 제가한 코드입니다! #eda print('\n====데이터 크기=====') print(train.shape,test.shape) print('\n====데이터 정보=====') print(train.info()) print('\n====train 결측치=====') print(train.isnull().sum()) print('\n====test 결측치=====') print(test.isnull().sum()) print('\n====카테고리=====') cols=train.select_dtypes(include='O').columns for col in cols: set_train=set(train[col]) set_test=set(test[col]) same=set_train==set_test if same: print(col,'O') else: print(col,'X') print('\n====타겟 기초 =====') print(train['price'].describe()) # 전처리 target=train.pop('price') train=pd.get_dummies(train) test=pd.get_dummies(test) # print(train.shape,test.shape) #검증 from sklearn.model_selection import train_test_split X_tr,X_val,y_tr,y_val=train_test_split(train,target,test_size=0.2,random_state=42) print(X_tr.shape,X_val.shape,y_tr.shape,y_val.shape) # rf from sklearn.ensemble import RandomForestRegressor rf=RandomForestRegressor(random_state=42) rf.fit(X_tr,y_tr) pred=rf.predict(X_val) #학습 from sklearn.metrics import root_mean_squared_error print('===rf===') print(root_mean_squared_error(y_val,pred)) #lg import lightgbm as lgb lg=lgb.LGBMRegressor(random_state=42,verbose=-1) lg.fit(X_tr,y_tr) pred=lg.predict(X_val) print('==lg==') print(root_mean_squared_error(y_val,pred)) #lr from sklearn.linear_model import LinearRegression lr=LinearRegression() lr.fit(X_tr,y_tr) pred=lr.predict(X_val) print('==lr==') print(root_mean_squared_error(y_val,pred)) #결과 pred=lg.predict(test) submit=pd.DataFrame({'pred':pred}) submit.to_csv('result.csv', index=False)

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
anycallkjs 댓글 2 좋아요 0 조회수 69

강사님.. 하단 URL에 있었던 코드들 다운 받거나 공유 부탁 드립니다..

미해결

Data Engineering Course (1) : 빅데이터 하둡 직접 설치하기

파일이 삭제 되었습니다.. 설치 파일하나만 섹션으로 넣어주시면 안될까요..? Download Ubuntu 20.04 LTS and Installation Hadoop 3.x on Ubuntu Standalone Operation(Local mode )

  • java
  • 빅데이터
  • hadoop
  • 데이터-엔지니어링
  • mapreduce
홍태경 댓글 2 좋아요 0 조회수 64

작업형1 모의문제 4번에 3)문제 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강사님 정답이 views_min=df.iloc[:10]['views'].min df.iloc[:10, -1]=views_min 인데, df=df.iloc[0:10] df['views']=df['views'].min() 이렇게 쓰면 안될까요??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
연정 댓글 2 좋아요 0 조회수 49

이상치 전처리 작업

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강사님 다름아니라 2과목 중 데이터 전처리에서 이상치 관련 질문있습니다. 제가 강의를 듣었을 때는 이상치를 데이터의 현실적 한계성으로 판단하신거로 이해하였습니다. ex( age 컬럼은 음수가 될 수 없다.) 제가 예전에 학교에서는 이상치를 quantile을 통해 IQR값을 추출하고 그 추출한 값을 바탕으로 이상치를 판단했었던 기억이 있습니다. 그렇기에 빅데이터분석기사에서 이상치 값을 판단할 때, IQR로 이상치를 판단 또한 하는게 맞을까요? 아니면 이 과정까지는 필요가 없을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
Jeongman 댓글 2 좋아요 0 조회수 65

평가결과값 문의

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

초반에 target(output)을 pop을 이용해 분류하고 검증데이터 분할, 모델 생성/학습을 진행했습니다. roc-auc, f1score, accuracy 평가결과가 1.0 으로 나오는 이유는 뭘까요....? # 타켓설정 target = train.pop('output') # 검증데이터분할 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size = 0.15, random_state = 0) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state = 0) rf.fit(X_tr, y_tr) pred = rf.predict(X_val) pred_proba = rf.predict_proba(X_val) from sklearn.metrics import roc_auc_score, f1_score, accuracy_score print(roc_auc_score(y_val, pred_proba[:, 1])) print(f1_score(y_val, pred)) print(accuracy_score(y_val, pred)) ----------------------------------- 1.0 1.0 1.0

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
ywldud1215 댓글 2 좋아요 0 조회수 56

하단 파일이 열리지 않습니다

미해결

Data Engineering Course (1) : 빅데이터 하둡 직접 설치하기

Download Ubuntu 20.04 LTS and Installation Hadoop 3.x on Ubuntu Standalone Operation(Local mode)

  • java
  • 빅데이터
  • hadoop
  • 데이터-엔지니어링
  • mapreduce
홍태경 댓글 1 좋아요 0 조회수 55

ssh-keygen -t rsa -P "" 등 ssh 암호화? 는 하둡에서 필수인가요?

미해결

Data Engineering Course (1) : 빅데이터 하둡 직접 설치하기

강사님 안녕하세요 아래부터 자세한 설명 없이 코드를 쳤는데 하둡 셋업할때 필수로 입력 해야 하는건가요? export PDSH_RCMD_TYPE=ssh ssh-keygen -t rsa -P "" cat ~/.ssh/id_rsa.pub>>~/.ssh/authorized_keys

  • java
  • 빅데이터
  • hadoop
  • 데이터-엔지니어링
  • mapreduce
홍태경 댓글 2 좋아요 0 조회수 64

시계열 데이터 날짜와 시간 format

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

강사님, 안녕하세요. 해당 강의에서는 시간 format 파라미터 사용시 H만 대문자로 사용하면 된다고 하셨는데, e-book에서는 H:M:S 다 대문자로 되어야한다고 적혀있어서요. 어떤게 맞을까요???

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
연정 댓글 2 좋아요 0 조회수 85

평가지표 F1 스코어 질문드립니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요! F1 스코어 설명하시면서 average = micro, macro, weighted 중에 문제에서 요구하는데로 쓰면 된다고 하셨는데.. 만약 문제에서 제시된 평가지표가 F1 스코어가 아니지만 F1 스코어를 사용하려고 할 경우(문제에서 요구된게 없는 경우)에는 micro, macro, weighted 중 어떤걸 사용하면 될까요? 감사합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
한광욱 댓글 2 좋아요 0 조회수 65

수업 내 사용되는 프롬프트 등 강의 자료

미해결

데이터분석에 ChatGPT 강림

현재 '6. 데이터 분석 프로세스 - 데이터의 이해'를 학습 중인데, 매 차시에서 프롬프트 작성하시는 화면이 크게 제공되는 것도 있고 아닌것도 있어서, 어떤 질문을 하셨는지 확인해서 따라해 보기가 어렵습니다. 통계에 대해 평균, 중간값 정도의 이해만 있는 상태에서 깨져 나오는 화면의 글자를 보고 따라 하기가 너무 어렵네요 어떤 차시는 질문 타이핑 하신 걸 확대 해주셔서 보고 했는데, 이번 차시부터는 확대를 안 해주셔셔.. 뭉그러진 화면을 보고 추측해서 학습을 하고 있습니다.(따라 하고) 좀더 데이터 분석에 대해 알면 프롬프트를 따라 하지 않고, 말만 듣고도 내가 질문을 적당히 만들어 할 수있지만, 이제 시작하는 저로서는 무척 어렵네요 강의 내 사용하신 프롬프트라도 따로 텍스트로 제공해 주시면 좋겠어요

  • 빅데이터
  • 데이터-리터러시
  • chatgpt
하루분 댓글 1 좋아요 0 조회수 47

작업형 2 기출7회분에서

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 혹시 선형회귀모델에서 rmse 값이 가장 낮게 나왔어서 모델을 선택하고 실제 test 데이터를 예측하는데, 이 과정에서 80프로의 train으로 학습한 모델이잖아요..? 나중에 train 자체 100프로를 재학습시킨 후 test 예측하는게 더 올바른 것인지.. 이 과정 없이 그동안 진행해온 부분으로 바로 test 예측하는게 좋은지 궁금해요!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
아기고앵 댓글 2 좋아요 0 조회수 67

GROUP BY, HAVING 실습 1번문제

미해결

[2026] 비전공자도 한 번에 합격하는 SQLD 올인원

먼저 유사한 질문이 있었는지 검색해보세요. 서로 예의를 지키며 존중하는 문화를 만들어가요. 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요. 실습 1번문제 쿼리는 맞게 했는데 왜 값이 다르게 나올까요 ?

  • sql
  • 빅데이터
  • 코딩-테스트
  • 데이터-엔지니어링
  • SQLD
우냥 댓글 2 좋아요 1 조회수 61

작업형2 모의문제1 (30강)

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

수업에서는 수치형 데이터에 대한 스케일링을 미실시 하였고, 학습 모델도 랜덤포레스트로만 진행하였습니다. 수치형 데이터에 대해 StandardScaler, RobustScaler 등의 스케일링을 실시하고, lightgbm 모델도 학습을 했을 때 랜덤포레스트 모델보다 성능이 좋게 나왔습니다. 혹시 이 문제에서 스케일링을 하면 안되는 이유나 lightgbm으로 했을 때 발생할 수 있는 문제가 있을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
danielcho0930 댓글 2 좋아요 0 조회수 53

수강 기간 연장 문의 드립니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 작년 개인 일정으로 인해 응시하지 못했던 실기 시험을 다가오는 6월 20일에 치르고자 준비하고 있습니다. 현재 제가 수강 중인 강의의 종료일이 2026년 5월 20일로 예정되어 있어 문의를 드립니다. 혹시 수강 기간을 실기 시험일 인 2026년 6월 20일 까지 연장해 주실 수 있는지 조심스럽게 여쭤보고 싶습니다. 만약 연장을 해주신다면, 남은 기간 동안 더욱 열심히 수강하여 이번 시험에 꼭 합격하고 싶습니다. 긍정적으로 검토해 주시면 감사하겠습니다. 감사합니다. 계정 이메일: whddlsghd@naver.com

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
졸린 공작 마크 댓글 2 좋아요 0 조회수 62

수강 계획과 관련해 문의 드립니다.

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

강사님 안녕하세요. 수강 계획을 짜기 위해, 관련하여 문의드리려고 합니다. 현재 제가 여러가지 일을 병행하고 있어, 실기 시험일 (6월 20일) 까지 강의 수강 및 시험 대비 계획을 짜려고 합니다. 강의 중 '최근 시험이 이전보다 좀 더 어려워져서 강의 계획에 포함된 문제들뿐만 아니라, 케글에 업로드 해 놓은 문제도 풀어보는 것이 필요하다'는 이야기를 들은 바 있어서, 해당 문제들을 푸는것도 계획에 포함시키기 위해 '해당 문제들은 어느정도 풀어봐야 실기 시험에 안정적으로 합격할 수 있다' 라 할 수 있을만한 대략적인 양이 있는지 궁금해 질문드립니다. 또한 현재 총 강의 중 10% 정도를 수강했는데, 비전공자로서 이전에 대학에서 방학동안 들었던 데이터 분석 강의에서 배운 내용을 환기하는데 도움 많이 되었습니다. 이에 좋은 강의 제공해 주셔서 감사합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
cpltctac 댓글 2 좋아요 0 조회수 47

마인드맵 사용 프로그램

미해결

[2026] 비전공자도 한 번에 합격하는 SQLD 올인원

먼저 유사한 질문이 있었는지 검색해보세요. 서로 예의를 지키며 존중하는 문화를 만들어가요. 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요. 안녕하세요. 마인드맵 강의 하실 때 하시는 프로그램 무엇인지 알 수 있을까요? 정리할때 좋은 것 같아서 해보려고 합니다. 감사합니다.

  • sql
  • 빅데이터
  • 코딩-테스트
  • 데이터-엔지니어링
  • SQLD
우냥 댓글 1 좋아요 1 조회수 48

엔터티 종류

미해결

[2026] 비전공자도 한 번에 합격하는 SQLD 올인원

먼저 유사한 질문이 있었는지 검색해보세요. 서로 예의를 지키며 존중하는 문화를 만들어가요. 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요. 안녕하세요. 엔터티 종류중에 유,무형 구분/ 발생지점이 있는데 사건 엔터티랑 행위 엔터티랑 다른건가요? 감사합니다.

  • sql
  • 빅데이터
  • 코딩-테스트
  • 데이터-엔지니어링
  • SQLD
우냥 댓글 2 좋아요 0 조회수 58

작업형1 - 연습문제 16~39 풀이는 몇강을 보면 되나요?

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 22강 작업형1 연습문제 13~15번까지 듣고, 그 이후 문제인 16번~39번까지의 연습문제 풀이를 보려고 찾아봤는데 강의를 못 찾아서요... 나머지 16~39번 풀이는 몇강을 보면 되는지 궁금합니다. 몇강을 보면 되는지 답변해 주시면 감사하겠습니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
EVERGREEN 댓글 2 좋아요 0 조회수 101

강의 교재[빅분기]

미해결

[핵집] 2025 빅데이터 분석기사(필기)_과목 3~4

안녕하세요. 강의 교재[빅분기]가 필요합니다. squeeze61@korea.kr 로 부탁드립니다.

  • 빅데이터
홍순철 댓글 2 좋아요 0 조회수 56

작업형 1 -연습문제 4-6

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요 선생님 작업형1 4-6 NEW 강의에서 Section 5번 답이 0.61인데 저는 계속해서 0.68이 나오네요 ㅠ 오타일 확률은 없는거겠죠 FJ포함된 조건으로 cond 작성한다음 df[cond].shape 하면 28개행 나옵니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
딩딩 댓글 2 좋아요 0 조회수 60

인기 태그

인프런 TOP Writers

주간 인기글