inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

이야기를 나눠요

173만명의 커뮤니티!! 함께 토론해봐요.

작업형2 성별예측 문제

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

https://dataq.goorm.io/exam/116674/체험하기/quiz/4 여기서 하는 성별예측 문제에서 import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") # print(train.shape, test.shape) # print( train.info ()) # print(train.isnull().sum()) # print(test.isnull().sum()) #결측치 처리 (환불금액) train['환불금액'] = train['환불금액'].fillna(0) test['환불금액'] = test['환불금액'].fillna(0) # print(test.isnull().sum()) # print(train['성별'].value_counts()) #인코딩 target = train.pop('성별') train = pd.get_dummies(train) test = pd.get_dummies(test) #검증 데이터 분리 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=0) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit (X_tr, y_tr) pred = rf.predict_proba(X_val) # print(pred) from sklearn.metrics import roc_auc_score roc = roc_auc_score(y_val, pred[:,1]) #예측 및 파일생성 pred = rf.predict_proba(test) submit = pd.DataFrame({ "pred":pred[:,1] }) submit.to _csv("result.csv", index=False) # print( pd.read _csv("result.csv")) 이렇게 코딩을 했는데 예측 및 파일 생성에서 pred = rf.predict_proba(test) 여기 부분이 오류가 뜨는데 왜 그런가요 ㅠㅠ > Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 43, in <module> pred = rf.predict_proba(test) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 674, in predict_proba X = self._validate_X_predict(X) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 422, in validate X_predict return self.estimators_[0]._validate_X_predict(X, check_input=True) File "/usr/local/lib/python3.9/dist-packages/sklearn/tree/_classes.py", line 407, in validate X_predict X = self._validate_data(X, dtype=DTYPE, accept_sparse="csr", File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 437, in validate data self._check_n_features(X, reset=reset) File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 365, in check n_features raise ValueError( ValueError: X has 73 features, but DecisionTreeClassifier is expecting 74 features as input. 이렇게 뜹니다,,

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
wnguswls2818 댓글 1 좋아요 0 조회수 250

문제2

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 좋은 강의 감사드립니다. 덕분에 잘 배우고 있습니다. 문제 2. 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 그리고 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요! 문제2를 대하고 순간 다음과 같은 고민을 했었습니다. 1번을 수행하여 'f1'컬럼의 결측치 행을 삭제한 후 2번을 하려니 'f3'컬럼의 결측치 갯수가 18개만 남더군요. 그럼 18개는 최초 데이터 100개의 20% 미만일까? 그렇지 않다. 'f1'컬럼 결측치를 제거한 후 데이터 갯수 69개의 20%~30%(14~20)에 해당한다. 그렇다면 'f3'컬럼의 최빈 값은 'f1'컬럼의 결측치를 제거하기 전의 값을 사용해야할까 아니면 결측치 제거 후의 값을 사용해야 할까? 결과적으로는 어떤 방식으로 하던 답은 56으로 일치했지만 주어진 데이터에 따라 다른 값이 나올 수도 있을 것 같습니다. 혼돈을 없애기 위해 문제 2의 문항 순서를 바꾸면 어떨까요? 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김우현 댓글 1 좋아요 1 조회수 320

서브쿼리

데이터 분석 SQL Fundamentals

서브쿼리만 따로 실행하면 상관 컬럼으로 참조한 컬럼은 메인쿼리에 있어서 서브쿼리 단독 실행이 안되는 바람에 문제점 파악하기도 힘들고 쿼리가 메인부터 실행되는게 아니라 서브부터 실행되기 때문에 가장 안쪽에 있는 서브쿼리부터 거꾸로 해석해야해서 직관적으로 의미를 알아내기도 어렵고... 정말 끔찍해요 안썼으면 좋겠어요... 최초 강의에 포함되지 않은 이유가 있는것같아요

  • sql
  • postgresql
  • dbms/rdbms
  • 서브쿼리
Geonu Park 댓글 1 좋아요 0 조회수 430

초기환경 설치에 관한 자료는 어디에 있나요

하트카운트와 함께 쉽게 시작하는 SQL

24년 9월 10일에 강의를 듣기 시작했습니다... 그런데 초기환경 설치 방법에 관한 자료를 못찾아서 글 남깁니다.. 어디에 있는지.. 알려 주시거나,,, 게시판에 올려 주시면 좋겠습니다.

  • sql
  • mysql
  • sql-query
M.S kang 댓글 1 좋아요 0 조회수 447

titanic.mean() 하면 오류가 나옵니다.

데이터 분석을 위한 판다스: 기초부터 데이터 분석까지

수업을 들으면 titanic에 mean()을 적용하면 결과가 나오는데, 저는 나오지 않더군요(에러 메시지가 나옴) 그래서 numeric_only=True를 주니까 문제가 해결이 되긴 하던데, 혹시 제가 뭔가 설정이 달라서 그런건지? 하여 문의 남깁니다.

  • pandas
seocoach 댓글 0 좋아요 0 조회수 204

혹시 쿼리를 빨리 읽는 방법이 있을까요?

데이터 분석 SQL Fundamentals

혹시 쿼리를 빨리 읽는 방법이 있을까요? 제가 실무에서 프로시저와 함수들을 주로 사용하고 있습니다. 그런데 제가 SQL 에 익숙하지 않아서 인것도 있지만 주석이 없는 프로시저와 함수들을 보고 의도를 파악하고 분석하는데 시간이 너무 오래 걸리고 있어요. 혹시 서브쿼리 join , union 등이 무분별하게 쓰여진 복잡한 쿼리에서 쿼리의 의도만을 빠르게 파악할 수 있는 방법이 있을까요? 제 나름대로 생각을 해서 SELECT 절은 일단 보지 않고 FROM 절을 먼저 보고 어떤 테이블에서 값을 가지고 오는지 판단한후 WHERE 절을 보고 마지막으로 SELECT 절을 보고 있어요 그런데 SELECT 절에서도 CASE WHEN 문이나 단일행 서브쿼리들이 있어서 실행을 시켜보아도 이게 무슨의미인지 파악하지 못할때가 많아요,, 방법이 있을까요?

  • sql
  • postgresql
  • dbms/rdbms
minhyuck WOO 댓글 1 좋아요 0 조회수 1022

[사이드프로젝트 협업 경험에 대한 설문조사] 부탁드립니다! 추첨 선물 있어요!!

안녕하세요! DND 11기 9조 119팀 🧑 🚒 입니다. 사이드프로젝트를 하려고 마음먹은 당신! 모집 글을 올리고 받은 수많은 지원서 중에 어떤 사람을 뽑아야 할지 고민 해보셨던 적이 있나요? 저희는 사이드프로젝트 멤버 구인 시 사용할 수 있는 "레퍼체크 서비스"를 준비하고 있어요. 함께 했던 팀원이 하는 평가를 통해 검증된 팀원을 모집할 수 있도록 도와주는 서비스입니다. 지원서를 받아본 경험이 없더라도 사이드프로젝트를 하시면서 팀원들과 있었던 협업 경험에 대해서 공유해주시면 보다 좋은 서비스를 만드는 데 많은 도움이 될 것 같아요! 👤 참여 대상: 사이드 프로젝트를 경험해보신 모든 IT 개발자 🧑 💻 , 디자이너 🎨 🎁 추첨 선물: 카카오페이 상품권 5천원권 (6명) ⌛ 예상 소요시간: 3분 ~ 5분 설문조사 내용은 조사 후 안전하게 폐기될 예정이며, 해당 설문 내용은 오로지 조사 목적으로만 사용됩니다. 많은 참여 부탁드립니다. 감사합니다. 😊 https://form.naver.com/response/fJ4paLi4TzETnQ-8R5d7Fw

  • 프로젝트
  • 사이드프로젝트
  • 팀원
  • 모집
sso 댓글 0 좋아요 0 조회수 432

사이드프로젝트 협업 경험에 대한 설문조사 (추첨 선물 있어요!)

안녕하세요! DND 11기 9조 119팀 🧑‍🚒 입니다. 사이드프로젝트를 하려고 마음먹은 당신! 모집 글을 올리고 받은 수많은 지원서 중에 어떤 사람을 뽑아야 할지 고민 해보셨던 적이 있나요? 저희는 사이드프로젝트 멤버 구인 시 사용할 수 있는 "레퍼체크 서비스"를 준비하고 있어요. 함께 했던 팀원이 하는 평가를 통해 검증된 팀원을 모집할 수 있도록 도와주는 서비스입니다. 지원서를 받아본 경험이 없더라도 사이드프로젝트를 하시면서 팀원들과 있었던 협업 경험에 대해서 공유해주시면 보다 좋은 서비스를 만드는 데 많은 도움이 될 것 같아요! 👤 참여 대상: 사이드 프로젝트를 경험해보신 모든 IT 개발자 🧑‍💻 , 디자이너 🎨 🎁 추첨 선물: 카카오페이 상품권 5천원권 (6명) ⌛ 예상 소요시간: 3분 ~ 5분 설문조사 내용은 조사 후 안전하게 폐기될 예정이며, 해당 설문 내용은 오로지 조사 목적으로만 사용됩니다. 많은 참여 부탁드립니다. 감사합니다. 😊 https://form.naver.com/response/fJ4paLi4TzETnQ-8R5d7Fw

  • 사이드프로젝트
  • 프로젝트
  • 협업
  • 설문조사
  • 팀원모집
sso 댓글 0 좋아요 0 조회수 454

[1유형]

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 1유형은 부분점수가 있다고 하는데 값을 출력하고 그 때마다 제출 버튼을 눌러야지 채점이 되는건가요? 1유형에도 문제가 3개 있으면 제출 버튼을 3번 누르면 되는 건가요? 2유형은 마지막에 파일 생성하면 끝이 나는 건가요? 3유형도 궁금합니다!!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
tlsdk0284 댓글 0 좋아요 0 조회수 297

맥북으로 공부

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강사님 올해 말 실기 시험 목표로 강의를 수강 중인 학생입니다. 강의 수강 중 문득 걱정이 되는게 있어서 문의 드립니다. 맥북 단축키 같은것도 알려주시고 당장 수강하는데는 별 문제없다고 생각하는데, 시험장에 맥북을 들고 갈 순 없는 노릇이니.. 혹시 맥북으로 공부해 갔을때 발생할 수 있는 문제와 그에 대처방법이 혹시 있을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
udinotti 댓글 1 좋아요 0 조회수 374

강의 연장

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강의 수강생인데요 ㅠ 이번 실기 치르는데 제가 작년부터 강의를 결제해서 듣고 있어서요 혹시 다음주까지 연장할 수 있는 기능이나 방법이 있을까요 ?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
안서은 댓글 1 좋아요 0 조회수 368

index 목차보다는 색인

핵심만 빠르게, 입문자를 위한 파이썬(Python)과 판다스(Pandas)

index 설명해주실 때 목차가 아니라 '색인'이라고 하는 것이 더 정확할 것 같습니다~ 보통 책의 목차는 정렬이나 검색 용도로 쓰자면 비효율적이라 오히려 더 헷갈릴 수 있을 것 같아요

  • python
  • pandas
nnc 댓글 0 좋아요 0 조회수 326

as 별칭을 한글로 하고 싶을 때

초보자를 위한 BigQuery(SQL) 입문

안녕하세요. 특정 컬럼명을 한글로 지정하여 노출하고 싶을 때에는 어떻게 해야 하나요? 별칭 지정할 때에는 따옴표 없이 사용하는거라 하셔서 아래처럼 시도해봤는데, 에러가 뜹니다. select id as 포켓몬아이디, kor_name, eng_name, type1 from basic.pokemon where type1 = 'Fire' 다른 부서원들에게 전달해야 할 때에는 컬럼명을 한글로 노출하여 전달해야 할 일이 많을 것 같아서요.컬럼명을 한글로 노출하려면 어떻게 해야 할까요? 혹시 몰라 ', " 도 함께 사용해봤는데 여전히 오류가 뜹니다. (에러문구는 다르게 뜨긴 하네요) ' 로 시도 " 로 시도

  • sql
  • bigquery
h8476952 댓글 1 좋아요 0 조회수 472

계속 진도를 빼는 게 맞을까요? 나을까요?

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 비전공자 직장인입니다. 퇴근후 딴짓 님 강의를 열심히 듣고 있습니다. 현재 작업형2 모의문제 2를 혼자서 풀고 있는데, 단순한 결측치 찾고, 샘플 찾고, 그런 것들은 하겠는데 이거를 모델링 하는 거에서부터 사실 멘붕입니다. 작업형1 모의문제를 풀 때도 똑같이 강의를 듣던것보다 더 어려워서 멘붕이 왔었습니다. 일단은 모르겠는 부분은 인지한 상태로 다시 반복하겠다는 의지로 계속 강의를 듣는 게 맞겠죠? 반복이 답이겠죠??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
뚜디니 댓글 3 좋아요 1 조회수 349

강의 듣고

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

강의를 한번 쭉 듣고나서는 이 강의 기출을 반복하면되나요??? 합격하신 분들은 이 강의만 반복적으로 돌려서 합격하셨다는건지 아님 얼른 듣고 추가적으로 더 무엇을 했다는것인지 무엇을 해야하는지 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
joy10780 댓글 1 좋아요 0 조회수 289

꼭 암기해야하는 코드나 파트...

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

선생님, 강의 열심히 보고 있는데 제가 5월 중순부터 시작하면서 조금 일찍 시작했는데도 불구하고 암기 할 게 너~~~~~~무 많아서 큰일입니다 ㅠㅠ 단권화 시키려고 실기용 교재를 샀는데 정말 정말 이것만큼은 꼭! 외우고 가야하는 코드나 문법같은거를 정리해주실 수 있나요? (강의나...파일로) 사실 고득점 합격은 바라지도 않고 60점 턱걸이로라도 너무 붙고싶습니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
moonwrd 댓글 2 좋아요 0 조회수 410

이번 실기일까지 강의를 듣고 싶어요.

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

삭제된 글입니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
찰스 댓글 1 좋아요 0 조회수 286

선배 개발자님들! 개발한 웹 사이트에 대한 냉정한 피드백을 부탁드립니다.

안녕하세요 선배님들! 개발자 스터디에서 활동하고 있는 초보 백엔드 개발자입니다. 이번에 스터디에서 백엔드와 프론트 개발자들이 모여 '밸런스 게임 커뮤니티' 라는 주제로 서비스를 기획하고 배포하였습니다. 기획자, 디자이너 없이 백엔드와 프론트끼리만 진행한 프로젝트이며, 실제 서비스와 유저를 모으는 것 까지 목표를 하고 있습니다 (창업 단계는 아닙니다.) 프로젝트에 대한 많은 경험이 없는지라, 웹 사이트에 대한 선배 개발자분들의 고견이 필요합니다. 뭔가 부족한 것 같긴 한데, 정확히 어떤 부분이 부족하고 개선이 필요한지를 파악하고 싶습 니다. 밸런스톡 : https://balancetalk.kro.kr 설문 링크 : https://moaform.com/q/6O24At 깃헙 : https://github.com/CHZZK-Study/Balance-Talk-Backend 관련한 모든 부분은 비영리임을 밝힙니다. 냉정한 피드백 부탁드리겠습니다. 감사합니다!

  • 스터디
  • 프로젝트
  • 웹사이트
  • 서비스
  • 기획
gywns0417 댓글 1 좋아요 0 조회수 563

BigQuery 입문 강의 수강 후 dataset 선정 및 진행 방향성

초보자를 위한 BigQuery(SQL) 입문

안녕하세요. 초보자를 위한 BigQuery(SQL) 입문 잘 들었습니다. 생각보다 재미가 있어서 계속 해보려 하는데 무엇을 해야할지 잘 몰라서 고민입니다. 강의 후반부에 "앞으로 배우면 좋을 내용" 에 있는 순서대로 해보려 했습니다. 공식 문서와 블로그 글을 통해 ARRAY, STRUCT의 기본 공부를 했습니다. 다음으로 넘어가 복잡한 데이터 가공하기 부분을 하고 있습니다. 우선 bigquery의 공개 데이터를 사용해 보자는 생각을 했고 Google Trends datasets과 COVID-19 Public Datasets을 살펴봤습니다. 세부사항과 데이터를 보며 어떤 것을 의미하는지까지는 알 수 있었습니다. 다만 이후부터 어떻게 해야할지 감이 안 왔습니다. 강의를 수강할 때는 예제 문제들이 있으니 배운 것을 적용할 수 있었는데, 처음 보는 데이터고 어떤 목적을 갖고 분석을 해야할지 모르겠습니다. bigquery 프로젝트 예제를 찾아봤지만 마땅한게 없었습니다. 혹시 이 강의를 수강하고 연습해 보기 좋은 dataset과 어떤 방식으로 프로젝트를 진행해야 할지 알고 싶습니다.

  • sql
  • bigquery
  • 데이터-리터러시
타크로 댓글 1 좋아요 0 조회수 552

토이플젝이나 사이드 플젝에 참여해보고싶은 디자이너 취준생 궁금한점

안녕하세요 토이플젝이나 사이드 플젝에 참여해보고 싶은 UIUX디자이너 취준생 인데요! 비전공자라 발목 잡을거 같아서 선뜻 참여를 못하겠더라구요 ㅠ 어느정도 레벨로 개발자분들과 소통이 가능해야 참여할 수 있을까요?

  • 프로젝트
  • uiux
  • 디자이너
호야HOYA 댓글 0 좋아요 0 조회수 454

인기 태그

인프런 TOP Writers

주간 인기글