inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

이야기를 나눠요

173만명의 커뮤니티!! 함께 토론해봐요.

작업형2 성별예측 문제

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

https://dataq.goorm.io/exam/116674/체험하기/quiz/4 여기서 하는 성별예측 문제에서 import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") # print(train.shape, test.shape) # print( train.info ()) # print(train.isnull().sum()) # print(test.isnull().sum()) #결측치 처리 (환불금액) train['환불금액'] = train['환불금액'].fillna(0) test['환불금액'] = test['환불금액'].fillna(0) # print(test.isnull().sum()) # print(train['성별'].value_counts()) #인코딩 target = train.pop('성별') train = pd.get_dummies(train) test = pd.get_dummies(test) #검증 데이터 분리 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=0) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit (X_tr, y_tr) pred = rf.predict_proba(X_val) # print(pred) from sklearn.metrics import roc_auc_score roc = roc_auc_score(y_val, pred[:,1]) #예측 및 파일생성 pred = rf.predict_proba(test) submit = pd.DataFrame({ "pred":pred[:,1] }) submit.to _csv("result.csv", index=False) # print( pd.read _csv("result.csv")) 이렇게 코딩을 했는데 예측 및 파일 생성에서 pred = rf.predict_proba(test) 여기 부분이 오류가 뜨는데 왜 그런가요 ㅠㅠ > Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 43, in <module> pred = rf.predict_proba(test) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 674, in predict_proba X = self._validate_X_predict(X) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 422, in validate X_predict return self.estimators_[0]._validate_X_predict(X, check_input=True) File "/usr/local/lib/python3.9/dist-packages/sklearn/tree/_classes.py", line 407, in validate X_predict X = self._validate_data(X, dtype=DTYPE, accept_sparse="csr", File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 437, in validate data self._check_n_features(X, reset=reset) File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 365, in check n_features raise ValueError( ValueError: X has 73 features, but DecisionTreeClassifier is expecting 74 features as input. 이렇게 뜹니다,,

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
wnguswls2818 댓글 1 좋아요 0 조회수 250

문제2

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 좋은 강의 감사드립니다. 덕분에 잘 배우고 있습니다. 문제 2. 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 그리고 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요! 문제2를 대하고 순간 다음과 같은 고민을 했었습니다. 1번을 수행하여 'f1'컬럼의 결측치 행을 삭제한 후 2번을 하려니 'f3'컬럼의 결측치 갯수가 18개만 남더군요. 그럼 18개는 최초 데이터 100개의 20% 미만일까? 그렇지 않다. 'f1'컬럼 결측치를 제거한 후 데이터 갯수 69개의 20%~30%(14~20)에 해당한다. 그렇다면 'f3'컬럼의 최빈 값은 'f1'컬럼의 결측치를 제거하기 전의 값을 사용해야할까 아니면 결측치 제거 후의 값을 사용해야 할까? 결과적으로는 어떤 방식으로 하던 답은 56으로 일치했지만 주어진 데이터에 따라 다른 값이 나올 수도 있을 것 같습니다. 혼돈을 없애기 위해 문제 2의 문항 순서를 바꾸면 어떨까요? 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김우현 댓글 1 좋아요 1 조회수 320

titanic.mean() 하면 오류가 나옵니다.

데이터 분석을 위한 판다스: 기초부터 데이터 분석까지

수업을 들으면 titanic에 mean()을 적용하면 결과가 나오는데, 저는 나오지 않더군요(에러 메시지가 나옴) 그래서 numeric_only=True를 주니까 문제가 해결이 되긴 하던데, 혹시 제가 뭔가 설정이 달라서 그런건지? 하여 문의 남깁니다.

  • pandas
seocoach 댓글 0 좋아요 0 조회수 204

웹디자인기능사 자격증 취득 후.

웹디자인개발기능사 실기전체 (카톡질문가능)

강사님. 그동안 잘 지내셨는지요? 여름도 벌써 중순이며, 장마기간이네요^^;; 다름이 아니라 웹디자인기능사 공부를 시작으로 개발을 시작하였는데요. 취업을 희망하는데 웹퍼블리셔나 프론트엔드개발자로 희망합니다. 강사님께서 제시하는 취업 로드맵 이 있는지 여쭙고자 글 남깁니다:) ps) 강의가 더 있으시다면,,,,ㅎㅎㅎㅎㅎㅎㅎㅎㅎ 강의 업로드 해주신다면.........ㅎㅎㅎ 감사하겠습니다!

  • HTML/CSS
  • jquery
  • 취업
sy4562 댓글 0 좋아요 0 조회수 485

[1유형]

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 1유형은 부분점수가 있다고 하는데 값을 출력하고 그 때마다 제출 버튼을 눌러야지 채점이 되는건가요? 1유형에도 문제가 3개 있으면 제출 버튼을 3번 누르면 되는 건가요? 2유형은 마지막에 파일 생성하면 끝이 나는 건가요? 3유형도 궁금합니다!!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
tlsdk0284 댓글 0 좋아요 0 조회수 297

맥북으로 공부

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강사님 올해 말 실기 시험 목표로 강의를 수강 중인 학생입니다. 강의 수강 중 문득 걱정이 되는게 있어서 문의 드립니다. 맥북 단축키 같은것도 알려주시고 당장 수강하는데는 별 문제없다고 생각하는데, 시험장에 맥북을 들고 갈 순 없는 노릇이니.. 혹시 맥북으로 공부해 갔을때 발생할 수 있는 문제와 그에 대처방법이 혹시 있을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
udinotti 댓글 1 좋아요 0 조회수 374

강의 연장

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강의 수강생인데요 ㅠ 이번 실기 치르는데 제가 작년부터 강의를 결제해서 듣고 있어서요 혹시 다음주까지 연장할 수 있는 기능이나 방법이 있을까요 ?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
안서은 댓글 1 좋아요 0 조회수 368

index 목차보다는 색인

핵심만 빠르게, 입문자를 위한 파이썬(Python)과 판다스(Pandas)

index 설명해주실 때 목차가 아니라 '색인'이라고 하는 것이 더 정확할 것 같습니다~ 보통 책의 목차는 정렬이나 검색 용도로 쓰자면 비효율적이라 오히려 더 헷갈릴 수 있을 것 같아요

  • python
  • pandas
nnc 댓글 0 좋아요 0 조회수 326

계속 진도를 빼는 게 맞을까요? 나을까요?

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 비전공자 직장인입니다. 퇴근후 딴짓 님 강의를 열심히 듣고 있습니다. 현재 작업형2 모의문제 2를 혼자서 풀고 있는데, 단순한 결측치 찾고, 샘플 찾고, 그런 것들은 하겠는데 이거를 모델링 하는 거에서부터 사실 멘붕입니다. 작업형1 모의문제를 풀 때도 똑같이 강의를 듣던것보다 더 어려워서 멘붕이 왔었습니다. 일단은 모르겠는 부분은 인지한 상태로 다시 반복하겠다는 의지로 계속 강의를 듣는 게 맞겠죠? 반복이 답이겠죠??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
뚜디니 댓글 3 좋아요 1 조회수 349

강의 듣고

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

강의를 한번 쭉 듣고나서는 이 강의 기출을 반복하면되나요??? 합격하신 분들은 이 강의만 반복적으로 돌려서 합격하셨다는건지 아님 얼른 듣고 추가적으로 더 무엇을 했다는것인지 무엇을 해야하는지 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
joy10780 댓글 1 좋아요 0 조회수 289

꼭 암기해야하는 코드나 파트...

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

선생님, 강의 열심히 보고 있는데 제가 5월 중순부터 시작하면서 조금 일찍 시작했는데도 불구하고 암기 할 게 너~~~~~~무 많아서 큰일입니다 ㅠㅠ 단권화 시키려고 실기용 교재를 샀는데 정말 정말 이것만큼은 꼭! 외우고 가야하는 코드나 문법같은거를 정리해주실 수 있나요? (강의나...파일로) 사실 고득점 합격은 바라지도 않고 60점 턱걸이로라도 너무 붙고싶습니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
moonwrd 댓글 2 좋아요 0 조회수 410

이번 실기일까지 강의를 듣고 싶어요.

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

삭제된 글입니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
찰스 댓글 1 좋아요 0 조회수 286

실습 코드들 개인 깃허브에 업로드 가능한가요??

[파이토치] 실전 인공지능으로 이어지는 딥러닝 - 기초부터 논문 구현까지

안녕하세요!! 공부한 기록을 남기고싶은데, Github에 강의중에 실행한 코드들이나 압축파일에 있는 코드파일들 올려도 되나요..?

  • python
  • 머신러닝
  • 딥러닝
  • 인공신경망
  • pytorch
miyang 댓글 1 좋아요 0 조회수 433

취준 관련해서 고민이 있습니다.

10주완성 C++ 코딩테스트 | 알고리즘 코딩테스트

안녕하세요. 큰돌님 이번에 컴공을 졸업한 수강생이고, 자바 백엔드 쪽을 희망하고 있습니다. 2-3개 프로젝트를 했지만, 결과물과 기여도 측면에서 포폴에 올린 정도는 아닌 것 같고, 코딩테스트와 CS 지식이 전부 자신이 없는 상태입니다. 큰돌님의 유튜브를 봤을 때, 코테, CS, 프로젝트, 오픈소스 이 4가지가 중요하다는 것을 보고 코테는 스터디를 하고, CS는 큰돌님의 책을 구매해서 볼려고 합니다. 여기서 제 질문은 프로젝트를 보완하고 실력을 키우기 위해 큰돌님이 추천해주신 부트캠프를 듣고 싶지만, 요즘 경쟁률도 높고 제가 합격할 실력은 아닌것 같아 이런 프로그램에 참여해 개발 일경험이라도 해보는게 나을지, 아니면 추천해주신 부트캠프를 듣기 위해 이번 상반기에는 코테나 CS 공부에 집중하는게 나을지 궁금합니다. 포폴에 프로젝트는 몇개 정도 있어야 할까요? 이번 하반기에 진행하는 부트캠프에 떨어진다고 하면, 눈을 낮춰 갈 수 있는 회사에 가는 것도 괜찮을까요? 취준 기간이 길어질까봐 걱정돼서요. 이상입니다. 읽어주셔서 감사합니다.

  • 코딩-테스트
  • 취업
almost 댓글 1 좋아요 0 조회수 879

[내일배움캠프] 취업 전략도 얻고❗ 주니어 개발자 취업 분석 리포트도 받고❗

"백엔드 개발자가 되고 싶은데..!" 백엔드 개발자 취업을 위해 독학과 부트캠프 중에 고민이신가요? 내 인생을 바꾸는 취업, 확실한 취업 전략 으로 대비하셔야죠! 🔥 취업에 대한 궁금증과 고민, 실시간으로 물어보며 나에게 맞는 취업 전략을 세워보세요! 🔥 📢 설명회 정보 : [ 확실한 백엔드 개발자 취업 설명회 ] 1부 - 현실적인 개발자 취업 이야기 2부 - 사전 질문 답변 및 실시간 Q&A ✅ 일시 : 2024.03.11(월) ‼ 바로 오늘 오후 07:00 ~ 08:00 ‼ ✅ 장소 : Zoom (온라인 실시간 화상) ✅ 신청 방법 : https://bit.ly/4cnlSir (30초면 ok 👌🏻 ) 링크 클릭 → 필수 정보 입력 → 궁금했던 점 모두 적어요! → 제출! 🔥 🎁 참여 혜택 (선착순 50명) 1) 주니어 개발자 취업 분석 리포트 2) 내일배움캠프 백엔드 코스 가산점 💬 문의 창구 - 채팅상담: https://spartacodingclub.channel.io/support-bots/41731 - 메일: contact@teamsparta.co 👉🏻 실시간 QnA를 통해 궁금증 해소하러 가기 👈🏻

  • 백엔드
  • 취업
  • 설명회
  • 전략
  • 개발자
예원 댓글 0 좋아요 0 조회수 597

공부법 고민입니다

[개정판] 파이썬 머신러닝 완벽 가이드

안녕하세요 교수님. 강의 정말 잘 듣고있습니다. 현재 파머완 강의 8장 중간까지 들은 학생입니다. 저는 원래 교수님의 컴퓨터비전 로드맵을 따라갈 생각이었으나, 아직 머신러닝에 대한 기초가 부족하다고 느껴서(어느정도는 알았지만 개념적으로 부족했습니다) 이 강의와 책을 본 후 로드맵을 본격적으로 따라가려고 했습니다. 처음 강의인 CNN 강의에서 선수지식이 '기본적인 머신러닝에 대한 개념 이해' 정도로 작성되어있는데 꼭 나머지 8,9장까지 마무리하고 넘어가야할까요? 아 그리고 로드맵 강의를 수강하면서 앱(?)같은 것도 만들어볼 기회가 있을까요? 감사합니다!

  • python
  • 머신러닝
  • 통계
jcy4023 댓글 1 좋아요 1 조회수 431

개발 직군 취업준비생 대상 챌린지 서비스 설문조사 부탁드립니다!

안녕하세요! 저희는 TECH!T 스쿨 수료생들이 모여있는 멋쟁이빌더 1기 ‘세니티' 입니다. 현재 7명의 팀원이 개발 직군 취업준비생을 대상으로 챌린지 운영 서비스 프로젝트를 진행하고 있습니다. 👀 대상: 개발 직군 취업준비생 ✅ 질문 수: 약 15~20개 ⏰ 예상 소요 시간: 5분 이하 📆 설문조사 기간: 2024년 02월 22일(목)~02월 23일(금)까지 ☕ 추가 인터뷰 상품: 커피 기프티콘 >> https://forms.gle/FZbsktdq6tSrZCTZ8 이 설문조사는 챌린지 활동에 참여하거나 관심이 있는 분들의 의견을 수집하여 보다 나은 챌린지 서비스 환경을 조성하기 위한 목적으로 진행됩니다. 여러분의 소중한 의견이 저희에게 큰 도움이 됩니다. 설문조사는 멋쟁이빌더 1기 팀 프로젝트의 일환으로, 설문 결과는 인사이트 도출을 위해 사용되며 그 외의 용도로는 사용되지 않습니다. 모든 응답은 익명으로 처리되며, 개인 정보는 보호됩니다. 참여해 주시는 모든 분들께 진심으로 감사드립니다.

  • 프로젝트
  • 설문조사
  • 취업
  • 챌린지
  • 인터뷰
유진 댓글 0 좋아요 0 조회수 482

티스토리 작성 가능 여부 질문

[개정판] 딥러닝 컴퓨터 비전 완벽 가이드

안녕하세요! 교수님 강의를 듣고 있는 수강생입니다 ! 강의를 복습할 때 개인 블로그에 수업 내용을 정리하면서 게시를 하고 싶은데요 ! 강의 내용에 포함되어있는 이미지를 사용해서 간단하게 요약해서 게시를 하고 싶은데 저작권법에 걸리는 지 여쭤보고 싶어서 글을 작성합니다 ! 개인 블로그에 강의 자료(이미지 등)을 사용해서 복습 용도로 게시를 해도 될까요 ??

  • python
  • 머신러닝
  • 딥러닝
  • keras
  • tensorflow
  • 컴퓨터-비전
ansqudrms01 댓글 0 좋아요 0 조회수 649

빠르게 코딩하기 위한 단축기 문의 (팁)

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

삭제된 글입니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
hello4298 댓글 1 좋아요 0 조회수 444

서로 차원이 다른 ndarray의 accuracy_score 함수 응용

[개정판] 파이썬 머신러닝 완벽 가이드

분류(Classification) 성능 평가지표 개요와 정확도(Accuracy) 소개 에서 MNIST를 모두 0으로 예측하는 코드에서 fakepred와 y_test를 비교하는데요 이때 type은 같은데 하나는 1차원 배열이고 또 다른 하나는 column을 1로 가진 2차원 배열인데 이렇게 shape이 달라도 accuracy_score를 통해 비교할 수 있나요?

  • python
  • 머신러닝
  • 통계
이주엽 댓글 1 좋아요 0 조회수 478

인기 태그

인프런 TOP Writers

주간 인기글