inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

이야기를 나눠요

173만명의 커뮤니티!! 함께 토론해봐요.

작업형2 성별예측 문제

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

https://dataq.goorm.io/exam/116674/체험하기/quiz/4 여기서 하는 성별예측 문제에서 import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") # print(train.shape, test.shape) # print( train.info ()) # print(train.isnull().sum()) # print(test.isnull().sum()) #결측치 처리 (환불금액) train['환불금액'] = train['환불금액'].fillna(0) test['환불금액'] = test['환불금액'].fillna(0) # print(test.isnull().sum()) # print(train['성별'].value_counts()) #인코딩 target = train.pop('성별') train = pd.get_dummies(train) test = pd.get_dummies(test) #검증 데이터 분리 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=0) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit (X_tr, y_tr) pred = rf.predict_proba(X_val) # print(pred) from sklearn.metrics import roc_auc_score roc = roc_auc_score(y_val, pred[:,1]) #예측 및 파일생성 pred = rf.predict_proba(test) submit = pd.DataFrame({ "pred":pred[:,1] }) submit.to _csv("result.csv", index=False) # print( pd.read _csv("result.csv")) 이렇게 코딩을 했는데 예측 및 파일 생성에서 pred = rf.predict_proba(test) 여기 부분이 오류가 뜨는데 왜 그런가요 ㅠㅠ > Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 43, in <module> pred = rf.predict_proba(test) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 674, in predict_proba X = self._validate_X_predict(X) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 422, in validate X_predict return self.estimators_[0]._validate_X_predict(X, check_input=True) File "/usr/local/lib/python3.9/dist-packages/sklearn/tree/_classes.py", line 407, in validate X_predict X = self._validate_data(X, dtype=DTYPE, accept_sparse="csr", File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 437, in validate data self._check_n_features(X, reset=reset) File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 365, in check n_features raise ValueError( ValueError: X has 73 features, but DecisionTreeClassifier is expecting 74 features as input. 이렇게 뜹니다,,

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
wnguswls2818 댓글 1 좋아요 0 조회수 250

질문이 아니라서 여기에 올립니다.

한 입 크기로 잘라 먹는 리액트(React.js) : 기초부터 실전까지

안녕하세요 노션 링크에 있는 github 주소가 404가 뜨네요~ https://github.com/winterlood/onebite-react-v2/tree/main/section10/chapter3 https://github.com/winterlood/onebite-react-v2/tree/main/section10/chapter2 최적화 부분 링크만 체크해보았는데도 이러네요~ 수고하세요~

  • javascript
  • react
  • node.js
jisan6565 댓글 1 좋아요 0 조회수 380

현업에서 백엔드로는 보통 뭐를 사용하나요?

처음 만난 리액트(React)

현재 미니 블로그로 프론트엔드를 완성해서 express로 백엔드 api를 만들어서 간단하게 글쓰기/댓글쓰기까지는 만들었습니다. 그러다보니 웹에 관심이 생기기 시작했는데 (원래는 Unity 개발만 파고 있었음.) 현업에서는 보통 무슨 프레임워크를 쓰는지 궁금해졌습니다. 그냥 express를 계속 사용해도 괜찮을까요?

  • javascript
  • react
dlghtmd1224 댓글 1 좋아요 1 조회수 394

문제2

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 좋은 강의 감사드립니다. 덕분에 잘 배우고 있습니다. 문제 2. 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 그리고 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요! 문제2를 대하고 순간 다음과 같은 고민을 했었습니다. 1번을 수행하여 'f1'컬럼의 결측치 행을 삭제한 후 2번을 하려니 'f3'컬럼의 결측치 갯수가 18개만 남더군요. 그럼 18개는 최초 데이터 100개의 20% 미만일까? 그렇지 않다. 'f1'컬럼 결측치를 제거한 후 데이터 갯수 69개의 20%~30%(14~20)에 해당한다. 그렇다면 'f3'컬럼의 최빈 값은 'f1'컬럼의 결측치를 제거하기 전의 값을 사용해야할까 아니면 결측치 제거 후의 값을 사용해야 할까? 결과적으로는 어떤 방식으로 하던 답은 56으로 일치했지만 주어진 데이터에 따라 다른 값이 나올 수도 있을 것 같습니다. 혼돈을 없애기 위해 문제 2의 문항 순서를 바꾸면 어떨까요? 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김우현 댓글 1 좋아요 1 조회수 320

요즘 현직에서 프론트 개발할때...

처음 만난 리액트(React)

리액트나 뷰 앵귤러로 개발을 많이 하나요?(추세) 아니면 바닐라 자바스크립트로 개발하나요??

  • HTML/CSS
  • javascript
  • react
sy4562 댓글 1 좋아요 0 조회수 441

Frontend도 공부하고 싶은데, NEXT JS 와 Flutter 중 무엇이 나을까요

[코드팩토리] [초급] NestJS REST API 백엔드 완전 정복 마스터 클래스 - NestJS Core

제목 그대로 입니다. 백엔드 공부하면서 프론트엔드도 구현해보고 싶은데 코드팩토리님 플러터 강의가 있더라구요. 그리고 여기저기 찾아보니 NEXTJS 도 많이 쓰는거 같기도 하구요. 코드팩토리님 강의 보면서 차근차근 배워나가는 재미가 있어서 플러터쪽을 고민하고 있긴한대, 장단점이 궁금합니다

  • javascript
  • typescript
  • rest-api
  • nestjs
  • backend
슈퍼아스라다 댓글 1 좋아요 0 조회수 1068

대대형

Azure Native로 나만의 GPT 만들기

잘보겠습니다

  • javascript
  • python
  • mongodb
  • azure
  • FastAPI
안현우 댓글 1 좋아요 1 조회수 388

방학동안 학습에 대한 질문입니다!!!

한 입 크기로 잘라 먹는 리액트(React.js) : 기초부터 실전까지

선생님,좋은 강의 제공해주셔서 감사의 말씀드리고 싶습니다!!! 다름이 아니라 몇가지 질문사항이 있어서 글을 남깁니다. 저는 현재 군필이며 it를 얕게 배우는 학과에 2학년으로 재학중이고 진로는 정해지지 않은상태이며 알고리즘(파이썬),리액트를 공부중에 있습니다. 자신이 배운 내용을 가르친다는 느낌으로 블로그를 쓰면 좋다고 하셨는데 어떤 플랫폼(티스토리 등) 을 쓰면 좋을지 궁금합니다 한국 백엔드 취업시장은 자바(스프링)이 독보적이라고 알고 있습니다. 취업시장에서는 프론트와 백을 나누어 뽑으며 이를 고려하여 자바를 할줄 몰라도 백엔드를 자바로 입문하는게 좋다고 생각하였는데 일각에서 자바는 어려우니 자바스크립트 기반의 node.js로 입문하라는 이야기를 들었습니다. 장고, nodejs,nextjs,sprng 등 무엇으로 입문하면 좋을지 선생님의 개인적인 의견이 궁금합니다!!! 또한 방학동안 프로젝트 외에 공부하면 좋을 cs지식(시스템프로그래밍,운영체제 등)은 무엇인지 궁금합니다!! 긴글 끝까지 읽어주셔서 감사합니다!!!

  • javascript
  • react
  • node.js
peter 댓글 1 좋아요 0 조회수 424

수강기간 연장

15일간의 빅데이터 파일럿 프로젝트

안녕하세요 강사님, 유익하고 좋은 강의를 만들어주셔서 감사드립니다. 수강하지 못한 부분들이 많이 있는데 수강기간 연장을 요청 드리고 싶습니다ㅜㅜ

  • 빅데이터
  • hadoop
  • kafka
  • zookeeper
  • redis
  • flume
  • impala
  • 데이터-엔지니어링
김도균 댓글 2 좋아요 0 조회수 430

[1유형]

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 1유형은 부분점수가 있다고 하는데 값을 출력하고 그 때마다 제출 버튼을 눌러야지 채점이 되는건가요? 1유형에도 문제가 3개 있으면 제출 버튼을 3번 누르면 되는 건가요? 2유형은 마지막에 파일 생성하면 끝이 나는 건가요? 3유형도 궁금합니다!!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
tlsdk0284 댓글 0 좋아요 0 조회수 297

맥북으로 공부

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강사님 올해 말 실기 시험 목표로 강의를 수강 중인 학생입니다. 강의 수강 중 문득 걱정이 되는게 있어서 문의 드립니다. 맥북 단축키 같은것도 알려주시고 당장 수강하는데는 별 문제없다고 생각하는데, 시험장에 맥북을 들고 갈 순 없는 노릇이니.. 혹시 맥북으로 공부해 갔을때 발생할 수 있는 문제와 그에 대처방법이 혹시 있을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
udinotti 댓글 1 좋아요 0 조회수 374

강의 연장

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강의 수강생인데요 ㅠ 이번 실기 치르는데 제가 작년부터 강의를 결제해서 듣고 있어서요 혹시 다음주까지 연장할 수 있는 기능이나 방법이 있을까요 ?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
안서은 댓글 1 좋아요 0 조회수 368

강좌소개 수업 자료 링크

비전공자의 전공자 따라잡기 - 자료구조(with JavaScript)

https://github.com/zerocho/cs-datastructure https://github.com/vadimg/js_bintrees#readme 강의 볼때마다 강좌소개로 들어가기 번거로워서 여기에 올려두고 싶습니다!

  • javascript
  • 코딩-테스트
  • 알고리즘
rhkdtjd_12 댓글 1 좋아요 0 조회수 296

BERTopic 분석 방법

빅데이터/텍스트마이닝 분석법 (LDA,BERTtopic,감성분석,CONCOR with ChatGPT)

안녕하세요 선생님 제가 LDA분석방법으로 연구를 진행중인데 이 LDA분석 방법의 단점을 개선한 방법으로 딥러닝 방식인 BERTopic 분석 방법이 최근 등장해서 연구논문에 조금씩 등장하는걸 확인했습니다. 그래서 이 분석 방법에 흥미가 생겨 어떻게 할 수 있는지 인터넷, 책 등을 아무리 찾아봐도 직접적으로 연구에 어떻게 적용해서 하는 건지, 딥러닝 방식이라 학습시키는 데이터(말뭉치)는 또 어떻게 준비하는 건지.. 도통 모르겠고 도움을 받을 수 있는 길이 없는거 같아서 답답한 마음에 한번 여쭤봅니다. 혹시 연구논문에 적용가능한 BERTopic 분석 방법에 대한 강의를 올려주실 계획은 없으실지 궁금합니다!

  • 빅데이터
  • 텍스트마이닝
우아한 북극곰 댓글 1 좋아요 0 조회수 512

계속 진도를 빼는 게 맞을까요? 나을까요?

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 비전공자 직장인입니다. 퇴근후 딴짓 님 강의를 열심히 듣고 있습니다. 현재 작업형2 모의문제 2를 혼자서 풀고 있는데, 단순한 결측치 찾고, 샘플 찾고, 그런 것들은 하겠는데 이거를 모델링 하는 거에서부터 사실 멘붕입니다. 작업형1 모의문제를 풀 때도 똑같이 강의를 듣던것보다 더 어려워서 멘붕이 왔었습니다. 일단은 모르겠는 부분은 인지한 상태로 다시 반복하겠다는 의지로 계속 강의를 듣는 게 맞겠죠? 반복이 답이겠죠??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
뚜디니 댓글 3 좋아요 1 조회수 349

강의 듣고

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

강의를 한번 쭉 듣고나서는 이 강의 기출을 반복하면되나요??? 합격하신 분들은 이 강의만 반복적으로 돌려서 합격하셨다는건지 아님 얼른 듣고 추가적으로 더 무엇을 했다는것인지 무엇을 해야하는지 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
joy10780 댓글 1 좋아요 0 조회수 288

꼭 암기해야하는 코드나 파트...

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

선생님, 강의 열심히 보고 있는데 제가 5월 중순부터 시작하면서 조금 일찍 시작했는데도 불구하고 암기 할 게 너~~~~~~무 많아서 큰일입니다 ㅠㅠ 단권화 시키려고 실기용 교재를 샀는데 정말 정말 이것만큼은 꼭! 외우고 가야하는 코드나 문법같은거를 정리해주실 수 있나요? (강의나...파일로) 사실 고득점 합격은 바라지도 않고 60점 턱걸이로라도 너무 붙고싶습니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
moonwrd 댓글 2 좋아요 0 조회수 410

키노트 관련 질문

자바스크립트 비기너: 튼튼한 기본 만들기

선생님 자바스크립트 전체강좌 결제햇는데요.. 비기너에서는 키노트 설명을 다운받을수있는데 나머지 3개강좌에서는 키노트 설명 다운이 없는 것 같아서요.. 키노트 설명을 다운받을수는 없을가요??

  • javascript
  • 객체지향
ymckh1005 댓글 1 좋아요 0 조회수 272

인기 태그

인프런 TOP Writers

주간 인기글