inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

이야기를 나눠요

173만명의 커뮤니티!! 함께 토론해봐요.

공부방법 질의드립니다.

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

정처기 실기 준비한다고 빅분기 실기 준비가 늦었는데요.... 인강 결제하고 공부한지 3일차인데, 작업형1 모의문제를 푸는데 멘탈이 탈탈 털려버렸어요 ㅜㅜ... 나름 열심히한다고 온갖 함수부터 달달 외우고는 있는데 응용이 전혀 되질 않아서 모의문제를 혼자 힘으로 1도 못풀었어요.. 계속 gpt로 코드 해석보면서 보고있는데, 이대로 계속 진도를 나가는게 맞는지 모르겠네요... 계속 지웠다 썼다 반복하고는 있는데, 단순히 답을 외우게 되는 것 같아서 나중에 응용이 될까 모르겠네요.. 이해가 안 가더라도 계속 진도를 나가고 회독을 하는게 맞는 건가요 ?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
rokkk 댓글 1 좋아요 1 조회수 276

작업형2 성별예측 문제

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

https://dataq.goorm.io/exam/116674/체험하기/quiz/4 여기서 하는 성별예측 문제에서 import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") # print(train.shape, test.shape) # print( train.info ()) # print(train.isnull().sum()) # print(test.isnull().sum()) #결측치 처리 (환불금액) train['환불금액'] = train['환불금액'].fillna(0) test['환불금액'] = test['환불금액'].fillna(0) # print(test.isnull().sum()) # print(train['성별'].value_counts()) #인코딩 target = train.pop('성별') train = pd.get_dummies(train) test = pd.get_dummies(test) #검증 데이터 분리 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=0) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit (X_tr, y_tr) pred = rf.predict_proba(X_val) # print(pred) from sklearn.metrics import roc_auc_score roc = roc_auc_score(y_val, pred[:,1]) #예측 및 파일생성 pred = rf.predict_proba(test) submit = pd.DataFrame({ "pred":pred[:,1] }) submit.to _csv("result.csv", index=False) # print( pd.read _csv("result.csv")) 이렇게 코딩을 했는데 예측 및 파일 생성에서 pred = rf.predict_proba(test) 여기 부분이 오류가 뜨는데 왜 그런가요 ㅠㅠ > Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 43, in <module> pred = rf.predict_proba(test) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 674, in predict_proba X = self._validate_X_predict(X) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 422, in validate X_predict return self.estimators_[0]._validate_X_predict(X, check_input=True) File "/usr/local/lib/python3.9/dist-packages/sklearn/tree/_classes.py", line 407, in validate X_predict X = self._validate_data(X, dtype=DTYPE, accept_sparse="csr", File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 437, in validate data self._check_n_features(X, reset=reset) File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 365, in check n_features raise ValueError( ValueError: X has 73 features, but DecisionTreeClassifier is expecting 74 features as input. 이렇게 뜹니다,,

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
wnguswls2818 댓글 1 좋아요 0 조회수 250

문제2

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 좋은 강의 감사드립니다. 덕분에 잘 배우고 있습니다. 문제 2. 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 그리고 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요! 문제2를 대하고 순간 다음과 같은 고민을 했었습니다. 1번을 수행하여 'f1'컬럼의 결측치 행을 삭제한 후 2번을 하려니 'f3'컬럼의 결측치 갯수가 18개만 남더군요. 그럼 18개는 최초 데이터 100개의 20% 미만일까? 그렇지 않다. 'f1'컬럼 결측치를 제거한 후 데이터 갯수 69개의 20%~30%(14~20)에 해당한다. 그렇다면 'f3'컬럼의 최빈 값은 'f1'컬럼의 결측치를 제거하기 전의 값을 사용해야할까 아니면 결측치 제거 후의 값을 사용해야 할까? 결과적으로는 어떤 방식으로 하던 답은 56으로 일치했지만 주어진 데이터에 따라 다른 값이 나올 수도 있을 것 같습니다. 혼돈을 없애기 위해 문제 2의 문항 순서를 바꾸면 어떨까요? 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김우현 댓글 1 좋아요 1 조회수 320

titanic.mean() 하면 오류가 나옵니다.

데이터 분석을 위한 판다스: 기초부터 데이터 분석까지

수업을 들으면 titanic에 mean()을 적용하면 결과가 나오는데, 저는 나오지 않더군요(에러 메시지가 나옴) 그래서 numeric_only=True를 주니까 문제가 해결이 되긴 하던데, 혹시 제가 뭔가 설정이 달라서 그런건지? 하여 문의 남깁니다.

  • pandas
seocoach 댓글 0 좋아요 0 조회수 204

[1유형]

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 1유형은 부분점수가 있다고 하는데 값을 출력하고 그 때마다 제출 버튼을 눌러야지 채점이 되는건가요? 1유형에도 문제가 3개 있으면 제출 버튼을 3번 누르면 되는 건가요? 2유형은 마지막에 파일 생성하면 끝이 나는 건가요? 3유형도 궁금합니다!!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
tlsdk0284 댓글 0 좋아요 0 조회수 297

맥북으로 공부

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강사님 올해 말 실기 시험 목표로 강의를 수강 중인 학생입니다. 강의 수강 중 문득 걱정이 되는게 있어서 문의 드립니다. 맥북 단축키 같은것도 알려주시고 당장 수강하는데는 별 문제없다고 생각하는데, 시험장에 맥북을 들고 갈 순 없는 노릇이니.. 혹시 맥북으로 공부해 갔을때 발생할 수 있는 문제와 그에 대처방법이 혹시 있을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
udinotti 댓글 1 좋아요 0 조회수 374

강의 연장

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 강의 수강생인데요 ㅠ 이번 실기 치르는데 제가 작년부터 강의를 결제해서 듣고 있어서요 혹시 다음주까지 연장할 수 있는 기능이나 방법이 있을까요 ?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
안서은 댓글 1 좋아요 0 조회수 368

index 목차보다는 색인

핵심만 빠르게, 입문자를 위한 파이썬(Python)과 판다스(Pandas)

index 설명해주실 때 목차가 아니라 '색인'이라고 하는 것이 더 정확할 것 같습니다~ 보통 책의 목차는 정렬이나 검색 용도로 쓰자면 비효율적이라 오히려 더 헷갈릴 수 있을 것 같아요

  • python
  • pandas
nnc 댓글 0 좋아요 0 조회수 325

계속 진도를 빼는 게 맞을까요? 나을까요?

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 비전공자 직장인입니다. 퇴근후 딴짓 님 강의를 열심히 듣고 있습니다. 현재 작업형2 모의문제 2를 혼자서 풀고 있는데, 단순한 결측치 찾고, 샘플 찾고, 그런 것들은 하겠는데 이거를 모델링 하는 거에서부터 사실 멘붕입니다. 작업형1 모의문제를 풀 때도 똑같이 강의를 듣던것보다 더 어려워서 멘붕이 왔었습니다. 일단은 모르겠는 부분은 인지한 상태로 다시 반복하겠다는 의지로 계속 강의를 듣는 게 맞겠죠? 반복이 답이겠죠??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
뚜디니 댓글 3 좋아요 1 조회수 349

강의 듣고

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

강의를 한번 쭉 듣고나서는 이 강의 기출을 반복하면되나요??? 합격하신 분들은 이 강의만 반복적으로 돌려서 합격하셨다는건지 아님 얼른 듣고 추가적으로 더 무엇을 했다는것인지 무엇을 해야하는지 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
joy10780 댓글 1 좋아요 0 조회수 288

꼭 암기해야하는 코드나 파트...

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

선생님, 강의 열심히 보고 있는데 제가 5월 중순부터 시작하면서 조금 일찍 시작했는데도 불구하고 암기 할 게 너~~~~~~무 많아서 큰일입니다 ㅠㅠ 단권화 시키려고 실기용 교재를 샀는데 정말 정말 이것만큼은 꼭! 외우고 가야하는 코드나 문법같은거를 정리해주실 수 있나요? (강의나...파일로) 사실 고득점 합격은 바라지도 않고 60점 턱걸이로라도 너무 붙고싶습니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
moonwrd 댓글 2 좋아요 0 조회수 410

이번 실기일까지 강의를 듣고 싶어요.

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

삭제된 글입니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
찰스 댓글 1 좋아요 0 조회수 286

안녕하세요! 이력서 스터디를 기획하고 있습니다! 강사님처럼 이력서 대해서 스스로 고민하고 답을 내릴 수 있는 개발자가 되려면 스터디를 어떻게 진행하는게 좋을지 궁금합니다...ㅠ 스터디 기획 내용 피드백 한 번 받을 수 있을까요?

실제 이력서 사례로 알아보는 [합격하는 이력서] 작성 가이드

현재 기획된 내용은 아래 페이지에 설명 되어 있습니다! https://circular-error-a3d.notion.site/4e4b5aff884c478c99d2733bdfe73f42?pvs=4 제가 해드릴 수 있는게 많이 없지만.... 강의 열심히 홍보 하겠습니다...! 계신 방향으로 절도 한 번 올리겠습니다...!

  • 면접
  • 이력서
최기환 댓글 1 좋아요 1 조회수 626

비전공 백엔드 개발자

실제 이력서 사례로 알아보는 [합격하는 이력서] 작성 가이드

안녕하세요. 비전공 백엔드 개발자를 준비중인 취준생입니다. IT 학원에서 기본적인 언어와 JSP, Spring, 프로젝트까지 수료는 했으나 포트폴리오를 만들지못해 현재 온라인강의 사이트에서 간단한 CRUD 게시판을 만들어 놓은 상태입니다. 이력서와 자소서 포트폴리오를 만들어서 지원했으나 서류에서 계속 떨어지더라구요~ 그래서 인프런에서 멘토링을 받아보니 제가 생각했던 이력서와 자소서가 아니더라구요~ 그래서 추천을 받아 워니님 이력서 강의를 수강하게되었는데요~ 너무 간단한 CRUD라서 이력서를 써도 괜찮을지 잘모르겠습니다. 프로젝트를 좀 더 한 후에 이력서를 쓰는게 좋을지 아니면 간단하지만 만들어 놓은 CRUD 게시판을 활용해 이력서를 써서 지원해보는게 좋을지 고민이 됩니다.

  • 면접
  • 이력서
haprudal 댓글 1 좋아요 2 조회수 538

지거국 지역할당제를 서울 공기업에 가능할지요?

[취업폭격기] 공공기관 전산직 취업 치트키 : NCS·전공·PT면접까지 한 번에 뚫는 정규과정

안녕하세요? 개인적 궁금함이 있어서요. 지거국 출신이 지거국의 지역할당제 이용하는거는 해당 대학교의 지역에만 해당이지만, 지거국출신이란거로 서울권 공기업 들어가기는 이득이 있는지 궁금해서 질문 남깁니다

  • 면접
  • 이력서
  • 기술면접
rewq171717 댓글 1 좋아요 0 조회수 1268

프레임워크

CS 지식의 정석 | 디자인패턴 네트워크 운영체제 데이터베이스 자료구조

https://github.com/egoing/django-tutorial-src 현재 컴퓨터 공학과로 편입하고 군복무중입니다. 복무중 토이프로젝트(to do list) 하나정도는 만들고 cs의 기본은 떼고 가자해서 파이썬을 배우고 장고를 배우고 있었습니다. 그리고 디자인 패턴을 공부하고 가장 쉽게 가르친다는 생활코딩의 장고 강의를 보면서 하려고 하는데 위 링크의 myapp의 views.py 에서 읽고 쓰고 수정하고 삭제하는 crud를 구현하는 코드를 잘 이해하지 못하겠어서 고민입니다. 분명 장고가 어떻게 구동되는 방식도 아는데 조금 무슨 개념을 몰라서 이해를 못하는지 답답합니다. 제가 그 부분의 코드를 이해하려면 어떤 공부를 먼저 해야할까요..?

  • 면접
  • 운영체제
  • 기술면접
최진욱 댓글 1 좋아요 0 조회수 502

고민있어요 ㅠㅠ

CS 지식의 정석 | 디자인패턴 네트워크 운영체제 데이터베이스 자료구조

안녕하세요! 큰돌님! 먼저 좋은 강의를 만들어주셔서 감사합니다. 덕분에 많은 걸 배우고 있어요! 저는 2월 달에 졸업을 앞두고 있고, 데이터 파이프라인을 설계하고 ETL을 개발하는 데이터 엔지니어가 꿈인 28살입니다.. 학교를 늦게 들어가서 시간이 많이 지체되었는데요. 취업을 위해서 어떤 방향으로 나아가야 할지 고민이 되어 이렇게 글을 작성하게 되었습니다. 현재 알고리즘은 백준 실버 1이고, 꾸준히 공부하고 있습니다. 프로젝트는 너무 간단한 걸 제외하면 혼자 AWS 서버리스 기반 프로젝트를 한 것이 전부입니다. 그리고 이 과정에서 AWS 아키텍트 어소시에이트 자격증까지 취득했습니다. 이러한 상황에서 프로그래머스 데이터 엔지니어링 데브옵스나 SW 마에스트로를 준비하고 있는데요. 솔직히 말해서 꼭 붙을거라는 보장도 없고 주변 사람들에 비해 나이도 적지 않은 거 같아서 취업에 대한 조바심이 납니다.. 본론을 말씀드리자면, 앞으로 국비교육을 준비하는게 최선일까요? 아니면 이런 스펙을 가지고 있더라도 더 독학하여 취업을 우선시 하는게 최선일까요? 혼자 고민을 많이 해봤는데 도저히 결론이 나질 않아 질문드립니다 ㅠㅠ 바쁘실텐데 답변해주시면 감사하겠습니다!

  • 면접
  • 운영체제
  • 기술면접
kyg8821 댓글 1 좋아요 0 조회수 637

제로미니님 안녕하세요 :)

[취업폭격기] 공공기관 전산직 취업 치트키 : NCS·전공·PT면접까지 한 번에 뚫는 정규과정

삭제된 글입니다

  • 면접
  • 이력서
  • 기술면접
전우중 댓글 1 좋아요 0 조회수 393

빠르게 코딩하기 위한 단축기 문의 (팁)

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

삭제된 글입니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
hello4298 댓글 1 좋아요 0 조회수 444

부트캠프 고민

빠른 취업을 위한 백엔드 로드맵

다음과 같은 양식으로 남겨주세요. 질문을 한 배경 : 부트캠프 선택 고민입니다. 위코드와 제로베이스 백엔드 스쿨 둘 중에서 고민중 입니다. 질문 내용 : 안녕하세요 저는 현제 4학년 2학기 컴공 학생입니다. 원래는 대학원 준비하다가 어쩌다 보니 나오게 돼서 웹쪽 준비가 미흡한 상태입니다. 그렇다 보니 부트 캠프를 통해 빠르게 공부해 취준하려 합니다. 여러 부트캠프를 찾아봤고 위에 언급한 둘 중에서 고민 중입니다. 간략하게 두 부트캠프에 대해 설명하면 위코드: 3개월 과정, 오프라인, Node.js, 기업 협업 프로젝트 제로베이스: 6개월 과정, 온라인, Spring, 코테, cs 준비, 우수 수강생 일시 협업 프로젝트 고민되는 이유는 위 코드는 3개월이란 짧은 기간 동안 여러 프로젝트를 빠르게 해볼 수 있는 게 장점인 거 같은데 Spring이 아닌 Node.js를 사용하고 따로 CS나 코테는 없는 것 같고 제로베이스는 Spring 사용한다는 점과 코테나 CS에 대해 자세히 해준다는 게 장점이고 기간이 6개월로 다소 길고 우수 수강생 아닐 시 협업 프로젝트 참여를 못해 애매할 수 있다 생각이 듭니다. 짧게나마 조언 해주시면 감사하겠습니다! 긴 글 읽어주셔서 감사합니다!!

  • 포트폴리오
  • 면접
  • 온라인-교육
세량 댓글 1 좋아요 0 조회수 1098

인기 태그

인프런 TOP Writers

주간 인기글