랜덤포레스트 결과가 다르게 나와요
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
랜덤포레스트 결과가 다르게 나와 요
- python
- 머신러닝
- 빅데이터
- pandas
- 빅데이터분석기사
173만명의 커뮤니티!! 함께 토론해봐요.
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
랜덤포레스트 결과가 다르게 나와 요
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
사후 검정 투키, 본페로니 식 외워야 하나요? 시험에서 사후검정도 해야하나요?
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
정처기 실기 준비한다고 빅분기 실기 준비가 늦었는데요.... 인강 결제하고 공부한지 3일차인데, 작업형1 모의문제를 푸는데 멘탈이 탈탈 털려버렸어요 ㅜㅜ... 나름 열심히한다고 온갖 함수부터 달달 외우고는 있는데 응용이 전혀 되질 않아서 모의문제를 혼자 힘으로 1도 못풀었어요.. 계속 gpt로 코드 해석보면서 보고있는데, 이대로 계속 진도를 나가는게 맞는지 모르겠네요... 계속 지웠다 썼다 반복하고는 있는데, 단순히 답을 외우게 되는 것 같아서 나중에 응용이 될까 모르겠네요.. 이해가 안 가더라도 계속 진도를 나가고 회독을 하는게 맞는 건가요 ?
서버개발자 과제전형 완벽가이드 - 1편
안녕하세요, 강사님. 강의 잘 듣고 있습니다. 강사님의 목소리가 어디선가 들었던 것 같아 더 반가웠습니다. 저는 SW 학부를 졸업했지만, 공부를 할수록 점점 어려워지고 흥미가 떨어져 결국 포기하려 했습니다. 그러던 중 교수님 추천으로 지금의 회사에 입사하게 되어 IT 부서에서 비개발 업무를 맡아 일하고 있습니다. 그동안 회사를 다니면서 개발자가 되기로 결심하게 되었고, 그런 면에서 제게 좋은 기회였다고 생각합니다. 그래서 본격적으로 개발 공부를 시작했습니다만, 직장을 다니며 평일, 주말에 공부하는 게 쉽지는 않더군요. 백엔드 공부를 처음 시작할 때는 Java와 Spring MVC부터 시작했습니다. 그런데 점차 공부하다 보니 배워야 할 기술들이 가지처럼 뻗어나가더군요. 그만큼 기술 하나하나를 따라가며 공부하다 보니 어느덧 1년이 넘었습니다. 그래도 꾸준히 이어올 수 있었던 이유는 저 나름의 목표가 있었고, 새로운 것을 배우는 재미도 있었기 때문인 것 같습니다. 아마 취업 후에도 평생 공부가 필요하겠지만, 그래서 지금 미리 습관을 들이는 게 오히려 좋은 일이라 생각합니다. 여기까지는 그냥 TMI네요. 😊 결론적으로 저는 완벽주의적인 성향 때문에 여러 기술을 충분히 알아야 한다는 생각이 강박으로 작용해 시간 소요가 커지고 있습니다. 이번 강의를 들으면서 새로운 기술을 익히는 것도 좋지만, 어디서 멈춰야 할지 타이밍을 놓칠 것 같아 고민입니다. 현재 진행 중인 프로젝트를 바탕으로 도메인 모델링을 잘 활용해 포트폴리오로 정리하고 싶습니다. 신입 백엔드 포트폴리오는 어느 정도 수준이 적합한지, 기준에 대한 조언을 듣고 싶습니다. 단순히 이직이 아니라 개발을 제 업으로 삼는 것이 목표입니다. 현재 직장에서의 연봉은 약 4천만 원 정도지만, 연봉보다도 개발자가 되는 것이 저에겐 더 큰 행복일 것 같습니다. 내향적인 성격이라 이런 글을 적는 것도 처음이지만, 강의에서 많은 영감을 받아 제 고민을 나누게 되었습니다. 감사합니다.
파이썬으로 시작하는 머신러닝+딥러닝(sklearn을 이용한 머신러닝부터 TensorFlow, Keras를 이용한 딥러닝 개발까지)
삭제된 글입니다
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
https://dataq.goorm.io/exam/116674/체험하기/quiz/4 여기서 하는 성별예측 문제에서 import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") # print(train.shape, test.shape) # print( train.info ()) # print(train.isnull().sum()) # print(test.isnull().sum()) #결측치 처리 (환불금액) train['환불금액'] = train['환불금액'].fillna(0) test['환불금액'] = test['환불금액'].fillna(0) # print(test.isnull().sum()) # print(train['성별'].value_counts()) #인코딩 target = train.pop('성별') train = pd.get_dummies(train) test = pd.get_dummies(test) #검증 데이터 분리 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=0) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit (X_tr, y_tr) pred = rf.predict_proba(X_val) # print(pred) from sklearn.metrics import roc_auc_score roc = roc_auc_score(y_val, pred[:,1]) #예측 및 파일생성 pred = rf.predict_proba(test) submit = pd.DataFrame({ "pred":pred[:,1] }) submit.to _csv("result.csv", index=False) # print( pd.read _csv("result.csv")) 이렇게 코딩을 했는데 예측 및 파일 생성에서 pred = rf.predict_proba(test) 여기 부분이 오류가 뜨는데 왜 그런가요 ㅠㅠ > Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 43, in <module> pred = rf.predict_proba(test) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 674, in predict_proba X = self._validate_X_predict(X) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 422, in validate X_predict return self.estimators_[0]._validate_X_predict(X, check_input=True) File "/usr/local/lib/python3.9/dist-packages/sklearn/tree/_classes.py", line 407, in validate X_predict X = self._validate_data(X, dtype=DTYPE, accept_sparse="csr", File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 437, in validate data self._check_n_features(X, reset=reset) File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 365, in check n_features raise ValueError( ValueError: X has 73 features, but DecisionTreeClassifier is expecting 74 features as input. 이렇게 뜹니다,,
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요. 좋은 강의 감사드립니다. 덕분에 잘 배우고 있습니다. 문제 2. 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 그리고 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요! 문제2를 대하고 순간 다음과 같은 고민을 했었습니다. 1번을 수행하여 'f1'컬럼의 결측치 행을 삭제한 후 2번을 하려니 'f3'컬럼의 결측치 갯수가 18개만 남더군요. 그럼 18개는 최초 데이터 100개의 20% 미만일까? 그렇지 않다. 'f1'컬럼 결측치를 제거한 후 데이터 갯수 69개의 20%~30%(14~20)에 해당한다. 그렇다면 'f3'컬럼의 최빈 값은 'f1'컬럼의 결측치를 제거하기 전의 값을 사용해야할까 아니면 결측치 제거 후의 값을 사용해야 할까? 결과적으로는 어떤 방식으로 하던 답은 56으로 일치했지만 주어진 데이터에 따라 다른 값이 나올 수도 있을 것 같습니다. 혼돈을 없애기 위해 문제 2의 문항 순서를 바꾸면 어떨까요? 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요!
데이터 분석 SQL Fundamentals
서브쿼리만 따로 실행하면 상관 컬럼으로 참조한 컬럼은 메인쿼리에 있어서 서브쿼리 단독 실행이 안되는 바람에 문제점 파악하기도 힘들고 쿼리가 메인부터 실행되는게 아니라 서브부터 실행되기 때문에 가장 안쪽에 있는 서브쿼리부터 거꾸로 해석해야해서 직관적으로 의미를 알아내기도 어렵고... 정말 끔찍해요 안썼으면 좋겠어요... 최초 강의에 포함되지 않은 이유가 있는것같아요
하트카운트와 함께 쉽게 시작하는 SQL
24년 9월 10일에 강의를 듣기 시작했습니다... 그런데 초기환경 설치 방법에 관한 자료를 못찾아서 글 남깁니다.. 어디에 있는지.. 알려 주시거나,,, 게시판에 올려 주시면 좋겠습니다.
데이터 분석 SQL Fundamentals
혹시 쿼리를 빨리 읽는 방법이 있을까요? 제가 실무에서 프로시저와 함수들을 주로 사용하고 있습니다. 그런데 제가 SQL 에 익숙하지 않아서 인것도 있지만 주석이 없는 프로시저와 함수들을 보고 의도를 파악하고 분석하는데 시간이 너무 오래 걸리고 있어요. 혹시 서브쿼리 join , union 등이 무분별하게 쓰여진 복잡한 쿼리에서 쿼리의 의도만을 빠르게 파악할 수 있는 방법이 있을까요? 제 나름대로 생각을 해서 SELECT 절은 일단 보지 않고 FROM 절을 먼저 보고 어떤 테이블에서 값을 가지고 오는지 판단한후 WHERE 절을 보고 마지막으로 SELECT 절을 보고 있어요 그런데 SELECT 절에서도 CASE WHEN 문이나 단일행 서브쿼리들이 있어서 실행을 시켜보아도 이게 무슨의미인지 파악하지 못할때가 많아요,, 방법이 있을까요?
스프링 핵심 원리 - 기본편
4줄 요약 저는 프로그래밍 초보자로, 회사에서 스프링과 Vuejs를 공부하라는 지시를 받았습니다. 하지만 자바의 기본 지식이 부족해 강의를 따라가기 어렵습니다. 현재 학업, 스프링, Vuejs, 빅데이터 대회준비를 동시에 진행하고 있어 시간도 부족합니다. 자바로 돌아가서 기초를 쌓아야 할지, 스프링 진도를 계속 나가야 할지 고민입니다. 주서. 저는 눈 가리고 귀 막은 상태로 강의를 듣고 싶지 않습니다, 저는 오래 산업에 종사하신 분들의 현실적인 조언이 필요합니다. 안녕하십니까. 곧 인턴으로 투입되기 위해 강의를 듣고 있는 얼리어잡터입니다. 제 배경은 이렇습니다. 객체지향프로그래밍 경험은 이 스프링 강의 속 코드를 보며 따라친 게 처음입니다. 회사에선 자바의 기본적인 문법만 공부하고 바로 스프링으로 들어가라고 하였습니다. 저는 학교에서(대학교가 아님) 수업들은 C와 Python의 경험을 토대로 자바의 겉 부분을 공부하고 스프링으로 넘어오게 되었습니다. 헌데 제가 자바의 겉 부분을 제가 잘 못 핥았는지 지금까지 들은 강의 내용을 전부 이해한다는 생각이 전혀 안들어 인턴인데 첫 회사 업무를 잘 수행 할 수 있을지가 의심이 들었습니다. 지금 제일 조언이 필요한 부분은 학업, 스프링, Vuejs, 빅데이터 대회 전부를 동시에 진행하고 있는데요 현재 자바도 잘 모르는데 final 이든 데이터 구조든 처음 보는 골뱅이 @Test 이런 것이 자바에서 어떻게 동작하는지 잘 몰라도 시간이 2개월 정도 밖에 남지 않았으니 그냥 스프링 진도를 나가는 것이 맞는지 아니면 스프링은 일단 접어두고 제대로 기초 공사 자바부터 차근차근 철근을 하나씩 박으면서 역량을 쌓기 위해 자바로 돌아가야 할지, 현업에 오래 종사하신 분들의 조언이 필요합니다
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요. 1유형은 부분점수가 있다고 하는데 값을 출력하고 그 때마다 제출 버튼을 눌러야지 채점이 되는건가요? 1유형에도 문제가 3개 있으면 제출 버튼을 3번 누르면 되는 건가요? 2유형은 마지막에 파일 생성하면 끝이 나는 건가요? 3유형도 궁금합니다!!
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요 강사님 올해 말 실기 시험 목표로 강의를 수강 중인 학생입니다. 강의 수강 중 문득 걱정이 되는게 있어서 문의 드립니다. 맥북 단축키 같은것도 알려주시고 당장 수강하는데는 별 문제없다고 생각하는데, 시험장에 맥북을 들고 갈 순 없는 노릇이니.. 혹시 맥북으로 공부해 갔을때 발생할 수 있는 문제와 그에 대처방법이 혹시 있을까요?
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요 강의 수강생인데요 ㅠ 이번 실기 치르는데 제가 작년부터 강의를 결제해서 듣고 있어서요 혹시 다음주까지 연장할 수 있는 기능이나 방법이 있을까요 ?
초보자를 위한 BigQuery(SQL) 입문
안녕하세요. 특정 컬럼명을 한글로 지정하여 노출하고 싶을 때에는 어떻게 해야 하나요? 별칭 지정할 때에는 따옴표 없이 사용하는거라 하셔서 아래처럼 시도해봤는데, 에러가 뜹니다. select id as 포켓몬아이디, kor_name, eng_name, type1 from basic.pokemon where type1 = 'Fire' 다른 부서원들에게 전달해야 할 때에는 컬럼명을 한글로 노출하여 전달해야 할 일이 많을 것 같아서요.컬럼명을 한글로 노출하려면 어떻게 해야 할까요? 혹시 몰라 ', " 도 함께 사용해봤는데 여전히 오류가 뜹니다. (에러문구는 다르게 뜨긴 하네요) ' 로 시도 " 로 시도
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요 비전공자 직장인입니다. 퇴근후 딴짓 님 강의를 열심히 듣고 있습니다. 현재 작업형2 모의문제 2를 혼자서 풀고 있는데, 단순한 결측치 찾고, 샘플 찾고, 그런 것들은 하겠는데 이거를 모델링 하는 거에서부터 사실 멘붕입니다. 작업형1 모의문제를 풀 때도 똑같이 강의를 듣던것보다 더 어려워서 멘붕이 왔었습니다. 일단은 모르겠는 부분은 인지한 상태로 다시 반복하겠다는 의지로 계속 강의를 듣는 게 맞겠죠? 반복이 답이겠죠??
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
강의를 한번 쭉 듣고나서는 이 강의 기출을 반복하면되나요??? 합격하신 분들은 이 강의만 반복적으로 돌려서 합격하셨다는건지 아님 얼른 듣고 추가적으로 더 무엇을 했다는것인지 무엇을 해야하는지 궁금합니다.
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
선생님, 강의 열심히 보고 있는데 제가 5월 중순부터 시작하면서 조금 일찍 시작했는데도 불구하고 암기 할 게 너~~~~~~무 많아서 큰일입니다 ㅠㅠ 단권화 시키려고 실기용 교재를 샀는데 정말 정말 이것만큼은 꼭! 외우고 가야하는 코드나 문법같은거를 정리해주실 수 있나요? (강의나...파일로) 사실 고득점 합격은 바라지도 않고 60점 턱걸이로라도 너무 붙고싶습니다!
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
삭제된 글입니다
[파이토치] 실전 인공지능으로 이어지는 딥러닝 - 기초부터 논문 구현까지
안녕하세요!! 공부한 기록을 남기고싶은데, Github에 강의중에 실행한 코드들이나 압축파일에 있는 코드파일들 올려도 되나요..?