선생님 안녕하세요 ㅎㅎㅎ 선생님 덕분에 마음 한시름 놓고 시험결과 발표일만 열심히 기다리고 있는데요! 빅데이터분석가 직무쪽으로 전향하고 싶은 마음도 많이 들게 되었는데 어떻게 준비해서 가면 좋을지 조언받고 싶어서 이렇게 글을 쓰게 되었습니다! 인터넷에 나와있는 빅데이터 관련 강의들 종류도 양도 상당하다보니 어떤 종류로 어떻게 공부해서 준비해야 비전공인 저도 이쪽 직무에 취업할 수 있을지 궁금합니다..! (선생님 빅분기 시험 외에도 데이터분석 관련 프로젝트나 툴 사용 등의 영상도 올려주시면 안될까요?! ㅎㅎㅎ)
function calculate(x) { var result = 3*x+5; return result; } 라고 입력후 var result1 = calculate(1); 이 어떻게 동작 하는 건가요 ? 괄호를 닫았음에도 아직 저 위에 함수 블록에서 작업 중인 걸로 되는 건가요?
안녕하세요 선생님 덕분에 7기 시험 잘 마무리 했습니다 감사합니다 다름이 아니라 이번 시험에서 lgbm을 사용했는데 끝나고 다른 사람들 말 들어보니 lgbm은 결과에 음수값을 생성한다 하더라고요 제가 처음 랜덤포레스트 돌렸ㅇㄹ때 rmse값이 100만 정도 됐고 lgbm으로 돌리니 83만정도 돼서 lgbm으로 제출했는데 40점 만점은 아니더라도 점수를 아예 못 받지는 않겠죠?
시험 잘 치뤘습니다. 그냥 문득 궁금한 점이 있어서 질문글을 올립니다. 스케일러를 적용할 때 train데이터 대상으로 fit_transform을 한 뒤, test 데이터를 대상으로는 transform을 하는 것으로 알고 있습니다. 그런데 문득 든 생각은, 저희가 작업할 때 train_test_split이라는 함수를 쓰는데 여기에서 x_tr, x_val, y_tr, y_val로도 나눕니다. 그래서 스케일러를 x_tr대상으로 만들고(즉 x_tr을 대상으로 fit_transform) x_val과 test셋에서는 transform을 해줘야하는게 아닌가라는 생각이 들어서 질문드립니다
안녕하세요 이번 7회 작업형 2번관련하여 문의를 아래와 같이 드립니다 < 문의내용 > 1. 회귀 / 분류 중에 어떤 문제 였는지 ? lightgbm regression 으로 문제를 풀이 하였는데, "데이터전문가포럼' 네이버 카페에서 조회하니 랜덤포레스트 classifier 로 문제를 풀이 하는 분들이 있어서 제가 완전히 틀린 것인가 싶어서 문의드립니다 2. regression으로 문제를 풀이하고, pred를 작성하였는데 예측하는 값이 amount(금액) 값이 '- 값이 발생' 해도 문제가 없는지 ? 상식선에서는 예측하는 값이 amount의 경우는 무조건 양의 값이 나와야 하는데, '음수 값이 발생해서 의문' <예상구성코드> *amount 값을 예상하는 내용 *train / test 2개 파일만 제공하였음 train Set에서 POP amount 값에 대해서 target으로 변경하여 pop 처리 lebel Encoding Model_Selection > train_test_split Lightgbm-regression max_depth / N_estimater / Learning Rate 만 조절 Sklearn > metrics > MSE MSE ** 0.5 로 RMSE 구성
작업형1-1 표준화 문제 : 1.083 작업형1-2 상관관계 : 4.809 작업형1-3 이상치 갯수 구하기 : 224 작업형2 회귀 : RMSE 값이 대략 473만....(RandomForestRegressor로 했는데 너무 커서 긴가민가하여 xgboost나 lightgbm 써도 8~900만대라 그냥 제출) 작업형3-1-1 오즈비 : 0.754 작업형3-1-2 잔차이탈도 : 3.008 (이건 모르겠어서 로지스틱회귀 result에서 Intercept의 z값 적음) 작업형3-1-3 error rate : 기억이 나지 않음.... 작업형3-2-1 결정계수 : 0.901 작업형3-2-2 회귀계수 : 0.985 직업형3-2-3 가장 높은 p-value : 0.052 이렇게 제출했는데 60점 이상은 나오겠죠....ㅎㅎ 이번 시험 합격해서 졸업했으면 좋겠네요ㅎㅎ 선생님 덕분에 그래도 생각보다 많이 풀게되서 기분이 좋았습니다. 감사합니다~
이 강의를 알게 되어서 이번 시험을 준비하는데 있어 정말정말 큰 도움이 되었습니다!!! 정말 감사드립니다!!! 시험을 보고 나온 시점에서 궁금한 점이 있는데요, get_dummies를 사용할 때 drop_first=True를 train,test에 모두 적용해도 되는지 궁금합니다! 또 걱정이 되는 부분은 작업형 2유형에서 모델 성능이 너무 작게 나왔다는 점입니다. RMSE값은 기억이 나지 않지만 r2값이 0.6언저리로 낮게 나왔습니다... 성능이 낮다는 이유로 0점이 나온 경우가 있는지 궁금합니다ㅠㅠㅠ
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 이번 빅데이터분석기사 7회 응시생입니다! 다름아닌 RMSE 값이 900만대가 나왔는데 오답처리될까요? 다른분들은 440만이라 불안해서 질문드립니다..
선생님! 안녕하세요 ㅎㅎ 선생님 덕에 작업형 3-1 소문제 두개빼고는 다 제대로 풀 수 있었어요 넘 감사합니다 💜 두개는 그냥.. 느낌대로 우선 제출은 하고왔습니다 🤣 🤣 작업형3 아예 모르는부분으로만 나올까봐 진짜 너무너무 걱정했는데.. 너무너무 감사합니다ㅠㅠ 곧 후기 제대로 남기겠습니다!!!! 근데 제가 여쭙고싶은게 있는데요! 1.작업형2 제출파일 pred가 모두 소수점 밑으로 끝에 e가 붙는데 그래도 괜찮은것 맞을까요? 2.강한 상관관계 = 양과 음의 상관관계 모두 생각해서 절댓값으로 확인해 변수를 찾았는데 강한 양or음의 상관관계가 아니고선 이렇게 해도 되는것 맞을까요?!
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 제출형태에 index와 y_pred를 넣으라고 되어있었는데, 이런 상황에서 실제 시험이면 index를 넣지않고 y_pred만 넣는다면 0점 처리가 되는건가요?
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요. 보통 작업형2 유형의 경우 예시된 pred 값이 소수점인 경우(보통 회귀모델) 소수점이 2번째 자리까지 표현되는데 제가 만든 csv파일을 read해보면 소수점 6자리까지도 pred값에 표현되고 있는데 상관없는건가요? rmse 값을 y_test로 불러왔을땐 예시로 만들어주신 값과 내가 코드를 작성하여 만든값이 별로 차이는 없습니다.
랜덤포레스트로 단순하게 테스트사이즈를 0.2로 하고 진행했더니 행의 개수가 달라지더라고요! 그래서 계속 오류가 발생했는데 테스트 사이즈를 조절하다 0.25로 하니 61개로 딱 맞아서 답이 출력되네요! 왜 그런지 혹시 이유가 있을까요? 사진과 같이 roc로하면 확률이 나오는데 단순하게 pred로 하면 확률이 아닌 0 과1로 출력이 됩니다. 원래 이렇게 나오는건지 궁금하고 문제에서는 roc로 csv를 구하라는건지 궁금합니다. 감사합니다!