안녕하세요 제가 이번 실기 시험을 응시하려고 했는데 시험 응시 기간을 놓쳐서 다음 시험을 봐야하는 상황입니다... 시험을 볼 수 없는 상황이라 이번 시험 때는 강의를 수강할 일이 없을 것 같고 제가 현재 9월까지 수강이 가능합니다. 그래서 다음 시험까지 수강 기간을 멈췄다가 10월부터 다시 수강 시작을 할 수 있을까요? 제 이메일은 ggm06401@naver.com입니다 부탁드립니다 선생님...
안녕하세요 이번 10회차 시험을 준비하고 있는 수강생입니다. 이제 작업형 1(섹션 4)까지 학습 끝내고 머신러닝에 들어가려고 합니다. 섹션 5 머신러닝 강의를 업데이트하고 계시던데, 혹시 언제까지 업데이트가 완료될까요? 시험이 한달 남아 학습은 빨리 하고 싶은데 강의 업데이트가 다되기까지 시간이 1주일 넘게 걸린다면 기다리기가 어려울 것 같아서요. 어떻게 할지 조언을 구하고 싶습니다. 머신러닝 신버전이 업데이트 다 되는 걸 기다렸다가 순차적으로 듣는다. 머신러닝 구버전으로 듣고 학습 진행한다. 작업형 3부터 학습하면서 머신러닝 업데이트를 기다리다가, 작업형 2 업데이트 다 되고 돌아온다. 그 이후에 기출 진행한다. 섹션 5 28. 머신러닝 학습 및 평가(분류) 듣고나서 섹션 6 구버전의 이어지는 강의를 듣는다. 이 경우 34.모델링 및 평가(회귀)로 이어서 들으면 될까요? 참고로 지금은 머신러닝 신버전 듣고 있습니다. 감사합니다.
안녕하세요 다른 커뮤니티에 글을 잘못 올려 다시 업로드합니다,, 작년에 결제하고 취업 준비를 하느라 실기 시험 준비를 거의 하지 못했습니다. 얼마전 취업을 해서 빅데이터분석기사 실기에 다시 공부를 시작했습니다. 강의 수강 기간이 5월 8일까지인 상황인데 혹시나 강의를 연장할 수 있을지 문의드립니다. 제 메일은 wogh9599@naver.com 입니다. 감사합니다.
다음과 같은 양식으로 남겨주세요. 질문을 한 배경 : 알려주신 내용을 활용해보려고 생각중에 서버리스를 사용해서 비용최적화를 하려고했습니다. 그런데 대쉬보드 url로 접속하면 무한로딩이 발생하고 진입이 안됩니다. 아주 관련 있는 내용은 아니지만 여쭤볼곳이 없어서 1주일째 고생하다가 여기 여쭙습니다. 질문내용 : 위에 내용처럼 오픈서치 서버리스 사용해보려고 하는데 진입자체가 안되서 실례 무릅쓰고 여쭙습니다. aws 문의 게시판에도 같은증상이 생기는 사람만 있고 해결한 사람은 없네요 ㅠㅠ IAM 으로 모든 권한 줘서 해도 동일한 증상만 발생합니다. 혹시 해결책이 있을까요? 항상 감사합니다~
정처기 실기 준비한다고 빅분기 실기 준비가 늦었는데요.... 인강 결제하고 공부한지 3일차인데, 작업형1 모의문제를 푸는데 멘탈이 탈탈 털려버렸어요 ㅜㅜ... 나름 열심히한다고 온갖 함수부터 달달 외우고는 있는데 응용이 전혀 되질 않아서 모의문제를 혼자 힘으로 1도 못풀었어요.. 계속 gpt로 코드 해석보면서 보고있는데, 이대로 계속 진도를 나가는게 맞는지 모르겠네요... 계속 지웠다 썼다 반복하고는 있는데, 단순히 답을 외우게 되는 것 같아서 나중에 응용이 될까 모르겠네요.. 이해가 안 가더라도 계속 진도를 나가고 회독을 하는게 맞는 건가요 ?
https://dataq.goorm.io/exam/116674/체험하기/quiz/4 여기서 하는 성별예측 문제에서 import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") # print(train.shape, test.shape) # print( train.info ()) # print(train.isnull().sum()) # print(test.isnull().sum()) #결측치 처리 (환불금액) train['환불금액'] = train['환불금액'].fillna(0) test['환불금액'] = test['환불금액'].fillna(0) # print(test.isnull().sum()) # print(train['성별'].value_counts()) #인코딩 target = train.pop('성별') train = pd.get_dummies(train) test = pd.get_dummies(test) #검증 데이터 분리 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=0) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit (X_tr, y_tr) pred = rf.predict_proba(X_val) # print(pred) from sklearn.metrics import roc_auc_score roc = roc_auc_score(y_val, pred[:,1]) #예측 및 파일생성 pred = rf.predict_proba(test) submit = pd.DataFrame({ "pred":pred[:,1] }) submit.to _csv("result.csv", index=False) # print( pd.read _csv("result.csv")) 이렇게 코딩을 했는데 예측 및 파일 생성에서 pred = rf.predict_proba(test) 여기 부분이 오류가 뜨는데 왜 그런가요 ㅠㅠ > Makefile:6: recipe for target 'py3_run' failed make: *** [py3_run] Error 1 Traceback (most recent call last): File "/goorm/Main.out", line 43, in <module> pred = rf.predict_proba(test) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 674, in predict_proba X = self._validate_X_predict(X) File "/usr/local/lib/python3.9/dist-packages/sklearn/ensemble/_forest.py", line 422, in validate X_predict return self.estimators_[0]._validate_X_predict(X, check_input=True) File "/usr/local/lib/python3.9/dist-packages/sklearn/tree/_classes.py", line 407, in validate X_predict X = self._validate_data(X, dtype=DTYPE, accept_sparse="csr", File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 437, in validate data self._check_n_features(X, reset=reset) File "/usr/local/lib/python3.9/dist-packages/sklearn/base.py", line 365, in check n_features raise ValueError( ValueError: X has 73 features, but DecisionTreeClassifier is expecting 74 features as input. 이렇게 뜹니다,,
안녕하세요. 좋은 강의 감사드립니다. 덕분에 잘 배우고 있습니다. 문제 2. 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 그리고 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요! 문제2를 대하고 순간 다음과 같은 고민을 했었습니다. 1번을 수행하여 'f1'컬럼의 결측치 행을 삭제한 후 2번을 하려니 'f3'컬럼의 결측치 갯수가 18개만 남더군요. 그럼 18개는 최초 데이터 100개의 20% 미만일까? 그렇지 않다. 'f1'컬럼 결측치를 제거한 후 데이터 갯수 69개의 20%~30%(14~20)에 해당한다. 그렇다면 'f3'컬럼의 최빈 값은 'f1'컬럼의 결측치를 제거하기 전의 값을 사용해야할까 아니면 결측치 제거 후의 값을 사용해야 할까? 결과적으로는 어떤 방식으로 하던 답은 56으로 일치했지만 주어진 데이터에 따라 다른 값이 나올 수도 있을 것 같습니다. 혼돈을 없애기 위해 문제 2의 문항 순서를 바꾸면 어떨까요? 30% 미만, 20% 이상인 결측치가 있는 컬럼은 최빈값으로 값을 대체하고 주어진 데이터에서 결측치가 30%이상 되는 컬럼을 찾고 해당 컬럼에 결측치가 있는 데이터(행)를 삭제 함. 'f3'컬럼의 'gold' 값을 가진 데이터 수를 출력하세요!
안녕하세요. 정말 좋은 강의덕분에 무사히 lambda에서 ec2로 클라우드 이관을 완료했습니다. 몇가지 고민 및 문의사항이 있어 글 남깁니다. 1. 지금까지 강의에서 배운 내용으로만 유저 1000명 이하인 서비스 운영이 가능할까요? - 지금까지 강의에서 다룬 프리티어 버전의 ec2, rds등에 대한 성능 측정을 어떤 식으로 진행해야 하는지 감이 안잡혀서 질문이 조금 추상적인점 양해 부탁드립니다. 2. 1번 질문이 추상적인 것 같은데, 혹시 지금 강의의 인스턴스 스펙에 대해서 성능을 측정할 수 있는 방법에는 어떤 것들이 있을까요? - ec2에 배포한 프로젝트의 아무 api를 잡고, jmeter등으로 성능 측정을 해보면 될까요? 아니면 더 정확하게 측정할 수 있는 다른 방법이 있을까요? - rds 관련해서 성능 측정은 어떤 툴이나 방법이 있는지도 궁금합니다. 3. 다른 글들을 찾아보면 vpc, elb, docker를 통해 아키텍처를 구성하는 것 같은데 각 기술에 맞는 도입시기 등은 언제일까요? 4. 이 강의를 다 들은 후에 클라우드 관련해서 어떤 걸 추가로 학습하면 좋을까요?