pd.DataFrame({"pred":pred}).to_csv("result.csv", index=False) 2유형 제출할때 마지막 csv 만드는 코드를 submit에 담지않고 저렇게만 해도 되나요?? pred=rf.predict(test) pd.DataFrame({"pred":pred}).to_csv("result.csv", index=False) 마지막 2줄을 이렇게만 작성해서 제출했습니다 read_csv로 파일 확인했을땐 test데이터와 size는 동일했습니다
시험문제에 'gas_totl(taeget)의 결측치는 0으로 대체했다' 라고 명시되어있는데 다들 뭐 삭제해야하니 평균 중앙값 처리해야하니 하는데.. 어떻게 생각하시나요.. 솔직히 isnull에도 안잡혀서 그냥 처리됐구나 하고 넘어갔는데 불안감 조성하니까 착잡하네요.. 작업형1-3빼곤다맞았는데.. 이전에도 타겟값에 결측치있거나 그런문제가 있었나요? 추가로 작업형2 질문이 있습니다만.. submit.to_csv('result.csv',index=False) 제출 print(test.shape, submit.shape) result = pd.read_csv('result.csv') print(test.shape, result.shape) 이렇게 했는데 제출 한후에 파일 불러와서 형식이랑 result랑 테스트쉐잎 확인했는데 제출한 후에 확인해도 상관없는걸까요?? 그리고 이렇게 해도 괜찮은지도 질문드립니다.
이슈였던 결측치(0) 전처리 작업없이 그대로 두고 가장 기본적으로 라벨인코딩 / 랜덤포레스트 적용했는데, 평가 점수가689 나오더라구요...!! 가장 기본적으로 해야되는 것들만 적용해서 나온 점수인데, 많은 분들 점수대는 400후반 ~ 500중반 미만으로 나왔다고 해서 조금 걱정이 듭니다ㅠ 간격에 대해서 기준은 없지만, 600후반으로 나와도 어느정도 점수는 받을 수 있을까요~~??! 선생님 덕분에 빅분기 시험에 대해서 포기하지 않고 끝까지 공부하여 시험까지 잘 마무리한 것 같습니다~! 여러 질문들에 대해서 빠르고 친절한 답변도 항상 감사했습니다!!^^
1유형 2유형 3유형 시험 복기는 없을까요 ? 1유형 1-1번 / 1-2번 40만 ? 43만 ? / 20만 1유형 2번 1유형 3번 2유형은 RMSE 530정도 나왔습니다. 근데 결측치 이야기가 있던데 isnull().sum() 했을 때 타겟 변수에 결측치가 없었는데, 결측치는 0으로 표시된다? 라는 내용이 있긴 했으나.. 별도 결측치 처리를 안 했는데 여러분은 어떻게 하셨나요? 그리고 3유형에 오즈비 구하는 문제에 값이 2 증가한다는 가정이 있었나요 ?
글을 작성하고 조금 더 공부해봤는데 저는 프론트(3000번 포트)와 백엔드(8080번 포트)간의 통신으로 웹이 배포되고 운영되는걸로 알았는데, 3000번 포트와 8080번 포트간의 통신을 하는 게 아니라고 하는 것 같아서 댓글에 다시 정리해보았습니다. 글의 내용처럼 서버가 배포되는것이 아닌, 댓글에 남긴 흐름으로 배포가 되는 게 맞는건지 궁금합니다.🥹 안녕하세요. 최근 재성 강사님의 AWS, Docker, CI/CD 강의를 수강하며, Spring Boot 프로젝트를 Docker 이미지로 패키징하고 무중단 배포하는 과정까지 직접 구축해보았습니다. Spring 서버를 EC2에 자동으로 배포하고 무중단으로 교체하는 구조는 충분히 이해하고 구현도 해보았지만, 이번 프로젝트에서 프론트엔드까지 함께 연동하려다 보니 새로운 고민이 생겼습니다. 프론트 지식이 전무한 상태에서, 프론트엔드 팀원이 React로 만든 프론트 화면까지 백엔드와 함께 배포해달라는 요청을 주셨는데, 여기서부터 개념적으로 막히기 시작했습니다. React에서 api/login 같은 요청을 보내면 Spring 서버가 응답하고, 이 데이터를 바탕으로 React가 화면을 렌더링한다는 구조를 이해하고, AWS강의를 들으며 S3, CloudFront로 프론트를 배포하는 과정도 실습하였는데 Spring과 React를 동시에 배포하려니까 흐름이 잘 이해가 가지않습니다..ㅠㅠ https://velog.io/@jwo0o0/AWS-S3%EB%A1%9C-React-%EC%95%A0%ED%94%8C%EB%A6%AC%EC%BC%80%EC%9D%B4%EC%85%98-%EB%B0%B0%ED%8F%AC%ED%95%98%EA%B8%B0 https://velog.io/@jwo0o0/AWS-S3-%EB%B2%84%ED%82%B7-Github-Action%EC%9C%BC%EB%A1%9C-CICD 강사님이 AWS 강의에 react 배포하는 방법으로 올려주신 블로그 포스팅을 참고해서 이해하려고 하는데 제가 이해한 흐름이 맞는 지 확인해주실 수 있나요? 현재 프로젝트에서 백엔드와 프론트를 분리해서 각각 repository에 올리고있는데요! Spring에서 workflow에 Github에 올라와있는 React 프로젝트를 S3에 업로드하고 CloudFront로 배포하도록 자동화 이후 workflow에 백엔드 Spring 프로젝트를 Docker 이미지로 패키징하여 ECR에 이미지를 Push. workflow에 SSH로 EC2에 접속하는 코드를 작성. EC2에서 ECR에 올린 이미지를 Pull받은 뒤 해당 이미지로 docker run 하여 spring server를 띄움. 이렇게 흐름을 이해하고 github Actions workflow를 작성해도 괜찮을까요? react는 3000포트를 사용하고, Spring은 8080포트를 사용하는걸로 아는데, 포트번호가 달라도 알아서 잘 통신이 되나요..?? 또 Spring workflow에서 프론트 Git 레포지토리까지 왔다갔다 하면서 S3 업로드 자동화를 해주는게 맞나요...?? 제가 프론트 지식이 아예없어서 S3에 프론트 프로젝트를 업로드하면 어떻게 백엔드와 어떻게 통신을 하는건지 잘 이해가 가지않습니다. 홈화면의 페이지가 있다면, 로그인이라는 버튼을 눌렀을 때 백엔드에 api/login이라는 요청을 보낸다고 했을 때 아무런 작업을 안해줘도 알아서 서로 통신을 하는지... 인프라 개념이 아직 미숙하다 보니 글도 장황한 것 같습니다 죄송합니다.. 😢 정리해보면서도 스스로 구조를 잡고자 하는 중인데, 혹시 제가 놓치고 있는 개념이 있다면 알려주시면 정말 감사하겠습니다!
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 타겟에 결측치가 있는 것에 대해 처리를 안하고 제출했는데 그러면 무조건 틀리나요..?ㅠ 점수는 잘 나왔습니다
이번 10회 실기시험 1유형 3번 문제가 띄어쓰기 제외하고 단어 수 세는거였는데 저는 (띄어쓰기 전 문장의길이 - replace로 띄어쓰기 지운 문장의길이) + 1 해줬는데 단어 개수가 이렇게해도 세어질까요?? 10개정도 확인했을땐 다 맞아서 그냥 그렇게 풀었는데 저처럼 푼 사람이 없는 것 같아 여쭤봅니다
안녕하세요 우선 늦게 질문 남기는 점 죄송합니다 다름이 아니라 시험환경 관련해서 질문이 있습니다. 기존 강의에서 코랩에서 코딩을 할 때 이전 셀 실행 기능이 있어 유용하게 사용했는데 시험 환경에서 같은 기능을 사용하려면 어떻게 해야하는지 궁금합니다. 추가적으로 코드 라인별 실행 불가라고 되어있는데 순차적으로 실행하면서 진행하는건 가능할까요? 예를 들어 2유형이라고 치면 전처리 하고 결과 보고 이후 그 밑에 코드 이어서 인코딩 진행한 후 결과 보고 모델 돌리고 결과 보고 이런식으로 순차적으로 코드 작성하면서 실행 결과 확인하는게 가능한지 궁금합니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 3과목 공부할 시간이 너무 없어서그러는데 강의에서 심화라고 나오는건 일단은 건너뛰어도 될까요? 3과목은 한문제라도 맞추는게 목표입니다.ㅠㅠ
아래 문제를 제가 혼자 다시 풀었을 때, 처음에 model = logit(formula,test).fit() 이라고 test데이터로 모델을 학습해서 답이 안나왔었습니다. 작업형2에서 배웠던 머신러닝의 train, test의 개념이 동일하게 적용되어 학습은 무조건 test가 아니라 train데이터로 진행하는 걸 대전제로 이해하면 될까요? 기출7회 작업형3 / 문제1-3. 독립변수 weight 만 사용해 학습한 로지스틱 회귀모델에서 test데이터의 gender를 예측하고, error rate(오류율)를 구하시오. (반올림하여 소수 셋째자리까지 계산) import pandas as pd df = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/refs/heads/main/p4/7_3/clam.csv") # train test 나누기 train = df.iloc[:210] test = df.iloc[210:] # print(train.shape, test.shape) (210, 6) (90, 6) # logit from statsmodels.formula.api import logit formula = 'gender ~ weight' model = logit(formula,train).fit() # test데이터의 gender 예측 pred = model.predict(test) print(pred) pred_ver2 = pred > 0.5 from sklearn.metrics import accuracy_score AS = accuracy_score(test['gender'],pred_ver2) ER = 1 - AS print(round(ER,3))
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요 퇴근후딴짓님 강의 잘 듣고 있습니다 🙂 다름이 아니라 2유형 코드 제출 시 제가 확인하려고 써둔 코드인 1) 평가 지표 코드 ROC_AUC / RMSE 등등 from sklearn.metrics import roc_auc_score 2) 생성 csv파일 확인 코드 print(pd.read_csv("r.csv").head() 위의 두 코드를 주석처리하거나 지운 후 맨 마지막 코드가 submit.to_csv가 되도록 하여 제출해야하는지 궁금합니다 ! 감사합니다 !!
logit에서 독립변수를 쓸 때 HasPhoneService와 HasTechInsurance에 C를 붙여주지 않는 건 그저 문제에 범주형이라고 나오지 않았기 때문인가요? 그럼 데이터가 범주형으로 나와있어도 문제에 범주형이라고 써져 있지 않다면 C를 쓰면 안되는건가요? 학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 부연설명도 조금 해주세요. 전화서비스를 받지 않은 고객이 이탈할 확률 대비, 전화 서비스를 받은 고객이 이탈할 확률에 대한 오즈비가 단순히 HasPhoneService에 대한 회귀계수 집어넣는 이유가 뭐에요? 나중에 또 이런문제가 나왔을때 그걸 판단하는 방법을 알려주세요... ㅠ