안녕하세요 선생님. 작업형 2유형 답안 제출 관련 문의 드립니다. 작업형 2유형 문제를 해결하면서 선생님이 알려주신 단계대로 차근차근 진행하여 csv예측 파일까지 잘 작성했습니다. 마지막에 작성된 csv파일을 확인하는 Print( pd.read _csv("result.csv))구문만 빼고 전 단계의 print구문은 다 주석처리 하고 마지막에 최종 1회만 제출했습니다. 앞 단계의 print구문들은 주석처리 하여도 제가 작성하였던 코드만 실행된 상태로 제출되면 감독관이 체점하는대는 아무 문제 없는게 맞을까요?
안녕하세요. 강사님 수업듣고 큰 도움을 받은 수강생입니다. 먼저 감사하다는 말씀드리고 싶네요. 비전공자로 막연한 관심에 파이썬이 뭔지 궁금해하다가 빅데이터 분석기사 시험이 파이썬으로 할수있다는 정보를 알게되고, 시험응시를 하면서 공부해볼 수 있겠구나 싶어서 시작해봤습니다. 막상 꾸준히 공불못해서 필기도 실기도 벼락치기하면서 시험을 치뤘지만, 앞으로 데이터분석가 수준으로 조금 더 딥하게 공부해보고 싶은 마음이 생겼습니다. 강의에서 캐글, 데이터분석 대회, 스터디 참여 등을 추천해주셔서 해보려고 합니다. 대신 조금만 더 구체적으로 파이썬을 활용하거나 꼭 그렇지않더라도 딥러닝 영역까지 학습하고 숙련할 수 있는 방법론에 대한 의견을 여쭙고 싶습니다. 감사합니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 이번 시험에서 작업형2 문제 풀이 과정입니다 Test 데이터에 총 3개의 범주형 컬럼이 존재 하였습니다. 월, 요일, 네임 이때 각 고유값은 12,7,2 여서 따라서 월과 요일은 라벨인코딩 / 네임은 겟더미즈 로 각각 하였습니다. 이후 모델 성능을 비교파기 위해 랜덤포레스트와 라이트지비엠을 사용 하였습니다. 랜포리그레서로 학습시키고 예측할 땐 random_state 만 고정한채 mae로 평가하였더니 140 정도였고 XGBM리그레서로 학습시키고 mae로 평가하니 108 정도 나왔습니다. 이때도 딱히 하이퍼 파마미터튜닝은 진행하지 않았습니다. 따라서 test 데이터를 xgbmregressor에 적용하여 예측한 결과를 제출하였습니다. 다만 여기서 lightgbm 을 사용하신 분들이 랜덤포레스트에서는 없었던 음수값이 예측에 나왔다고 하는데, 전처리를 동일하게 하고 평가도 좋게나온 모델의 결과가 저렇게 오류로 나올 수가 있나요..?그냥 남들 다 쓰는 랜포 쓸걸 괜히 lightgbm 알아서 쓴거 같다는 기분이 듭니다 ㅜㅜ
이해가 어려운 섹션이나 영상 설명은 질문으로 꼭 남겨주세요. 기출문제를 풀다가 막힌 개념이 있나요? 질문으로 회차나 번호, 개념을 예시로 질문해주세요. 답변에 도움이 됩니다. 이론 문제는 통합본 PDF 파일로 제공될 예정입니다. (6월 중 업로드 예정) 합격을 가르는 것은 역시 코드해석문제. 이론을 외울 시간이 없다면 코드에 익숙해지고, 중요 개념을 몇 가지 외워가면 합격할 수 있습니다. Pdf다운이안대여
안녕하세요, 수업을 대부분 수강하고 실제 현업에서 사용중에 있는데 문의사항이 있어서 질문 드립니다. 현재 상황은 이렇습니다. DAG 구성 - 5분단위 스케줄링 -4개의 task - task1 >> task2 >> task3 >> task4 - 각 task 별 timeout =5분 문제 상황은 task 2번이 한달에 한번씩 data 가 많아지면 5분까지 타임아웃이 걸릴때가 있는 것인데요, 이때 그다음 Dag run 이 수행되면서 task 2 번이 동시에 수행 되는 시간이 조금 있는데 그때 데이터 처리가 중복으로 처리되는 현상이 발생하게 됩니다. 그래서 가능하면 task2 을 동시에 돌리는걸 막고 싶었는데요, 처음 생각해낸 방법은 task_concurrency 옵션을 task 에 주어서 1개만 돌수 있게 바꾸고 timeout 을 조금더 넉넉하게 주려고 했으나, 만에하나 해당 task 가 10분이상 걸린다면 dag run 이 수행되고있는것 제외 2개가 더 웨이팅을 하는것이 되고, 이게 누적이 될수도 있을것으로 보여서 문제로 인지 했습니다. 서비스 적으로 5분내에 돌수 있게 하거나, 아니면 5분 스케줄링을 변경하는 방법을 고려해야 하지만 해당 고려 없이 혹시 airflow 단에서 할수 있는 작업이 있을까요? ex . runninng 중인 task 와 대기중인 task 가 하나정도 있다면 해당 task 는 스킵하는 옵션 등입니다..
저 docker volume을 사용해서 app 폴더의 내용을 수정하면 , 바로 docker container안에 반영되게 하느것을 따라하고 있는데 , 저장후 반영이 안되서 , docker exec -it 를 해서 container안에 들어가 보니 , 사용자가 수정 권한이 없어서 777로 바꾸고 다시 해봐도 잘 안되네요 , cat index.ts파일해도 바뀐 파일이 container안에 반영자체가 안되는거 같습니다 도와주세
안녕하세요. 3년전부터 aws 를 사용하고 있는 백엔드 개발자입니다. 실력좋으신 데브옵스팀이 있어 지금까진 오마카세로 요청만 드렸는데요 도져히 답답해서 자격증 먼저 도전하게 되었습니다. practitioner 강의를 듣다보니 난이도가 그렇게 높진 않아서 취득할 필요가 있나 싶은 생각이 드네요. 이 강의를 모두 완강 후 developer로 준비하고 싶은데 Solutions Architect와 developer의 차이가 무언지 설명 부탁드려도 될까요? 저의 궁극적인 목표는 개발 목적에 맞게 aws 솔루션을 습득해서 사용하고 문제 발생 시 스스로 찾아 해결하고 싶습니다. - 학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! - 먼저 유사한 질문이 있었는지 검색해보세요. - 서로 예의를 지키며 존중하는 문화를 만들어가요. - 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요.
너무 비싼 응시료때문에 한번에 붙고 싶은 욕심이 큽니다 ㅠㅠ 제공해주신 문제들로도 충분히 합격 할 수 있을까요..? 그리고 제일 궁금한게 시험볼때 영어를 한국어로 번역해서 문제가 제공 되는데 그 번역된 맥락들이 이 문제들과 비슷한가요?! 혹시 터무니 없이 알아볼수 없을 정도로 번역되어 있지 않을까 걱정됩니다..
이번 시험에서 오즈비가 또 나왔습니다. 지난 시험에서는 특정 변수값이 1 증가할때의 오즈비를 구하라고 나와서 다음과 같이 구했었습니다. import numpy as np np.exp(계수) --> 답 이번 문제에서는 특정 변수값이 5 증가할때의 오즈비를 구하라고 나왔습니다. 그러면 답이 아래와 같나요? np.exp(5*계수)
선생님 안녕하세요, 개정1판도, 개정 2판도 교재를 구매해서공부하고 강의듣고 있습니다. 그런데 두 책에서 log1p()함수에 관해 1+log(x) 라고 설명하고 계시는데 log(x+1)값이 아닐런지요? 그래서 이것을 역함수로 하는 함수는 exp1m()이 아니라 expm1() 되는거고 이름을 지정하는 원칙도 함수의 모양을 따라 지정한 것 같아요 1+x값을 로그에 넣고, 역함수를 만드는것은 e^(x)-1이라서 1p ->m1이런식으로..한게 아닐런지.. 제 생각이 잘못되었는지 궁금합니다
자바와 스프링 부트로 생애 최초 서버 만들기, 누구나 쉽게 개발부터 배포까지! [서버 개발 올인원 패키지]
강의내용 7:31초 .gitignore 파일을 만들떄 자동저장 or 수도저장 할건지 물어보는 부분에서 don't ask again 클릭후 add으로 눌러버려서 수동으로 저장으로 다시 바꾸고 싶은데 어떻게 해야하나요? 죄송해요 구글링해도 안나와서 이런 사소한 질문 죄송합니다!
자바와 스프링 부트로 생애 최초 서버 만들기, 누구나 쉽게 개발부터 배포까지! [서버 개발 올인원 패키지]
Database "mem:library" not found, either pre-create it or allow remote database creation (not recommended in secure environments) 이런 식으로 mem:library 를찾을수없다고 뜹니다 무엇이문제일까요? 구굴링해도 안뜹니다 혹시 h2 데이타베이스를 설치해야하는건가요?
안녕하세요- 교육도 듣고, 문제풀이를 반복해서 풀고 풀이를 보고 있는데요 문제풀이 7, 문제 5 에서 고가용과 고가용성 아키텍쳐의 의미와 각 솔루션이 고가용 솔루션 여부를 판단하는 기준이 무엇인지 정확히 모르겠습니다. 해당 문제에서 고가용성이 영속성이라고 생각하면 될까요? 저는 데이터 복제, 복제할 수 있는 어플리케이션이라고 풀이를 해서 아마존 EC2 + EBS 통해서 각 가용영역 별로 데이터를 복제하는 솔루션이라고 생각했는데 관점이 다른 것 같아서요. 고가용성이 데이터의 영속성이라는 관점에서보면 Aurora와 DynamoDB가 맞는 것 같은데 고가용성이 영속성이란 의미 일까요? - 학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! - 먼저 유사한 질문이 있었는지 검색해보세요. - 서로 예의를 지키며 존중하는 문화를 만들어가요. - 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요.