에어비엔비 가격 문제 풀이 영상 라벨인코딩 할때 언제 concat하고 언제는 안해도 되는지 잘 모르겠어요 set(train['neighbourhood']) == set(test['neighbourhood']) 이 코드에서 False가 나와서 범주형이 서로 다르기때문에 concat을 해야한다고 이해했는데, 이 문제에서는 그냥 바로 train, test에 인코딩하네요?
안녕하세요 강사님 강의에서는 전부 1번 방식으로 바로 제출하는것으로 방법이 나와있는데 틀린부분을 생성형AI와 같이 학습해본 결과 지속적으로 2번 방식처럼 train, target으로 한번 더 학습하고 테스트 파일을 예측하는게 더 낫다고 나오더라구요 2번으로 하는 경우에는 더 유의미한 차이가 있는걸까요? 아님 그냥 원래 방식대로 1번처럼 진행하는게 나을까요?
안녕하세요 정환님. 저는 정환님의 강의를 모두 구매해서 수강하고 있는 수강생입니다. 현재는 바이브 코딩 강의를 제외한 강의들을 모두 수강했고, 지금은 복습을 진행하고 있습니다. 복습과 함께 프론트엔드 신입 지원용 개인 프로젝트를 준비하고 있는데, 정환님께 배운 내용을 최대한 활용해 보고 싶어서 질문드립니다. 개인 프로젝트 기술 스택은 Next.js + TanStack Query + Supabase 기반으로 생각하고 있습니다. 1. 제가 이전에 영어학원에서 근무한 경험이 있어서, 그 경험을 바탕으로 영어와 관련된 서비스를 만들어보려고 합니다. 예를 들어 영어 원서 학습 서비스나 영어 단어장 서비스 등을 생각하고 있는데, 이런 주제가 프론트엔드 신입 포트폴리오용 개인 프로젝트로 적절할지 궁금합니다. 2. 혹시 프론트엔드 신입 포트폴리오용으로 추천해 주실 만한 프로젝트 주제가 있을까요? 3. 현재 React, TypeScript, Next.js, TanStack Query를 학습하고 복습 중입니다. 신입 프론트엔드 개발자로 취업하기 위해 어느 정도 수준까지 준비하는 것이 좋을지, 그리고 추가로 공부하면 좋을 부분이 있다면 조언 부탁드립니다. 4. 정환님의 바이브 코딩 강의를 수강한 이후에는 AI를 활용한 프로젝트도 하나 진행해 보고 싶습니다. 프론트엔드 신입 포트폴리오 관점에서 추천해 주실 만한 AI 프로젝트 주제가 있을까요? 5.포트폴리오를 준비하는 입장에서 아래 항목들의 우선순위를 어떻게 가져가는 것이 좋을지도 궁금합니다. 현재 준비 기간이 넉넉하지 않아 세 가지를 모두 진행하지 못할 수도 있다는 생각이 들어서, 어떤 순서로 준비하는 것이 가장 효과적일지 조언 부탁드립니다. 1) 개인 프로젝트 2) AI 프로젝트 3) 팀 프로젝트 질문이 많았는데 시간 내어 읽어주셔서 감사합니다. 정환님 강의를 통해 정말 많은 도움을 받고 있습니다. 항상 좋은 강의 만들어주셔서 감사드립니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 # 레이블 인코딩, 랜덤포레스트: 807.8000397227841 # 원핫 인코딩, 랜덤포레스트: 819.45688399024339 # 레이블 인코딩, lgb: 779.846084731424 # 원핫 인코딩, lgb: 786.6443289033147 # 모델은 lgb로 선택 # 모델 선택 후 튜닝, 결측치 처리 유무, 인코딩 유무 확인하며 성능 비교하기 # 튜닝 X -> 더 높아짐 # 결측치 0으로 처리, 카테고리로 인코딩: 772.4958384891883 # 결측치 처리 X, 카테고리 인코딩: 768.6458172187305 # 결측치 처리 X, 레이블 인코딩: 782.66052200386 # 결측치 0으로 처리, 레이블 인코딩: 779.8460847311424 위의 과정을 거쳐 lgb모델, 결측치 처리 X, 카테고리 인코딩으로 선택하여 진행하였는데, 이렇게 하는 것이 맞는지 확인차 질문드립니다 !!! 그리고, 다 선택 후, train, target 전체 데이터로 재학습 후 test 예측하는 것이 더 좋을지 질문드립니다 !
안녕하세요, train 데이터에는 없지만 test 데이터에는 있는 범주형 데이터를 인코딩하기 위해서 train test를 다 합친 후에 인코딩을 수행하는 것으로 알고 있는데요, (라벨인코딩, 원핫인코딩) 만약 train test 두 데이터를 합친 데이터를 fit 하고 train, test 별로 transform 하면 이것도 결국엔 Data Leakage가 되는 것이 아닌지 여쭙고 싶습니다. 만약 시험 환경에서 저런 상황이 나타난다면 Data Leakage는 감수하고 인코딩을 수행해야 하는 것인지 궁금합니다. 감사합니다.
먼저 강의는 정말 잘 듣고 있습니다. 강의 내용을 주로 들으면서 따로 궁금한 점들을 인터넷에 나와있는 다른 정보를 찾아가면서 해결해 나아가니 습득이 잘 되는 것 같습니다. 문의 사항은 다음과 같습니다. 17강 강의 마지막 부분 (강의 동영상 16:00 부분) 에서 feature 에 대한 y 값이 0 0 0 0 1 1 1 1 1 이 되는 그래프를 직접 그리신 다음 선형회귀 직선을 그리셨는데, 기울기가 음이 되도록 좌상향 직선을 그리셨습니다. 이부분이 많이 헷갈리는데, 지금까지 선형회귀를 학습한 내용을 생각하면 오차가 최소화되어야 하기 때문에 기울기가 양이 되는 우상향 직선이 되어야 하는 것이 아닌가 생각합니다. 이에 대한 답변 부탁드립니다. 강의 막바지 내용이고 다음 강의에서 다룰 내용이라 그냥 그러려니 하고 넘어갈 수도 있는데 (아직 18강 강의를 듣기 전입니다.) 혹시나 해서 문의드립니다. 감사합니다.
작업형 2를 풀때 회귀문제에서 카테고리가 다른 경우는 기출에서는 나오지 않았고 연습문제에서만 나왔는데 지금까지 카테고리가 같은 것만 공부해서 카테고리가 다른 경우는 공부하지 않았습니다 카테고리가 다른 경우가 나올 확률이 높아서 공부하는게 좋을지 시험3일 전에 여쭤봅니다..!
안녕하세요, XGBRegressor 학습 시 나타나는 warning으로 실제 오류와 자주 헷갈려서, import warnings warnings.filterwarnings('ignore') 실행 후 코드를 계속 실행해도 괜찮을 지 여쭤보고자 문의 드립니다. 좋은 강의 감사합니다.