안녕하세요, 강의와 교재로 공부하고 있습니다. 교재 작업형2 ch4 회귀 부분에서 트레인 테스트 데이터를 합친 후 범주형 데이터를 레이블 인코딩 한 후 다시 트레인 테스트로 쪼개고 결측치를 채우는 최솟값, 최빈값으로 채우는 과정으로 진행이 되는데요, 레이블 인코딩 과정에서 범주형데이터의 결측치가 하나의 값으로 인코딩이 되어서 결측치가 존재하지 않아 중앙값으로 결측치를 대체하는 과정이 불필요한 것 같은데 맞을까요? 또한 원핫 인코딩을 사용하려는 경우 결측치를 먼저 대체한 후에 인코딩을 해야 오류가 안나는게 맞을까요? 일반적으로 결측치 처리를 인코딩 후에 하는지 전에 하는지 궁금합니다. 감사합니다.
<Image src="/logo.png" alt="로고" width={100} height={100} /> import Logo from "@/public/logo.png"; <Image src={Logo} alt="로고" width={100} height={100} /> 이 두가지 접근 방식의 차이가 있을까요?
안녕하세요. 열심히 수업을 듣고있는 수강생입니다. 도넛스토어를 만든 후에 랜더링을 걸어보고 궁금한 부분이 있어서 질문드립니다. 뷰포트와 랜더링 결과물을 같이 찍은 스크린샷입니다 도넛 아이싱이 렌더링 했을때 이상하게 나옵니다. 혹시 버그인가 해서 파일을 저장해서 다시 불러왔는데요 솔리디파이 오프셋에 녹색이 칠해져 있고 아이싱이 뒤집혀있습니다. 옵션값 1로 바꿔서 제대로 바꾸어놓고 찍었는데도 이상하게 나옵니다. 혹시 이게 원인일까요? 또 녹색은 왜 생기는지 궁금합니다. 앞서 파일을 저장했다가 다시 열었습니다. 색이 이상한 부분이 있어 수정하고 렌더를 걸었는데 수정 전 색깔로 결과물이 나옵니다. (창문유리,화초,바닥,빵색)이상해서 세이브하고 다시 껏다 켰는데 수정한게 반영이 안된 채로 리셋되어 있습니다. 왜 잘 안되는지 궁금합니다. 상세하고 알차게 강의해주셔서 재미있게 잘 공부하고 있습니다. 앞으로도 잘 부탁드립니다:D!
작업형2 모델 분석 및 결과 제출에 대해 질문이 있습니다. 회귀분석을 예로들면 랜덤포레스트회귀, XGB회귀, 릿지, 라쏘 등 다양한 모델을 사용해서 모델 마다 도출하는 값이 다른고 그 중 가장 높은 값(r2값이나 mse 값 등 문제에서 평가로 제시된 지표)을 사용한다고 알고 있습니다. val데이터로 학습을하고 가장 높은 값을 찾아서 마지막에 pred = model.predict(test)로 대입하는데, 모델을 선택하는 과정이 없는 것 같습니다. 이렇게 두개의 모델을 사용해서 각각 값을 도출해서 위와 같은 값이 나왔고 이런식으로 test데이터를 예측값에 적용하는데 위 두개에 모델중에 더 나은 모델을 선택하는 과정이 없는건가요?? 두개의 모델이 다 활성화 되어있는데 저렇게 밑에 model.predict만 적어놓으면 이 모델이 xgb인지 랜덤포레스트인지 어떻게 인식하는걸까요?
모의고사 문제 3번 풀이 관해서 질문 드려요! 문제 3번 풀이가 방법이 총 세가지로 풀이 해주셨는데 ( replace, map, 조건) 혹시 시험에서 저런 류의 문제에서 결측치랑 데이터값을 변경하라는 문제에서 어떤 특정한 풀이를 이용해서 풀라고도 나오기도 하나요? 아니면 저 세개중에 한가지 방법만 사용해서 답만 구해도 상관 없는건가요!?
Assistant 기능으로 데이터를 tagging 하는 봇을 만들려고 합니다. tagging에 관한 정보를 file에 업로드 하고 필요한 내용을 bot을 통해 묻고 답으로 tag list를 받아 보려고 하는데요, 이 때 file로 질문 마다 새로운 thtread를 만들어서 질문을 하게 되면 file을 확인할때는 매번 token을 사용한걸로 처리가 되고 비용이 청구 될까요? 이런 목적으로 하는 경우에는 file 보다는 fine-turing이 더 좋을까요?
from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train.drop('charges',axis=1), train['charges'], test_size=0.15, random_state = 2022) X_tr.shape, X_val.shape, y_tr.shape, y_val.shape 학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 먼저 선생님의 코드는 위와 같았습니다. 아래는 제가 수정해서 작성한 코드입니다. from sklearn.model_selection import train_test_split X_train = train.drop('charges', axis = 1) y_train = train['charges'] X_tr, X_val, y_tr, y_var = train_test_split(X_train, y_train, test_size = 0.15, random_state= 2002) -------> 보기 편하려고 이렇게 넣었더니 y_var을 찾을 수 없다는 에러가 나왔음 헷갈리지 않기 위해 이와 같이 변수로 처리한 뒤 train_test_split을 했더니 X_train.head를 찍어도 선생님과 다른 결과가 나오고 평가 수식을 적은 후 linear regression을 하니 y_val이 정의되지 않았다고 에러가 나옵니다. 이유가 무엇인지 한참 고민해도 알아내지 못해서 질문 남깁니다. 답변해 주시면 감사하겠습니다.
선생님 안녕하세요! 현재 작업형2 연습을 하고 있는데 데이터 전처리 과정에서 어떤 문제는 object형 모두를 삭제하고, 어떤 문제에서는 int, float, object형 각각 일부 선택해서 삭제 또는 결측치 입력 후 검증 하던데 선생님은 어떤 기준으로 나누는지 아니면 어떤 기준을 가지고 나누면 도움이 되는지 궁금합니다!
강사님 도움을 요청합니다. 아래의 문제로 몇일을 끙끙이다 현재의 본인의 수준으로는 해결을 못해서 염치불구 하고 도움을 구합니다. 사이트에서 페이지 넘기기가 안됩니다. 코드를 올립니다. 마지막 부분 반복문에서 순차적으로 다음 페이지로 넘기려고 하는데 다 넘어가지 못하고 에러가 납니다. 페이지를 변수에 담아 프린트 해보면 8개의 페지가 찍이는데 반복문으로 넘어가서는 8개의 페지로 순차적으로 이동이 안되고 걸립니다. 코드는 아래와 같이 했습니다. 바쁘실줄 알지만 길이 없어 문의하니 한번 봐주시면 감사하겠습니다.
https://map.naver.com/p/api/smart-around/places?searchCoord=127.108519%3B36.817412&boundary=127.09854112852958%3B36.807207632892144%3B127.1187113403231%3B36.82744325030478&code=01&limit=20&sortType=RECOMMEND&timeCode=AFTERNOON 위 링크인데, 아무래도 현재 막힌 것 같습니다ㅠㅠ 영상 재촬영이 어렵다면 보충 설명이라도 추가 가능할까요?