Assistant 기능으로 데이터를 tagging 하는 봇을 만들려고 합니다. tagging에 관한 정보를 file에 업로드 하고 필요한 내용을 bot을 통해 묻고 답으로 tag list를 받아 보려고 하는데요, 이 때 file로 질문 마다 새로운 thtread를 만들어서 질문을 하게 되면 file을 확인할때는 매번 token을 사용한걸로 처리가 되고 비용이 청구 될까요? 이런 목적으로 하는 경우에는 file 보다는 fine-turing이 더 좋을까요?
from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train.drop('charges',axis=1), train['charges'], test_size=0.15, random_state = 2022) X_tr.shape, X_val.shape, y_tr.shape, y_val.shape 학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 먼저 선생님의 코드는 위와 같았습니다. 아래는 제가 수정해서 작성한 코드입니다. from sklearn.model_selection import train_test_split X_train = train.drop('charges', axis = 1) y_train = train['charges'] X_tr, X_val, y_tr, y_var = train_test_split(X_train, y_train, test_size = 0.15, random_state= 2002) -------> 보기 편하려고 이렇게 넣었더니 y_var을 찾을 수 없다는 에러가 나왔음 헷갈리지 않기 위해 이와 같이 변수로 처리한 뒤 train_test_split을 했더니 X_train.head를 찍어도 선생님과 다른 결과가 나오고 평가 수식을 적은 후 linear regression을 하니 y_val이 정의되지 않았다고 에러가 나옵니다. 이유가 무엇인지 한참 고민해도 알아내지 못해서 질문 남깁니다. 답변해 주시면 감사하겠습니다.
선생님 안녕하세요! 현재 작업형2 연습을 하고 있는데 데이터 전처리 과정에서 어떤 문제는 object형 모두를 삭제하고, 어떤 문제에서는 int, float, object형 각각 일부 선택해서 삭제 또는 결측치 입력 후 검증 하던데 선생님은 어떤 기준으로 나누는지 아니면 어떤 기준을 가지고 나누면 도움이 되는지 궁금합니다!
강사님 도움을 요청합니다. 아래의 문제로 몇일을 끙끙이다 현재의 본인의 수준으로는 해결을 못해서 염치불구 하고 도움을 구합니다. 사이트에서 페이지 넘기기가 안됩니다. 코드를 올립니다. 마지막 부분 반복문에서 순차적으로 다음 페이지로 넘기려고 하는데 다 넘어가지 못하고 에러가 납니다. 페이지를 변수에 담아 프린트 해보면 8개의 페지가 찍이는데 반복문으로 넘어가서는 8개의 페지로 순차적으로 이동이 안되고 걸립니다. 코드는 아래와 같이 했습니다. 바쁘실줄 알지만 길이 없어 문의하니 한번 봐주시면 감사하겠습니다.
https://map.naver.com/p/api/smart-around/places?searchCoord=127.108519%3B36.817412&boundary=127.09854112852958%3B36.807207632892144%3B127.1187113403231%3B36.82744325030478&code=01&limit=20&sortType=RECOMMEND&timeCode=AFTERNOON 위 링크인데, 아무래도 현재 막힌 것 같습니다ㅠㅠ 영상 재촬영이 어렵다면 보충 설명이라도 추가 가능할까요?
안녕하세요 결측치 관련 질문드립니다 1.시험에서 test 데이터가 주어질시 제가 test데이터 행을 삭제하지 않아야 하는것은 인지했습니다. 그러나 test 데이터의 결측치를 제 임의대로 값을 넣어도 되는것인가요? 강의를 보니 이상치를 컨트롤하는 케이스는 거의없으나 결측치는 object는 최빈값 int,float은 중앙값이나 0 을 대입하는데 모든경우에 통일되는 방법인가요? 혹은 시험장에서 여러가지 결측치 처리 방법을 전부 알고가서 하나하나 검증하며 가장 값이 높은걸 넣어야 하나요 시험장에서 A로 평가하겠다 하면 검증을 통해 나오는 수치가 A를통해 보통 몇 이상이 나와야 제출할수 있을까요?
안녕하세요. 강의 잘 듣고 있습니다!! 예시문제 작업형2에서, 예시에서는 pred가 0,1로만 나오는데 제출은 확률값인 0,xxx이런형태로 제출해도 되는 것이 맞나요....? roc_auc_score여서 확률값제출이 맞는 것 같은데, 예제를 볼때는 0/1로만 되어있어 질문드립니다! 감사합니다.
1. predict와 predict_proba 모두 머신러닝 모델에서 예측할 때 사용하는 함수인데, 빅분기 시험에서 제출할 때 predict_prob함수를 사용해야만 하는 이유가 있나요? 2. random_state 경우 train&test split에도 사용하고 예축 모델에서도 사용하셨는데 빅분기 시험에서는 train&test split만 사용해도 괜찮나요? (그리드서치를 통한 하이퍼 파라미터 탐색에서도 train&test split에서만 random_state를 사용하는 경우가 있는 것 같아서요. -> 각 분할된 데이터셋의 최적의 하이퍼 파라미터 탐색하는 방식)
안녕하세요 서버는 종료한 상태에서 강의대로 (with-searchbar)/error.tsx 파일을 만들고 새로고침을 하면 error.tsx에서 작성한 페이지가 나오지 않습니다. error.tsx 인덱스 페이지 아래 사진처럼 error.tsx페이지가 아닌 핸들링되지 않은 런타임 에러가 발생해버립니다.. 혹시 searchParams를 Promise객체로 타입정의 한것처럼 뭔가 사용방법이 바뀐걸까요..?
안녕하세요 강의 잘 듣고 있습니다. SSR 의 동작방식에 대해 문의 드립니다. 1) 프로젝트에 초기 접속할때는 '/' 페이지에 대한 HTML 반환 후 js bundle 반환 => 하이드레이션 2) '/search' 로 이동하면 '/search' 페이지에 대한 HTML 반환 후 캐싱된 js bundle 과 결합하여 하이드레이션 저는 대충 위 과정으로 이해하고 있었는데, 페이지에 따라 js bundle을 추가로 요청하는 경우도 있다고 해서 헷갈리는 것 같습니다. 초기 접속과 이후 새로운 페이지를 요청할때 HTML 응답과 js bundle 응답이 어떤식으로 동작하는지 설명 부탁 드립니다!
안녕하세요 현재 6.4)스켈레톤 UI 적용하기 강의를 듣고나서 궁금한점이 있어 질문 남깁니다. 서버쪽 데이터요청이 오래 걸리는 경우 Suspense를 통해 Skeleton UI를 보여주고 이후 데이터가 적용 된 컴포넌트를 보여주는거로 알고 있습니다. 그래서 사용자경험이 조금 오를 것 같긴한데, 만약 데이터 요청이 빠른 경우(0.5초만에 데이터처리가 이뤄진 경우)에는 오히려 UX 관점에서 불편하지 않을까 싶어서 이럴땐 어떻게 처리하는게 좋을 지 질문 남깁니다! 예시) 책 검색 -> 책 리스트의 skeleton UI 가 잠깐 보였다가(0.5초 등장) -> 책 리스트 나타남 (이와 같은 과정이 이뤄지면 오히려 사용자 경험이 떨어지지 않을까 싶어 궁금합니다)
--------------------------------------------------------------------------- FileNotFoundError Traceback (most recent call last) Cell In[8], line 1 ----> 1 train_data = pd.read_csv("/kaggle/input/titanic/train.csv") 2 train_data.head() 다운이 제대로 받지 않아서 생기는 문제 같은데요... 영상에서는 다운을 받는 과정이 생략되어있는거 같은데 자세하게 알려주세요
단일표본검정 예시 문제에서 귀무가설을 기각하고 채택하는게 헷갈려 질문합니다! 단측검정 "합격원두 상품의 평균 무게는 120g보다 크다"의 경우 코드를 실행했을 때 p-value가 0.01985가 도출됩니다. 그렇다면 유의수준 0.05보다 작기 때문에 귀무가설을 기각하고 대립가설인 "합격원두 상품의 평균 무게는 120g보다 작다"를 채택하는 것이지요? 그런데 해당 표본의 평균은 120g보다 큰 121g인데.... 어디서 제가 잘못이해한걸까요?