안녕하세요! 24. 머신러닝 학습 및 평가 (분류) 25. 머신러닝 학습 및 평가 (회귀) 강의를 듣고 궁금한게 생겨서 질문을 남기고 있습니다! 0) 궁금증의 개요 : Train 데이터와 Test 데이터의 컬럼수가 차이가 날 때, 원핫 인코딩으로 풀기위해서는 합치기(concat) 와 분리를 사용하는 것으로 인지하고 있습니다. 1) 분류 문제의 경우 ① Train 데이터와 Test 데이터의 컬럼수가 차이가 남 -> 원핫 인코딩을 쓰려면 합치기 (concat) 사용 + 원핫 인코딩 사용 + 분리 -> 레이블 인코딩으로 합치기 (concat) 미사용하고, 풀이 진행함 2) 회귀 문제의 경우 ① Train 데이터와 Test 데이터의 컬럼수가 차이가 안남 ② 합치기(concat) -> 레이블 인코딩 -> 분리를 진행하고 풀이 진행함 3) 궁금한 점 ① 분류 문제에서 트레인 데이터와 테스트 데이터의 컬럼의 수가 다를 때, 원핫 인코딩으로 풀이 진행하려면 .concat 사용 -> 원핫 인코딩 -> 분리해야하는데 이 과정이 하기 싫으면 레이블 인코딩 사용하면 되나요??? ② Train 데이터와 Test 데이터의 컬럼수가 차이가 날때만, 원핫 인코딩에서 합치기와 분리를 진행하는거 아닌가요??? ③ 회귀 문제에서는 Train 데이터와 Test 데이터의 컬럼수가 차이가 안나는데, 왜 레이블 인코딩으로 합치기와 분리를 하신건가요??? ④ 회귀 문제에서 레이블 인코딩을 할 때, 왜 Test 데이터에는 트랜스폼을 진행안하신 이유가 있을까요? 분류 문제에서는 트랜스폼을 진행하셨는거 같은데 ㅠㅠ ⑤ 원핫 인코딩, 레이블 인코딩에서 합치기와 분리 순서가 맞는지 확인 부탁드려도 될까요? - 순서 : 합치기 -> 원핫,레이블 인코딩 -> 분리 ※ 제가 파이썬이 처음이라 궁금한점이 너무 많은거 같습니다 ㅜㅜ 번거롭게 해드려 죄송합니다ㅜㅜ
메일 전송을 커맨드로 지정해주셨는데, 어떤 상황에서 보통 사용되는지 궁금합니다. 그리고, 서비스 내에서 특정 상황에서 알아서 (python manage.py ~ 명령어를 터미널에 따로 입력하지않아도) 이메일을 보내게 하려는 것이라면 어떻게 커맨드로 설정해놓은 저 부분을 실행시키는지 궁금합니다.
학습하는 분들께 도움이 되고, 더 좋은 답변을 드릴 수 있도록 질문 전에 다음을 꼭 확인해주세요. 1. 강의 내용과 관련된 질문을 남겨주세요. 2. 인프런의 질문 게시판과 자주 하는 질문(링크)을 먼저 확인해주세요. (자주 하는 질문 링크: https://bit.ly/3fX6ygx) 3. 질문 잘하기 메뉴얼(링크)을 먼저 읽어주세요. (질문 잘하기 메뉴얼 링크: https://bit.ly/2UfeqCG) 질문 시에는 위 내용은 삭제하고 다음 내용을 남겨주세요. ========================================= [질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예/아니오) 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예/아니오) [질문 내용] 21 버전의 자바를 사용 중입니다. .close()를 하여도 pool의 개수가 0개로 변경되지 않습니다. main 스레드에서 인지하는데 시간이 걸리나 하여 sleep()을 통해 시간의 변화를 줬지만 여전히 동일한 결과값이 도출됩니다.
안녕하세요. 프로그램에 대한 지식이 없다보니 이것저것 내용을 보고 판단해서 작성한건데, 이렇게 하면 크게 문제가 없을까 싶어서 문의 드립니다. #1. 데이터불러오기 import pandas as pd train = pd.read _csv(r'C:\Users\user\Desktop\빅데이터분석기사 실기\8회\train.csv') test = pd.read _csv(r'C:\Users\user\Desktop\빅데이터분석기사 실기\8회\test.csv') #customerID, TotalCharges #불필요 삭제 train = train.drop('customerID', axis=1) test_ID = test.pop('customerID') #타켓 지정 target = train.pop('TotalCharges') #원핫 라벨링 train = pd.get_dummies(train) test = pd.get_dummies(test) 이후 데이터분리 데이터학습 데이터검증
안녕하세요! 좋은 강의 감사합니다. 덕분에 원하는 홈페이지를 비교적(?) 쉽게 만들 수 있었습니다! 웹 페이지를 배포한 이후에 검색 최적화를 위해 google search console(구글 서치 콘솔)을 적용하고 싶습니다. 웹사이트 인증을 위해서는 html 파일 수정이 필요한데 방법을 잘 모르겠습니다... 혹시 좋은 방법이 있으실까요?ㅜㅜ
학습하는 분들께 도움이 되고, 더 좋은 답변을 드릴 수 있도록 질문전에 다음을 꼭 확인해주세요. 1. 강의 내용과 관련된 질문을 남겨주세요. 2. 인프런의 질문 게시판과 자주 하는 질문(링크)을 먼저 확인해주세요. (자주 하는 질문 링크: https://bit.ly/3fX6ygx) 3. 질문 잘하기 메뉴얼(링크)을 먼저 읽어주세요. (질문 잘하기 메뉴얼 링크: https://bit.ly/2UfeqCG) 질문 시에는 위 내용은 삭제하고 다음 내용을 남겨주세요. ========================================= [질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예) 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예) [질문 내용] em.getReference() 시 처음으로 영속성 컨텍스트에서 프록시 객체 반환 후 find() 메소드 호출하면 그대로 프록시 객체가 반환되는걸로 이해하였습니다. find()시 실제 DB에 접근하여 데이터를 가져오는데 이를 실제 엔티티에 저장하고 프록시 객체와 엔티티 객체를 연결짓는 부분만 초기화?(재설정) 하는건가요?! 초기화 라는 용어가 헷갈리고, 실제 DB 데이터를 어떻게 프록시 객체와 연결하는지 궁금합니다!
import pandas as pd df=pd.read_csv('members.csv') q3 = df['views'].quantile(0.75) q1= df['views'].quantile(0.25) IQR=q3-q1 cond = (df['views']<q1-1.5*IQR)|(df['views']>q3+1.5*IQR) print(sum(cond)) 스스로 풀었을 때 이렇게 적었는데, or로 엮어서 합계를 구해도 각 조건 마다 카운트 해서 값을 정확히 내는 게 맞을까요?
#모의문제 2 - 내가 푼 것 import pandas as pd df=pd.read_csv('members.csv') #print(df.info()) cond=df.dtypes=='object' #print(df.shape) df=df.drop(df.columns[cond],axis=1) df=df.fillna(0) #print(df.shape) #print(df.info()) cond2=df.sum(axis=1)>3000 print(len(df[cond2])) 이렇게 해도 정답 73으로 동일한데, 이렇게 풀어도 되는지 여쭙고싶습니다.
안녕하세요 선생님 좋은 강의 감사합니다. 저희 articleController에서 readAll 부분을 보면 @GetMapping("/v1/articles") public ArticlePageResponse findAll( @RequestParam("boardId") Long boardId, @RequestParam("page") Long page, @RequestParam("pageSize") Long pageSize ) { return articleService.readAll(boardId, page, pageSize); } 이런식으로 pageSize를 쿼리 파라미터로 넘겨주도록 설계가 되어 있는데, pageSize라는 파라미터는 값을 받아서 처리하는 것이 아니라, 서버에서 값을 정하고 항상 똑같은 pageSize를 써야하는 것 아닌가요 ?? 왜 pageSize를 인자로 받는지 이해가 잘가지 않습니다.