한 가지 방법 풀기
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
한 가지 방법으로 풀기로 문제를 풀었을 때는 ID 값이 없는데 Pred 값만 제출해도 되는걸까요?
- python
- 머신러닝
- 빅데이터
- pandas
- 빅데이터분석기사
172만명의 커뮤니티!! 함께 토론해봐요.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
한 가지 방법으로 풀기로 문제를 풀었을 때는 ID 값이 없는데 Pred 값만 제출해도 되는걸까요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
Labels in y_true and y_pred should be of the same type. Got y_true=[0 1] and y_pred=['0' '1']. Make sure that the predictions provided by the classifier coincides with the true labels. 이런 문장이 뜨던데 accuracy_score(ans, pred) 중 pred가 numpy.ndarray 배열이 된 것 같거든요.. 잘 따라한 것 같은데 선생님이 한건 바로 accuracy_score를 바로 볼 수 있고, 제거는 못보여 지네요.. pd.DataFrame(pred) 사용해서 해결하긴 했는데,, numpy배열로 바뀐 사유가 궁금합니다. y_train['income'] = y_train['income'].str.replace(">50K", '1') y_train['income'] = y_train['income'].str.replace("<=50K", '0') y_train['income'].astype(int) from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier() rf.fit(X_train[list], target) pred = rf.predict(X_test[list]) submit = pd.DataFrame( { 'id' : X_test['id'], 'income' : pred } ) submit.to_csv("1111.csv", index = False) y_test.head() (y_test['income']=='>50K').astype(int) from sklearn.metrics import accuracy_score y_test = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p2/data_atype_y/y_test.csv") ans = (y_test['income'] == '>50K').astype(int) pred = pred.astype(int) accuracy_score(ans, pred)
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
(y_test['income']=='>50K').astype(int) 로 코딩하면 바로 0 혹은 1의 값으로 바로 변경되던데요. 만약 3개 이상의 target 값이 있을경우 astype(int) 하게되면 0, 1, 2 로 3개가 생기는 걸까요?
미해결
실전! 스프링 부트와 JPA 활용1 - 웹 애플리케이션 개발
학습하는 분들께 도움이 되고, 더 좋은 답변을 드릴 수 있도록 질문전에 다음을 꼭 확인해주세요. 1. 강의 내용과 관련된 질문을 남겨주세요. 2. 인프런의 질문 게시판과 자주 하는 질문(링크)을 먼저 확인해주세요. (자주 하는 질문 링크: https://bit.ly/3fX6ygx) 3. 질문 잘하기 메뉴얼(링크)을 먼저 읽어주세요. (질문 잘하기 메뉴얼 링크: https://bit.ly/2UfeqCG) 질문 시에는 위 내용은 삭제하고 다음 내용을 남겨주세요. ========================================= [질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예/아니오) 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예/아니오) [질문 내용] 여기에 질문 내용을 남겨주세요. 안녕하세요 강사님 강의 정말 잘 듣고있습니다. package jpabook.jpashop.domain; import jakarta.persistence.*; import jpabook.jpashop.domain.item.Item; import lombok.Getter; import lombok.Setter; import static jakarta.persistence.FetchType.*; @Entity @Getter @Setter public class OrderItem { @Id @GeneratedValue @Column(name = "order_item_id") private Long id; @ManyToOne(fetch = LAZY) @JoinColumn(name = "item_id") private Item item; @ManyToOne(fetch = LAZY) @JoinColumn(name = "order_id") private Order order; private int orderPrice; private int count; //==비즈니스 로직==// public void cancel() { getItem().addStock(count); } public int getTotalPrice() { return getOrderPrice() * getCount(); } } 비즈니스 로직인 cancel()과 getTotalPrice()에 대한 질문인데요 한쪽은 getter을 사용했고 다른 한쪽은 그냥 필드값을 넣었는데 혹시 이렇게 차이가 생기는 이유가 있을까요 ? getTotalprice는 getter로 orderprice와 count를 가져오지만 cancel에서는 그냥 count 필드값을 쓰는데의 차이점이 궁금합니다.
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요 6회 기출문제 3번을 풀다가 궁금한점이 생겨서 문의 드립니다. 아래와 같은 데이터가 있을 때 '날짜'와 '경찰서 명'은 object 입니다. 위 데이터에서 '강력범죄' 부터 '교통범죄'까지 데이터를 행으로 총합을 구할 시에 아래와 같이 iloc를 설정을 한다고 풀이와 강의에 나와있습니다. df['총범죄건수'] = df.iloc[:, 1 : -1].sum(axis =1) 여기에서 iloc 에서 '-1' 이라고 설정하는 것은 제일 끝 열까지 설정하는 것이 아닌지요? 그러면 '경찰서명'까지 선택이 되어야하는데 로그를 찍어보면 '강력범죄'~'교통범죄'까지 나오는 것을 확인할 수있습니다. 강의에서는 iloc는 0부터 세기 때문에 바로 전까지 값의 열이 선택된다고 알려주셨고, -1로 하면 끝의 열을 나타내는 것이고 -2를 하면 끝열 바로 전 열을 선택하는 것이라고 알려주셔서 알고있습니다. 그런데 위에 데이터에서는 왜 -1을 해도 '경찰서명'까지가 안나오는 것인지 문의드립니다.
미해결
스프링 MVC 2편 - 백엔드 웹 개발 활용 기술
안녕하세요. 강의 '서블릿필터-인증체크' 08:25 에서 질문있습니다. 질문1) @Slf4j public class LoginCheckFilter implements Filter { private static final String[] whitelist = {"/", "/members/add", "/login", "/logout", "/css/*"}; @Override public void doFilter(ServletRequest request, ServletResponse response, FilterChain chain) throws IOException, ServletException { HttpServletRequest httpRequest = (HttpServletRequest) request; String requestURI = httpRequest.getRequestURI(); HttpServletResponse httpResponse = (HttpServletResponse) response; try { log.info("인증 체크 필터 시작 {}", requestURI); if (isLoginCheckPath(requestURI)) { log.info("인증 체크 로직 실행 {}", requestURI); HttpSession session = httpRequest.getSession(false); if (session == null || session.getAttribute(SessionConst.LOGIN_MEMBER) == null) { log.info("미인증 사용자 요청 {}", requestURI); httpResponse.sendRedirect("/login?redirectURL=" + requestURI); return; //여기가 중요, 미인증 사용자는 다음으로 진행하지 않고 끝! } } chain.doFilter(request, response); } catch (Exception e) { throw e; //예외 로깅 가능 하지만, 톰캣까지 예외를 보내주어야 함 } finally { log.info("인증 체크 필터 종료 {}", requestURI); } } /** * 화이트 리스트의 경우 false 즉, 인증 체크X * true시 인증 체크O */ private boolean isLoginCheckPath(String requestURI) { return !PatternMatchUtils.simpleMatch(whitelist, requestURI); } } 수업에 사용된 위 코드에서 try~catch를 해줘야 한다는 것을 어떻게 인지하고 사용할 수 있는지 궁금합니다. 예외처리에 무감각하게 되면 try~catch없이 개발을 할 때가 많았는데요. 지금도 마찬가지로 왜 try~catch가 필요한지 알지 못합니다. 질문2) catch구문에서 throw e; 를 하여 서블릿단에서 톰캣으로 예외를 보내줘야하는 이유도 궁금합니다. (강사님께서 이유를 말씀해주시지 않았습니다.) 보통 try~catch구문을 사용하지 않으면 에러가 발생했을 때 발생한 위치에서 요청이 종료되고 500에러를 응답하는 것으로 알고있습니다. try~catch를 쓰고 catch구문에서 로그만 남기면 200정상이 될 것이지만 try~catch를 쓰고 catch구문에서 톰캣에게 throw를 하게된다면 여전히 500응답합니다. 위 세 케이스 중에 로그를 남길 수 있고 동시에 500에러를 클라이언트에게 보낼 수 있는 방법으로 세 번째 방식이 채택된 것인지 궁금합니다.
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
한 셀에 푸는 연습을 하고 있는데 갑자기 KeyError : 'TravelInsurance'가 뜹니다. 왜일까요? 그리고 시험장에서 한 셀에서 모두 실행할 때 전처리 작업 모두 print()붙이면서 각각의 값을 도출해야하는지 print없이 값만 확인해도 되는지 궁금합니다.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
위와 같이 작성해주신 코드를 보는 중 의문이 생겨 질문 남깁니다! train 데이터를 전처리할 때에는 train데이터의 최빈값, 중앙값, 평균으로 결측치를 대체하는데 반해, test 데이터 전처리 시 범주형 데이터는 test 데이터의 최빈값으로 대체/ 수치형 데이터는 train 데이터의 평균, 중앙값으로 대체하고 있습니다. 왜 test 데이터 처리 시 train/test 데이터 모두 다 사용하나요? 일관성 있게 하나만 사용해서는 안되는지 궁금합니다.
미해결
제 컴퓨터에서 프로젝트 관련 플라스크 코드와 그 외 템플릿 등등을 작성했고 그 모든 폴더가 있는 전체 폴더를 압축해서 팀원에게 넘겼습니다. 이후 팀원이 압축을 풀고 똑같이 터미널에서 해당 폴더가 있는 경로로 이동 후, python app.py 명령어와 flask run 명령어 모두 실행해보았지만 Python 이라는 메시지만 나올 뿐, 실행도 오류 메시지도 출력되지 않고 있는 상황입니다. 설정도 다 맞게 해놨고 제 컴퓨터에서는 잘만 돌아가는데 뭐가 문제일까요...? 당연히 팀원도 플라스크 install 했습니다.
미해결
김영한의 실전 자바 - 고급 1편, 멀티스레드와 동시성
학습하는 분들께 도움이 되고, 더 좋은 답변을 드릴 수 있도록 질문 전에 다음을 꼭 확인해주세요. 1. 강의 내용과 관련된 질문을 남겨주세요. 2. 인프런의 질문 게시판과 자주 하는 질문(링크)을 먼저 확인해주세요. (자주 하는 질문 링크: https://bit.ly/3fX6ygx) 3. 질문 잘하기 메뉴얼(링크)을 먼저 읽어주세요. (질문 잘하기 메뉴얼 링크: https://bit.ly/2UfeqCG) 질문 시에는 위 내용은 삭제하고 다음 내용을 남겨주세요. ========================================= [질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예/아니오) 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예/아니오) [질문 내용] volatile이라는 키워만 (X) => volatile이라는 키워드만 (O) 추가로 오탈자나 조금 어색한 문장들이 보였는데 그런게 보일때마다 어디로 공유드리면 될까요?
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
df.groupby(['city','f2']).sum().reset_index() 이 코드문을 작성했을떼 id, f3과 같은 문자열 데이터도 같이 들어가서 선생님께서 하신 코드와 다르게 나옵니다. 그래서 따로 숫자형 데이터만 묶어서 그룹을 만든 다음 해결을 하긴 했는데, 선생님과 똑같이 했을땐 왜 같게 안나오는건지, 버젼이 바뀐건지 궁금해 여쭤봅니다
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요, 독립표본검정 시 정규성을 만족하나 등분산성을 만족하지 않는 경우 equal_var = False라는 파라미터를 추가한다고 가르쳐주셨는데요, 분산분석에서도 정규성은 만족하였으나 등분산성을 만족하지 않는 경우 추가해야 하는 조건이 있는지 문의드립니다. 학습에서 정규성을 만족하지 않을 경우 kruskal-wallis 비모수검정을 활용한다고 말씀해주셨는데, 등분산성을 만족하지 않는 경우는 설명이 되지 않은 듯 해서요.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요. MinMaxScaler하는데 qsec을 인지하지 못했다는 에러가 뜨네요. 어떤 부분이 잘 못 되었는지 알 수 있을 까요? 자료는 df=pd.read_csv("mtcars.csv")코드를 통해 내려받아서 head확인하였습니다.
해결됨
김영한의 실전 자바 - 중급 2편
학습하는 분들께 도움이 되고, 더 좋은 답변을 드릴 수 있도록 질문전에 다음을 꼭 확인해주세요. 1. 강의 내용과 관련된 질문을 남겨주세요. 2. 인프런의 질문 게시판과 자주 하는 질문(링크)을 먼저 확인해주세요. (자주 하는 질문 링크: https://bit.ly/3fX6ygx) 3. 질문 잘하기 메뉴얼(링크)을 먼저 읽어주세요. (질문 잘하기 메뉴얼 링크: https://bit.ly/2UfeqCG) 질문 시에는 위 내용은 삭제하고 다음 내용을 남겨주세요. ========================================= [질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예/아니오) 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예/아니오) [질문 내용] 안녕하세요. stack 2번째, 문제 풀이 를 보면서 궁금증이 생겨서 질문을 남깁니다. 문제 풀이를 듣던 도중에 영한 님이 history를 만들 때, ArryDeque를 이용해서 만들었던 것을 볼 수 있었습니다. 그러다가 계속 듣다 보니까 갑자기 이런 생각이 들더라고요.(어떤 분이 '자바 성능 비교 표' 올린 영향도 있습니다.) '앞으로만 추가하니 LinkedList가 더 빠르지 않을까?' 라는 생각 이요. 그런데 ArrayDeque를 왜 사용했을까? 생각 해보니 '앞으로만 추가 하지만, 여러 가지 이용할게 더 많아서 ArrayDeque 를 사용 했다.' 인데 이것도 추측이라서 정확하지 않네요. 그래서 LinkedList 대신 ArryDeque를 사용한 이유를 자세히 알고 싶습니다. 답변 부탁 드립니다.
미해결
김영한의 실전 자바 - 중급 2편
직접 구현하는 Set1 - MyHashSetV1 강의중 public class MyHashSetV1 { static final int DEFAULT_INITIAL_CAPACITY = 16; LinkedList<Integer>[] buckets; private int size = 0; private int capacity = DEFAULT_INITIAL_CAPACITY; public MyHashSetV1() { buckets = new LinkedList[capacity]; for (int i = 0; i < capacity; i++) { buckets[i] = new LinkedList<>(); } } 이렇게 생성자에 객체를 생성하는데 클래스 필드에 객체를 생성하지 않고 생성자 안에서 생성하는 이유가 무엇인지 궁금해서 문의드립니다.
미해결
김영한의 실전 자바 - 기본편
문제만 보고 풀었을 때, Rectangle 이렇게 정의하고 RectangleOopMain에서 이렇게 작성했는데, 이렇게 문제를 풀이해도 객체지향으로 변경한게 맞나요? 실행시켰을 때 값은 동일하게 나와서 정답인 줄 알았는데, 문제 풀고 강의 들어보니 정답과 달라서 궁금합니다.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
RandomForestRegressor 실행할때 마다 성능평가값이 달라집니다. 반복해서 실행하니, 처음보다 유의미하게 수치가 낮아졋습니다. 강의에서는 스케일링 한거 보다 베이스라인이 성능평가가 더 낫다고 하는데, minmaxsclaler 를bmi 만 한 성능평가 수치가 가장 좋습니다. 질문1) 랜덤포레스트는 원래 돌릴때마다 성능이 좋아지나요? 질문2) 시험환경에서는 랜덤포레스트를 반복해서 실행하면 안되나요? (성능평가 결과가 좋아져서 신뢰성 하락이 되나요?
미해결
김영한의 실전 자바 - 고급 1편, 멀티스레드와 동시성
계속해서 영한님 강의를 들으니 이해도 잘되고 재미도 있어서 제가 백엔드 개발자가 되기 위해 계속 노력할 수 있는 것 같습니다. 궁금한점은 제가 코딩테스트 문제를 계속 연습하고있는데 거기서 stream/lambda 식이 많이 활용되어서 이대로는 풀으나 마나라고 생각해서 먼저 그부분부터 알고자 학습을 진행중입니다. 혹시 스트림/람다 강의는 언제 열리는지랑 지금 과정을 알아여지 람다/스트림 과정의 이해가 쉬워지는 지 궁금합니다.
해결됨
스프링 MVC 2편 - 백엔드 웹 개발 활용 기술
안녕하세요. BindingResult의 reject 메소드시그니처를 확인하려고 합니다. ctrl + 클릭 으로 정의된 곳으로 이동하니 Errors 인터페이스로 이동했습니다. 이때 시그니처가 아쉽게도 void reject(String errorCode, @Nullable String defaultMessage); 아니라 위 그림처럼 var1, var2로 되있습니다. 강사님께서 강의하실 땐 전자처럼 파라미터변수명이 ctrl + p 로 확인할 수 있었던것 같습니다. 저도 동일한 환경을 만들고 싶은데요. 유용한 방법이 있는지 궁금합니다.
미해결
김영한의 실전 자바 - 고급 1편, 멀티스레드와 동시성
(사진)