inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

172만명의 커뮤니티!! 함께 토론해봐요.

작업형 2번 test 데이터 행 삭제에 관해 문의드립니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

작업형 2번을 풀 때, test 데이터의 행은 절대 삭제하면 안되고, 삭제할 경우 0점 처리를 맞는다고 알고 있습니다. 제가 말의 뜻을 정확하게 이해를 못해서 그런데, 혹시 제가 이해한 것이 맞는지 한 번만 확인해주시면 감사하겠습니다. [제가 이해한 뜻] 1번 상황) 예를들어 처음에 train, test 데이터가 주어졌습니다. train.shape, test.shape으로 찍었을 때, (10000,10), (2000,9)가 나왔습니다. 전처리를 통해서, train과 test의 불필요한 컬럼, 결측치가 너무 많은 컬럼을 삭제하였습니다. 그 이후 train.shape, test.shape을 찍었을 때, (10000,8), (2000,7) 이 나왔습니다. 2번 상황) 전처리 하기 전 train.shape이 (2000,9) 가 전처리 후 train.shape이 (1800,7) 이 나왔습니다. 제가 이해하기로, 1번 상황처럼 train과 test의 동일한 컬럼을 삭제하는 것은 상관 없는데, 2번 상황처럼, test의 행 데이터가 손실되는 것은 안되는 걸로 이해했습니다. 혹시 제가 이해한 것이 맞는지 봐주시면 정말 감사하겠습니다..!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
하동주 댓글 1 좋아요 0 조회수 153

캐글 t1-12 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

df2 = df.groupby('country').max() #시간에 따라 접종률이 점점 올라감 df2 = df2.sort_values(by='ratio', ascending = False) 여기서 df.groupby('country')['ratio'].max() 를 하지 않고 그냥 max()를 한 이유가 뭔가요? 접종률 상위 10개국, 하위 10개국을 찾는게 아닌가요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
빅분기1202 댓글 2 좋아요 0 조회수 164

질문있습니다

해결됨

김영한의 실전 자바 - 기본편

public class BabyDog extends Dog{ @Override public void sound() { System.out.println("낑낑"); } } BabyDog라는 클래스를 만들고 Dog를 상속받았을경우 메인클래스에서 soundAnimal(dog)를했을때 제가생각하는 이미지는 sound() Animal sound() Dog sound() BabyDog 이렇게돼서 결국 맨아래 BabyDog sound가불려서 낑낑이나올거같은데 멍멍이나오더라구요 어떤점을 잘못이해한건지 알려주실수있을까요?

  • java
  • 객체지향
Choi 댓글 1 좋아요 1 조회수 231

3유형 풀때...

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

선생님 대부분 3유형에서는from scipy import stats 불러오구 stats.levene~ , stats.wilcoxn 이렇게 등등 다 불러오던데f_oneway만 import scipy.stats as stats 이렇게 불러오는거로 가르쳐 주시던데 from scipy import statsstats.f_oneway(그룹A,B,C) 이렇게 해도 분석이 되는거 같은데 이렇게 불러두 되나요? 어떤건 from scipy.stats as stats이고어떤건 from scipy import stats 여서 좀 헷갈리더라구요 ㅠㅠ 또 카이제곱은 from scipy.stats import Chisquare 이런형태구...from scipy import Chisquarestats.Chisquare(df['a'],df['b']) 이렇게 해두 되나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
moonwrd 댓글 2 좋아요 0 조회수 262

"비밀번호" 문제 확인 부탁드립니다!

미해결

자바 코딩테스트 - it 대기업 유제

안녕하세요! 비밀번호 문제를 다음과 같이 풀었는데 확인 한번 부탁드려도될까요~? class Solution { public int solution(int[] keypad, String password) { int answer = 0; char[] pw = password.toCharArray(); int[] index = new int[pw.length]; for (int i = 0; i < 9; i++) { for (int j = 0; j < pw.length; j++) { if (pw[j] - '0' == keypad[i]) { index[j] = i; } } } for (int i = 0; i < index.length - 1; i++) { int curr = index[i]; if (curr == index[i + 1]) { continue; } if (curr % 3 == 0) { // left if (index[i + 1] - curr == -3 || index[i + 1] - curr == -2 || index[i + 1] - curr == 1 || index[i + 1] - curr == 3 || index[i + 1] - curr == 4) { answer++; } else { answer += 2; } } else if (curr % 3 == 1) { // center if (index[i + 1] - curr >= -4 && index[i + 1] - curr <= 4) { answer++; } else { answer += 2; } } else if (curr % 3 == 2) { // right if (index[i + 1] - curr == -4 || index[i + 1] - curr == -3 || index[i + 1] - curr == -1 || index[i + 1] - curr == 2 || index[i + 1] - curr == 3) { answer++; } else { answer += 2; } } } return answer; } public static void main(String[] args) { Solution T = new Solution(); System.out.println(T.solution(new int[]{2, 5, 3, 7, 1, 6, 4, 9, 8}, "7596218")); System.out.println(T.solution(new int[]{1, 5, 7, 3, 2, 8, 9, 4, 6}, "63855526592")); System.out.println(T.solution(new int[]{2, 9, 3, 7, 8, 6, 4, 5, 1}, "323254677")); System.out.println(T.solution(new int[]{1, 6, 7, 3, 8, 9, 4, 5, 2}, "3337772122")); } } 0 1 2 3 4 5 6 7 8 패스워드의 각 문자에 대해 인덱스 번호를 구한 뒤 왼쪽, 가운데, 오른쪽임에 따라 다음 값과의 차이를 비교하여 +1인지 +2인지 구분하는 형태로 코드를 작성해봤습니다. 강사님이 풀이해주신 방식과는 다소 차이가 있어보여서 어떤 방식이 괜찮은지 혹은 위 방식에 문제점이 있는지 궁금하여 질문 올려봅니다

  • java
  • 코딩-테스트
주노 댓글 1 좋아요 0 조회수 193

range를 꼭 써야하나요 ?

미해결

[신규 개정판] 이것이 진짜 크롤링이다 - 실전편 (인공지능 수익화)

for i in (1,2): 2페이지까지 도는 문법이 이렇게만 작성해도 되던데 range를 꼭 적어줘야하나요 ?

  • python
  • 웹-크롤링
hm_stom 댓글 1 좋아요 0 조회수 184

유형2번 코드 작성해보았는데...

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

# 시험환경 세팅 (코드 변경 X) import pandas as pd import numpy as np from sklearn.model_selection import train_test_split def exam_data_load(df, target, id_name="", null_name=""): if id_name == "": df = df.reset_index().rename(columns={"index": "id"}) id_name = 'id' else: id_name = id_name if null_name != "": df[df == null_name] = np.nan X_train, X_test = train_test_split(df, test_size=0.2, random_state=2021) y_train = X_train[[id_name, target]] X_train = X_train.drop(columns=[target]) y_test = X_test[[id_name, target]] X_test = X_test.drop(columns=[target]) return X_train, X_test, y_train, y_test df = pd.read_csv("../input/titanic/train.csv") X_train, X_test, y_train, y_test = exam_data_load(df, target='Survived', id_name='PassengerId') X_train.shape, X_test.shape, y_train.shape, y_test.shape #Survived예측 print(X_test.shape) target=y_train['Survived'] test_id=X_test['PassengerId'].copy() test=X_test train=X_train print(train.shape, test.shape) train=train.drop('PassengerId', axis=1) test=test.drop('PassengerId', axis=1) train=train.drop('Name', axis=1) test=test.drop('Name', axis=1) print(train.shape, test.shape) #합치기 df=pd.concat([train, test]) df['Age']=df['Age'].fillna(df['Age'].mean()) df['Cabin']=df['Cabin'].fillna(df['Cabin'].mode()[0]) df['Embarked']=df['Embarked'].fillna(df['Embarked'].mode()[0]) #인코딩 from sklearn.preprocessing import LabelEncoder cols=df.select_dtypes(include='O').columns for col in cols: le=LabelEncoder() df[col]=le.fit_transform(df[col]) #쪼개기(712, 179) train=df[:712] test=df[712:] print(train.shape, test.shape) print(target.shape) from sklearn.model_selection import train_test_split x_tr, x_val, y_tr, y_val=train_test_split(train, target, test_size=.2, random_state=2022) from sklearn.ensemble import RandomForestClassifier rf=RandomForestClassifier(random_state=2022) rf.fit(x_tr, y_tr) pred=rf.predict(test) print(pred) print(pred.shape) print(len(test_id)) submit=pd.DataFrame({ 'PassengerId': test_id, 'Survived': pred }) submit.to_csv('수험번호.csv', index=False) print(submit.shape) 캐글 타이타닉 보고 이렇게 작성해보았는데, 혹시 0점 될만한 요인이 있을까요??ㅠㅠ test데이터 행 수 하고 pred수 하고 동일한거 확인했습니다! 그리고 제출할때는 split로 안쪼개고 바로 fit(train, target)해서 predict(test)해도 되는 부분일까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
한정수 댓글 1 좋아요 0 조회수 152

작업형2 기출 2회

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

기출 한 가지 방법 풀기에는 수치형, 범주형 분리 & 로버스트 스케일 작업이 없고 바로 get_dummies가 나오는데, 실전에서 바로 get_dummies를 사용해도 상관없는지 궁금합니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
정원 댓글 1 좋아요 0 조회수 162

EDA 카테고리 비교 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요! 기출(작업형2) 한가지 방법으로 풀기 13분쯤에 print("\n ===== 카테고리 비교 =====") print(train.describe(include='O')) print(test.describe(include='O')) 이 코드가 있는데 이 코드는 회귀인 경우에만 사용하는 건가요? EDA라서 생략을 해도 되는 것 같긴 한데, 어떤 때 사용하는지 그리고 목적이 무엇인지 궁금합니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
베리 댓글 1 좋아요 0 조회수 208

target, 즉 우리가 예측하려는 값이 범주형인 경우

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 target 값은 절대로 절대로 인코딩해서는 안되나요? ? 그냥 아묻따 전처리 때 분리하는 것이 가장 좋겠죠??

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
wanzy123 댓글 1 좋아요 0 조회수 201

인텔리제이에서 경고 표시가 수업 화면과 다르게 나오는 현상

미해결

김영한의 실전 자바 - 중급 1편

실제로 코드를 치면 이렇게 형광펜처럼 경고 표시가 나오는데 강의 화면에서는 밑줄로만 표시되어서요! 혹시 설정을 따로 진행하신걸까요? ========================================= [질문 템플릿] 1. 강의 내용과 관련된 질문인가요? (예/아니오) 2. 인프런의 질문 게시판과 자주 하는 질문에 없는 내용인가요? (예/아니오) 3. 질문 잘하기 메뉴얼을 읽어보셨나요? (예/아니오) [질문 내용] 여기에 질문 내용을 남겨주세요.

  • java
  • 객체지향
맥스 댓글 1 좋아요 0 조회수 234

기출 6회- 작업형 1 2번문제

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요 선생님! 2번문제에서 1~6학년까지의 학생수 합을 구하고 그걸 교사수로 나누는 부분에서 이렇게 강의와 똑같이 코딩을 하였는데 sum() 아래의 식이 출력되면서 실행할 때마다 전체학생수가 계속 늘어나더라구요,, 이건 왜 그런걸까요? sum식을 한번 써주고 주석처리해야하는걸까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
박나현 댓글 1 좋아요 0 조회수 178

RestController와 view 관련하여 질문있습니다.

미해결

안녕하세요. 개인 프로젝트를 진행하다 이해가 안되는 부분이 있어서 질문드립니다. 맛집 서비스를 위한 REST API (HTTPS)를 구성하는 프로젝트로, 맛집 정보들은 DB를 사용하여 관리 REST API는 CRUD 연산을 제공 할 것입니다. 일단 프론트단을 제외하고 백만 개발한거라 @RestController를 사용해서 테스트를 끝냈는데, 이제 프론트까지 개발하려고 하니 @RestController는 json 형식으로 데이터를 받잖아요. 화면을 생성해야하는데 @RestController와 별개로 새로운 클래스를 생성하여 @Controller를 붙여 뷰단만 따로 관리하는 컨트롤러를 생성하는게 좋을까요? @RestController는 REST API를 관리하는 컨트롤러, @Controller는 화면단만 관리하는 컨트롤러로 각각 생성하는게 좋은건지 아니면 개발했던 @RestController에 ModelAndView를 활용하는 것 중 뭐가 더 나은건지? 궁금해요. 찾아보니 RestController에 화면을 줄때 자바스크립트나 ajax를 사용하는 방법이 있긴한데 보통 뭐를 더 사용하고 뭐가 더 좋은지 궁금합니다.

  • springboot
  • java
  • restcontroller
  • controller
고구마 댓글 3 좋아요 0 조회수 383

기본값 타입에 식별자도 포함되는지

해결됨

자바 ORM 표준 JPA 프로그래밍 - 기본편

JPA에서는 데이터 타입을 톱레벨에서 2가지, 엔티티 타입과 값 타입으로 분류한다고 하는데 식별자도 값 타입 중 기본값 타입으로 분류되는 것이 맞나요? 예를 들어 Member 엔티티에 식별자인 memberId와 필드인 name, age가 있다면 memberId, name, age 모두 기본값 타입인 것인지 궁급합니다. 당연한 질문일 수도 있겠지만, 설명하실 때와 강의자료에서 모두 식별자가 기본값 타입이라는 언급을 안하시는 것 같아서 예외적인 부분인가 하여 질문합니다.

  • java
  • jpa
WOOKI 댓글 1 좋아요 0 조회수 196

시계열데이터 변환시 (to_datetime) format을 형식 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 시계열데이터 변환시 (to_datetime) format을 형식 질문드립니다 년도, 월, 일 을 나눈는 기준이 %인거같고 사이사이 형식(월,-,/)과같은걸 어디에 넣는지와와 순서가 헷갈려서요 강의시 데이터중 data5컬럼은 변환시 바로 잘바뀌었는데 만약을위해 format을 쓴다면 df['Date4'] = pd.to _datetime(df['Date4'],format = '%d-%m-%Y') 오류가 납니다. 같은 방식으로 DateTime3, DateTime4 도 format을 사용시 어떻게 사용해야할지?? 머가 문제인건지?? 해결 방법을 여쭙니다

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김라온 댓글 1 좋아요 0 조회수 218

예측 임계값

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

임계값 관련해서 헷갈리는 점이 있어 문의 남깁니다. 예를들어 예측에 대한 임계값이 0.5라고 한다면 (pred >= 0.5).astype(int)로 봐야할지 (pred > 0.5).astype(int)로 봐야할지 궁금합니다. 임계값 자체를 포함해서 봐야하는걸까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
nahye1137 댓글 1 좋아요 0 조회수 162

2유형 오류

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

2차원 형태로 해야 출력이 되고, 그냥 평상시처럼 열만 뽑으면 이런 에러가 뜹니다.. 4회 기출에서만 이런 현상이 생기네요.. 원인이 뭘까요..

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
sso03046 댓글 2 좋아요 0 조회수 186

작업형2유형 답안제출시

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

답안제출시 자기 수험번호를 파일명으로해서 제출하는건가요? 아니면 result.csv라는 파일명으로 제출하는건가요? result.csv로 제출하면 누가 제출했는지 알수 없을텐데, 이게 궁금합니다.

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
지월목박 댓글 4 좋아요 0 조회수 264

7회 기출문제 작업형3에서..

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

1-2번) model = glm(formula, data=train, family=sm.families.Binomial()).fit() 를 실행하면 TypeError: 'module' object is not callable 이런 에러가 나오는데 원인이 뭘까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
Jihoon Park 댓글 2 좋아요 0 조회수 303

dslContext 작성 시 fetchGroups 이렇게 작성해도 될까요?

해결됨

실전 jOOQ! Type Safe SQL with Java

fun findActorFilmography(searchOption: ActorFilmographySearchOption): List<ActorFilmography> { val actorListMap = dslContext.select( ACTOR, FILM, ).from(ACTOR) .join(FILM_ACTOR).on(ACTOR.ACTOR_ID.eq(FILM_ACTOR.ACTOR_ID)) .join(FILM).on(FILM.FILM_ID.eq(FILM_ACTOR.FILM_ID)) .where( containsIfNotBlank(ACTOR.FIRST_NAME.concat(" ").concat(ACTOR.LAST_NAME), searchOption.actorName), containsIfNotBlank(FILM.TITLE, searchOption.filmTitle), ) // 이 부분!! .fetchGroups( { record -> record[ACTOR.name, Actor::class.java] }, { record -> record[FILM.name, Film::class.java] } ) return actorListMap.entries .map { entry -> ActorFilmography(entry.key, entry.value) } } private fun containsIfNotBlank(field: Field<String?>, inputValue: String?): Condition { if (inputValue.isNullOrBlank()) { return DSL.noCondition() } return field.likeRegex(inputValue) } alias을 사용하지 않고, name으로 추출해봤더니 데이터가 정상적으로 잘 나와서요!! 혹시나 예외 케이스도 있을 수 있을 것 같아 질문합니다!

  • java
  • sql
  • spring-boot
  • jooq
  • dsl
chhong 댓글 6 좋아요 2 조회수 700

인기 태그

인프런 TOP Writers

주간 인기글