172만명의 커뮤니티!! 함께 토론해봐요.
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 지난번에 고민있어요에 올렸다가 질문 카테고리에 올리라고 하셔서 고민이지만 질문에 적어봅니다! 현재 강사님 책을 2025년 버전으로 가지고 있고, 인강은 1회 완강을 하고, 1유형, 3유형은 기출로, 2유형은 기출 + 캐글 competition에서 learner단계..? beginner단계..? 쉬운거 참여 하면서 처음 보는 데이터에 익숙해지려고 그냥 무한 반복 코딩 하고 있습니다. 근데 인강만 1회 완강했지, 책에 있는 개념이나 문제는 보지 않은 상태인데요, 시험 12일 남은 지금 시점에서 책을 한번이라도 봐야하는지, 혹은 기출 무한반복하면서 2유형은 competition 계속 새로운거 도전하는게 더 합격 확률을 높이는건지 궁금합니다! 책이 있으면서 안본게 계속 마음에 걸려서요 ㅠ_ㅠ 그나저나 진짜 예시문제 2유형 오류 아니면 어쩌지 하면서 엄청 스트레스 받고, 진짜 허탈하고 의욕 사라졌었는데 오류인거 알아주시고 업데이트되었다고 칼소식 알려주셔서 너무 감사해요ㅠㅠ 이번이 1트이자 마지막 시험으로 강사님 믿고 합격길 달려보려고 합니다!! 빅분기 공부하는 매 순간 감사드립니다!
python 머신러닝 빅데이터 pandas 빅데이터분석기사
뚜뚜
2025-06-09T13:14:14.880Z
댓글 2
좋아요 0
조회수 56
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
여기서 선생님의 코드와 똑같이 작성했는데 오류가 발생합니다. 그래서 아래의 코드와 같이 작성하면 선생님의 답안과는 다른 결과값이 나와서 문의 드립니다 df.quantile(.75,numeric_only=False)
python 머신러닝 빅데이터 pandas 빅데이터분석기사
김지수
2025-06-09T13:11:20.590Z
댓글 1
좋아요 0
조회수 52
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
A하고 B 둘중에 한개만 정규성 만족하면 ttest를 해도되나요? 아니면 한개만 만족할때는 맨휘트니유 써야하나요?
python 머신러닝 빅데이터 pandas 빅데이터분석기사
황증조
2025-06-09T13:07:46.685Z
댓글 2
좋아요 0
조회수 32
해결됨
Azure Native로 나만의 GPT 만들기
안녕하세요~ 먼저 좋은 강의를 무료로 공개해주셔서 감사드립니다 다름이 아니라 제 현재 수준이 기초CS나 백엔드 등의 지식이 전무하다보니 강의를 보면서 따라해보고는 있지만 무슨 내용인지 모른 상태로 따라쳐보고만 있고 이슈가 발생하면 막히면서 진행하는데 차질이 큰데 일단 몰라도 쭉 따라가는게 괜찮을까요?? 공부 방법을 어떻게 하면 좋을지 궁금하여 문의드립니다.
javascript python mongodb azure FastAPI
두루미
2025-06-09T12:48:09.220Z
댓글 3
좋아요 0
조회수 139
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
1. 코드 import pandas as pd df = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/refs/heads/main/p4/7_1/air_quality.csv") # Q1,Q3,IQR 구하기 Q1 = df['CO2'].quantile(0.25) Q3 = df['CO2'].quantile(0.75) # print(df.describe()) # print(Q1,Q3) IQR = Q3 - Q1 # 상하한선 구하기 up = Q3 + 1.5 * IQR down = Q1 - 1.5 * IQR # 이상치 수 찾기 cond = (df['CO2'] > up) | (df['CO2']<down) cond.isnull().sum() 2. 결과값 np.int64(0) 3. 질문 제가 마지막에 cond.isnull().sum()로 썻더니 결과가 0이 나오고, df[cond]로 쓰면 선생님 영상처럼 답이 잘 처리됩니다. 제가 최초에 한 코드가 왜 답이 0이 나오는지 모르겟습니다
python 머신러닝 빅데이터 pandas 빅데이터분석기사
smrudsla
2025-06-09T12:44:27.752Z
댓글 2
좋아요 0
조회수 37
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요 기출 8회차 작업형 2문제인데요, 시험환경과 같이 한 곳에다가 코드를 입력하려고 연습을 하는 중이지만, drop 함수를 사용하고 재실행하면 오류가 발생하여 코드를 나눠서 작성하게 됩니다. 처음 데이터를 재실행하는 것 외에 해결방법이 없을까요? 시험환경에서는 코드를 한곳에 모두 작성해야되어서 걱정이 됩니다..
python 머신러닝 빅데이터 pandas 빅데이터분석기사
dltjdbs2002
2025-06-09T12:36:58.448Z
댓글 1
좋아요 0
조회수 76
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
19:25 여기서 listbox라는 이름에 값을 넣었는데, 함수 정의할 때 data라는 이름으로 정의된 것이 없는데도 어떻게 data가 listbox의 값을 불러오는 건가요? 이렇게 함수를 정의해도 되는거 아닌가요? def min_max(listbox): mi = min(listbox) ma = max(listbox) return mi, ma
python 머신러닝 빅데이터 pandas 빅데이터분석기사
2025-06-09T12:24:03.354Z
댓글 2
좋아요 0
조회수 65
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
#1. 문제탐색 # 회귀모델 csv id,price # target : price # R-Squared, MAE, MSE, RMSE, RMSLE, MAPE # 2. 데이터불러오기 import pandas as pd import numpy as np train = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p2/ab_nyc/train.csv") test = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p2/ab_nyc/test.csv") # train = pd.read_csv("train.csv") # test = pd.read_csv("test.csv") #3 데이터 탐색 #print(train.shape, test.shape) #print(train.head(3), test.head(3)) #print(train.isnull().sum(), test.isnull().sum()) #print(train.info(), test.info()) #4. 데이터 전처리 #print(train.shape, test.shape) cols = ['name', 'host_name', 'host_id'] train = train.drop(cols, axis =1 ) test = test.drop(cols, axis =1 ) #print(train.shape, test.shape) train['last_review'] = train['last_review'].mode(0) test['last_review'] = test['last_review'].mode(0) train['reviews_per_month'] = train['reviews_per_month'].fillna(0) test['reviews_per_month'] = test['reviews_per_month'].fillna(0) #변수부여 target = train.pop('price') train = train.drop('id', axis=1) id = test.pop('id') cols = train.select_dtypes(include = 'object').columns #print(train.shape, test.shape) #레이블인코딩 from sklearn.preprocessing import LabelEncoder for col in cols : le = LabelEncoder() train[col] = le.fit_transform(train[col]) test[col] = le.transform(test[col]) from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size = 0.2, random_state = 2) #6.모델 학습 및 평가 from sklearn.ensemble import RandomForestRegressor rf = RandomForestRegressor(random_state = 2) rf.fit(X_tr, y_tr) pred = rf.predict(X_val) from sklearn.metrics import r2_score, mean_absolute_error, mean_squared_error, mean_absolute_percentage_error mae = mean_absolute_error(y_val, pred) mse = mean_squared_error(y_val, pred) mape = mean_absolute_percentage_error(y_val, pred) rmse = np.sqrt(mean_squared_error(y_val, pred)) print(f"mae: {mean_absolute_error(y_val, pred)}") print(f"mse: {mean_squared_error(y_val, pred)}") print(f"mape: {mean_absolute_percentage_error(y_val, pred)}") pred = rf.predict(test) submit = pd.DataFrame({'id' : id, 'price' : pred}) submit.to_csv("0516.csv", index = False) pd.read_csv("0516.csv") 안녕하세요 모의문제 2-2번 레이블 인코딩으로 작성했는데 피드백주실 사항 있으실까요? 이 문제도 원핫인코딩으로 진행해야할까요?
python 머신러닝 빅데이터 pandas 빅데이터분석기사
이지웡
2025-06-09T12:19:02.015Z
댓글 3
좋아요 0
조회수 75
해결됨
윤재성의 자바 기반 안드로이드 앱개발 Part 1 - UI Programming
- 학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! - 먼저 유사한 질문이 있었는지 검색해보세요. - 서로 예의를 지키며 존중하는 문화를 만들어가요. - 잠깐! 인프런 서비스 운영 관련 문의는 1:1 문의하기를 이용해주세요. <?xml version="1.0" encoding="utf-8"?> <TableLayout xmlns:android="http://schemas.android.com/apk/res/android" xmlns:app="http://schemas.android.com/apk/res-auto" xmlns:tools="http://schemas.android.com/tools" android:id="@+id/main" android:layout_width="match_parent" android:layout_height="match_parent" android:shrinkColumns="0" android:stretchColumns="*" tools:context=".MainActivity"> <TableRow android:layout_width="match_parent" android:layout_height="match_parent"> <Button android:id="@+id/Button5" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button6" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button7" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button8" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button9" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button10" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button11" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button12" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button13" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button14" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button15" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button16" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button17" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> <Button android:id="@+id/button18" android:layout_width="match_parent" android:layout_height="wrap_content" android:layout_weight="0" android:text="Button" /> </TableRow> </TableLayout> 버튼들의 너비도 바꿔봤는데 shrinkColumns 적용이 되지 않아요 왜 그런걸까요..?
승쨩
2025-06-09T11:45:20.163Z
댓글 1
좋아요 0
조회수 80
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
#1. 문제파악 # 분류모델 / ROC-AUC, 정확도(Accuracy), F1, 정밀도(Precision), 재현율(Recall) #TARGET : Attrition_Flag # CSV("CLIENTNUM,Attrition_Flag) , 수험번호.CSV #2. 데이터불러오기 import pandas as pd train = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p2/ceredit%20card/train.csv") test = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p2/ceredit%20card/test.csv") # train = pd.read_csv("train.csv") # test = pd.read_csv("test.csv") #없을 경우 -> 원핫인코딩 / 있으면 레이블인코딩 #3. EDA #print(train.shape, test.shape) #print(train.info(), test.info()) #print(train.isnull().sum(), test.isnull().sum()) #print("test에만 있는 컬럼:", test_cols - train_cols) #train_cols = set(train.columns) #test_cols = set(test.columns) #4. 데이터 전처리 #공통 print(train.shape, test.shape) target = train.pop('Attrition_Flag') train =train.drop('CLIENTNUM', axis=1) id = test.pop('CLIENTNUM') print(train.shape, test.shape) #레이블 인코딩 cols = train.select_dtypes(include = 'object').columns from sklearn.preprocessing import LabelEncoder for col in cols : le = LabelEncoder() train[col] = le.fit_transform(train[col]) test[col]= le.transform(test[col]) #5. 데이터 분할 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=2) #6. 모델 학습 및 평가 from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=2) rf.fit(X_tr,y_tr) pred = rf.predict(X_val) pred1 = rf.predict_proba(X_val) from sklearn.metrics import roc_auc_score, f1_score, recall_score, accuracy_score, precision_score roc = roc_auc_score(y_val, pred1[:,1]) f1 = f1_score(y_val, pred) recall = recall_score(y_val, pred) acc = accuracy_score(y_val, pred) pre = precision_score(y_val, pred) #7 평가 pred_test = rf.predict(test) pred1 = rf.predict_proba(test) #print(pred1) submit = pd.DataFrame({'CLIENTNUM' : id, 'Attrition_Flag' : pred1[:,1]}) submit.to_csv("0000.csv", index = False) pd.read_csv("0000.csv") 안녕하세요~ 이번엔 레이블인코딩으로 데이터전처리해서 풀어봤습니다 혹시 피드백해주실 부분이 있으실까요~?
python 머신러닝 빅데이터 pandas 빅데이터분석기사
이지웡
2025-06-09T11:42:37.652Z
댓글 2
좋아요 0
조회수 74
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
안녕하세요. 문제 8번 원본 데이터가 변경된 것 같습니다. 불러오는 주소가 잘못 되었거나.. 데이터가 바뀐 것 같습니다.
python 머신러닝 빅데이터 pandas 빅데이터분석기사
무화과
2025-06-09T08:44:16.272Z
댓글 2
좋아요 0
조회수 31
미해결
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형 2 문제를 풀때 컬럼을 삭제하는 기준에서 ID와 같은것은 무조건 삭제하는것이 좋을까요? 아래와 같은 예시에서는 비행편 컬럼을 삭제하고 시작하셨는데... 카테고리수가 다르다고 함부로 삭제하는건 또 아닐거같은데 기준을 어떻게 정하면 좋을까요? 저는 비행편 컬럼을 삭제하지 않고 회귀모델을 만들었는데 rmse가 더 적게 나오긴했고요.. = print("\n ===== 카테고리 비교 =====") cols = train.select_dtypes(include='object').columns for col in cols: set_train = set(train[col]) set_test= set(test[col]) same = (set_train == set_test) if same: print(col, "\t카테고리 동일함") else: print(col, "\t카테고리 동일하지 않음") train = train.drop('flight', axis=1) test = test.drop(
python 머신러닝 빅데이터 pandas 빅데이터분석기사
이선희
2025-06-09T08:37:15.880Z
댓글 2
좋아요 0
조회수 77
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
df.sort_values('id_assessment',ascending=False) 를 할때와 df['id_assessment'].value_counts()를 할때와 값이 다르게 나오는데 왜 인가요?
python 머신러닝 빅데이터 pandas 빅데이터분석기사
김라의
2025-06-09T07:47:21.093Z
댓글 2
좋아요 0
조회수 51
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 logit 으로 테스트 데이터 학습 시킬때 data = test가 아닌 train으로 학습시키는건가요?? 문제에 예측하라그래서 test 를 데이터셋으로 넣는줄 알았는데 아니어서 여쭤봅니다
python 머신러닝 빅데이터 pandas 빅데이터분석기사
eovnfjfpa
2025-06-09T06:52:44.134Z
댓글 2
좋아요 0
조회수 83
미해결
자바와 스프링 부트로 생애 최초 서버 만들기, 누구나 쉽게 개발부터 배포까지! [서버 개발 올인원 패키지]
무료버전은 해당 기능설정을 지원하지 않네요. 뭐지? 했던분들 참고하시면 좋겠네요
java spring aws mysql spring-boot jpa
장은성
2025-06-09T06:34:53.191Z
댓글 2
좋아요 0
조회수 75
미해결
자바 ORM 표준 JPA 프로그래밍 - 기본편
안녕하세요. JpaMain.java 코드에서 em.persist 순서에 따라 UPDATE 문이 발생하는데요. em.persist(parent); em.persist(child1); em.persist(child2); 이렇게 적었을 땐 강사님과 똑같은 코드로 update 문이 발생하지 않고, 아래와 같이 작성했을 때 update 쿼리가 마지막에 한번 더 나갑니다. em.persist(child1); em.persist(child2); em.persist(parent); 이유가 무엇인지 궁금합니다. 편의 메서드에서 child을 더티 체크하기 때문에 update 쿼리가 나간 것 같은데, 왜 순서를 바꿨을 땐 update 쿼리가 발생하지 않는지 잘 모르겠습니다!
nick
2025-06-09T06:02:05.160Z
댓글 1
좋아요 0
조회수 50
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
#1. 문제파악 # 분류모델 / ROC-AUC, 정확도(Accuracy), F1, 정밀도(Precision), 재현율(Recall) #TARGET : Attrition_Flag # CSV("CLIENTNUM,Attrition_Flag) , 수험번호.CSV #2. 데이터불러오기 import pandas as pd train = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p2/ceredit%20card/train.csv") test = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p2/ceredit%20card/test.csv") # train = pd.read_csv("train.csv") # test = pd.read_csv("test.csv") #3. EDA #print(train.shape, test.shape) #print(train.info(), test.info()) #print(train.isnull().sum(), test.isnull().sum()) #4. 데이터 전처리 #print(train.shape, test.shape) target = train.pop('Attrition_Flag') train =train.drop('CLIENTNUM', axis=1) id = test.pop('CLIENTNUM') train = pd.get_dummies(train) test = pd.get_dummies(test) #print(train.shape, test.shape) #5. 데이터 분할 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=2) #6. 모델 학습 및 평가 from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=2) rf.fit(X_tr,y_tr) pred = rf.predict(X_val) pred1 = rf.predict_proba(X_val) from sklearn.metrics import roc_auc_score, f1_score, recall_score, accuracy_score, precision_score roc = roc_auc_score(y_val, pred1[:,1]) f1 = f1_score(y_val, pred, average = 'macro') recall = recall_score(y_val, pred) acc = accuracy_score(y_val, pred) pre = precision_score(y_val, pred) #7 평가 pred = rf.predict(test) pred1 = rf.predict_proba(test) #print(pred1) submit = pd.DataFrame({'CLIENTNUM' : id, 'Attrition_Flag' : pred1[:,1]}) submit.to_csv("0000.csv", index = False) pd.read_csv("0000.csv") 작업형 2 모의문제1로 이렇게 작성했는데, 피드백 주실 부분이 있으실까요? ㅠㅠ
python 머신러닝 빅데이터 pandas 빅데이터분석기사
이지웡
2025-06-09T05:33:21.915Z
댓글 2
좋아요 0
조회수 87
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
# # 자료형 변환 # df['subscribed'] = pd.to _datetime(df['subscribed']) # # df['subscribed'] = pd.to _datetime(df['subscribed'], format="%Y-%m-%d") # format 사용 위 두개 중에 저는 항상 맨 위로만 코드를 작성했는데 오늘 문제풀이를 하다보니 두번째로도 알려주시는데..첫번째 코드로만 외우면 나중에 오류가 생길까요?
python 머신러닝 빅데이터 pandas 빅데이터분석기사
이선희
2025-06-09T05:23:22.583Z
댓글 2
좋아요 0
조회수 44
미해결
[2024년 개정]이것이 진짜 한글자동화다[기본편]
혹시 이런 질문 드려도 될 지 모르겠네요. 제가 학원에서 국어 강의를 하고 있는 국어선생인데요. 주로 한글 문서를 사용해 문서를 편집하거든요. 제가 알고 싶은 것은 스타일이 적용 안된 한글 문서를 스타일 적용된(예를 들어 지문파일 스타일, 문제스타일, 보기스타일, 선택지스타일, 정답및 해설스타일 등)문서로 일괄 자동 변환 아니면 반자동 되게 하는 프로그램을 만들고 싶거든요. 이거 제가 강의 들으면 문과인 기계에 문외한인 저도 만들 수 있나요? 아니면 의뢰를 해야 하나요? 의뢰해도 만들 수 있다면 하고 싶어요. 사실 시간이 없거든요. 여기 게시판에 맞는 질문인지 모르겠네요.
박정훈
2025-06-09T04:42:22.914Z
댓글 1
좋아요 0
조회수 297
해결됨
[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요 강사님 오늘 방금 시간으로 RMSE 내용이랑 test.csv 예측칼럼 삭제 확인했는데 혹시 강의 업로드 가능하신지 문의드립니다~
python 머신러닝 빅데이터 pandas 빅데이터분석기사
bosong0808
2025-06-09T01:11:37.606Z
댓글 2
좋아요 0
조회수 66