inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

172만명의 커뮤니티!! 함께 토론해봐요.

작업형2) 모의고사 2 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

안녕하세요. 질문이 있습니다. object 컬럼 'neighbourhood'에 대해서... object 형 컬럼의 고유항목들이 train 데이터와 test 데이터 모두 일치하는지 확인한 후 일치하지 않으면 train 데이터와 test 데이터를 concat으로 합친 후에 인코딩을 진행하고 다시 분리해주라고 학습했습니다. 그런데 이번 수업 에어비엔비 자료에서 'neighbourhood' 항목이 일치하지 않는 것으로 확인되어 concat 과정을 진행해 주었는데 수업에서는 이 과정이 없더라구요. 관련 질문을 찾아보니 test 데이터의 항목을 train 데이터가 모두 포함하고 있으면 레이블 인코딩은 가능하고 원핫 인코딩은 불가능하다고 하신 것 같은데 이렇게 생각하니 너무 복잡한 것 같아서요. 그냥 일치하지 않는 항목이 있으면 무조건 concat을 진행해준다고 생각하면 오히려 편할 것 같은데 이렇게 생각하고 문제를 풀어도 오류가 없을지 궁금합니다. 그리고 저는 'neighbourhood' 항목이 object형이고 value가 200개 이상으로 꽤 크다고 생각했으며 price를 예측할 때 크게 의미 있는 컬럼이라는 생각이 들지 않아서 굳이 인코딩하기 보다는 과감하게 삭제를 진행했었는데요. 문제를 풀 때 이렇게 자신의 기준으로 컬럼을 삭제해도 괜찮은 건가요? csv 파일로 생성해야 하는 target 컬럼 같은 경우 어쩔 때는 데이터 전처리 초반에 다음과 같은 코드(target = train.pop('price'))로 미리 분리를 해두거나 이번 수업처럼 검증 데이터를 분리할 때 X_train, X_val, y_train, y_val = train_test_split(train.drop('price', axis=1), train['price'], test_size=0.15, random_state=2022) 이런 식으로 함수 매개변수로 설정해주시기도 하셨잖아요. 방법이 여러 가지가 있어서 그때그때 다른 방법을 보여주신 거라고 생각하면 될까요? 그리고 test_size를 보통 20%로 잡으시던데 이번엔 15%로 잡은 이유가 별도로 있으신 건지 궁금합니다. 만약 전처리 할 때 target = train.pop('price')을 통해 미리 타겟을 분리해두면, train 데이터에 타겟 컬럼이 존재하지 않게 되잖아요. 근데 검증 데이터 분리할 때 첫 번째 매개변수로 train 데이터를 두 번째 매개변수로 타겟 값을 넣어줌으로써 학습 및 검증은 타겟값이 정상적으로 활용되는 것이 맞나요? 이 가정이 맞다면 문제가 없지만, 가정이 틀리다면 저 타겟을 왜 분리하는지 이해가 되지 않을 것 같습니다..

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
kki733232 댓글 3 좋아요 0 조회수 101

머신러닝 인코딩 관련 문의

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

1.머신러닝 인코딩 강의 관련하여 원핫 인코딩 또는 라벨 인코딩 둘 중 하나를 사용하면 된다고 하는데, train_oh = pd.get_dummies(train) test_oh = pd.get_dummies(test) data = pd.concat([train, test], axis=0) data_oh = pd.get_dummies(data) train_oh = data_oh.iloc[:len(train)].copy() test_oh = data_oh.iloc[len(train):].copy() 해당 원핫 인코딩만 적용하면 ValueError: could not convert string to float: 'Private' 해당 오류가 뜨면서 cols = ['workclass', 'education', 'marital.status', 'occupation', 'relationship', 'race', 'sex','native.country'] from sklearn.preprocessing import LabelEncoder for col in cols: le = LabelEncoder() train[col] = le.fit_transform(train[col]) test[col] = le.transform(test[col]) 라벨 인코딩까지 같이 적용해야 오류가 안 뜨는데, 혹시 두 가지 같이 적용해야 되는지 문의드립니다. 또한, 머신러닝 (회귀) 강의에서는 인코딩 하는 방법이 cols = ['Item_Identifier', 'Item_Fat_Content', 'Item_Type', 'Outlet_Identifier', 'Outlet_Size', 'Outlet_Location_Type', 'Outlet_Type'] df = pd.concat([train, test]) # 라벨 인코딩 from sklearn.preprocessing import LabelEncoder le = LabelEncoder() for col in cols: df[col] = le.fit_transform(df[col]) # 원핫 인코딩 df = df.drop('Item_Identifier', axis=1) df = pd.get_dummies(df) train, test 개별로 보지않고, 합쳐서 적용을 하는데 별도로 분리해서 적용하지 않고 한번에 합쳐서 적용해도 되는지 궁금합니다! 인코딩 부분이 헷갈리는데, 가장 보편적으로 사용되는 인코딩 방법이 어떤것인지 알려주시면 해당 방법으로 주로 학습해보겠습니다!^^

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
bobby1994 댓글 2 좋아요 0 조회수 122

소수점 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

만약 각종 값을 구할 때 소수점이 필요하다면 그냥 model.params로 한번에 확인하고 수기로 제출해도 되나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
현우 댓글 2 좋아요 0 조회수 54

평가지표 수치

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

검증 데이터와 평가지표를 통해 평가했을 때, 평균적으로 어느정도가 제출하기 이상적인 수치인지 질문 드려도 될까요..?? 질문이 이상하긴한데.. 궁금하네요 영상에서 0.6정도도 선생님께서 강의 흐름상 그냥 제출하신 것 같은데 그정도도 마음 놓고 제출해도 될지 궁금합니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이정균 댓글 2 좋아요 0 조회수 53

작업형1 모의문제, 문제에서 데이타가 링크로 적혀있어요. 어떻게 불러와야 하나요?

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 작업형 모의문제1번부터... data:members.csv 를 사용해서 문제를 풀게 되어 있는데 코드에 이렇게 링크로 적혀있는데 어떻게 불러오나요?? import pandas as pd df = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p1/members.csv")

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
12 소슴이 댓글 2 좋아요 0 조회수 68

pyenv는 윈도우에서는 잘 안되나 보네요..

해결됨

실전! Django 활용

pyenv virtualenv 3.11.8 goodpang 하니까 no such command 'virtualenv' 라고 뜨고 구글 검색해보니까 인프런 q&a 에서 윈도우에서는 잘 동작하지 않는다고 되어 있습니다. 인프런 AI가 아래를 추천해주는군요. python -m venv myenv

  • python
  • django
  • postgresql
  • orm
  • 동시성
Edwards 댓글 1 좋아요 0 조회수 210

LV1 설정

미해결

우리를 위한 프로그래밍 : 파이썬 중급 (Inflearn Original)

LV1부터 하나씩 듣고 있는데 가상환경설정 말고는 레벨1에서 설정한대로 두어도 되는 건가요?

  • python
  • django
yungyu391 댓글 2 좋아요 0 조회수 116

3강 그대로 따라했는데 코드가 아무 결과도 반납하지 않습니다.

해결됨

남박사의 파이썬으로 봇 만들기 with ChatGPT

코드를 그대로 따라서 작성하고 실행해보았는데 아무런 반환값이 나오지 않습니다. 구글과 네이버의 페이지 구조가 그동안 (처음 강의 올리신 후) 바뀌어서 그런걸까요?

  • python
  • 웹-크롤링
  • 챗봇
  • 객체지향
  • openai-api
minimings 댓글 2 좋아요 0 조회수 82

질문있습니다.

미해결

코드로 배우는 React 19 with 스프링부트 API서버

안녕하세요, 기존 JS기반 강의의 자료는 받을 수 없는 걸까요? 유투브로 올려주시긴 했으나 코드를 보면서 진행해보고 싶습니다...

  • react
  • spring-boot
  • jpa
  • jwt
  • redux-toolkit
별다방 댓글 2 좋아요 0 조회수 51

graphql 접속이 안됩니다.

해결됨

[코드캠프] 부트캠프에서 만든 고농축 프론트엔드 코스

graphql 포트폴리오용 주소는 접속이 되지만 graphql practice 주소와 rest-api practice 주소가 접속이 안되는 것 같습니다. http://practice.codebootcamp.co.kr/graphql http://practice.codebootcamp.co.kr/api-docs 해당 주소로 접속하였을 때 사이트에 연결할 수 없다고 나옵니다.

  • react
  • node.js
  • seo
  • graphql
  • next.js
댓글 2 좋아요 0 조회수 125

저는 원핫 인코딩으로 진행했는데 이런 코드로 짜보니 결국에는 마지막 에러가..

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

결국엔 마지막 에러가 '주구매상품_소형가전'이라고 뜨네요 제 코드에서 어디를 수정해야할까요? import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") #분류문제(랜포RandomForestClassifier) #print(train.shape),print(test.shape) #결측치 이상치 확인 train['환불금액']=train['환불금액'].fillna(0) test['환불금액']=test['환불금액'].fillna(0) train=train.drop('회원ID',axis=1) test=test.drop('회원ID',axis=1) #타겟값 지정 target=train.pop('성별') #원핫인코딩 train=pd.get_dummies(train) test=pd.get_dummies(test) #데이터분할하기 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=2022) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) #모델함수 불러와서 에측하기 from sklearn.ensemble import RandomForestClassifier from sklearn.metrics import roc_auc_score model=RandomForestClassifier(n_estimators=1000,max_depth=7,random_state=2022) model.fit (X_tr, y_tr) pred = model.predict_proba(X_val) #성능평가 roc_auc from sklearn.metrics import roc_auc_score print(roc_auc_score(y_val,pred[:,1])) #실제 test로 예측값구하기 pred = model.predict_proba(test)

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이선희 댓글 2 좋아요 0 조회수 98

결측치 채우는건 0혹은 중앙값? 어떤걸 추천하시는지요?

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

현재 구름환경 들어와서 2유형 풀어보고있는데요 혹시 결측치값은 어떤걸로 채우는걸 가장 추천하실런지요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이선희 댓글 2 좋아요 0 조회수 75

선생님~ 답변부탁드립니다 ㅠ저는 원핫인코딩으로 했더니 평가가 850대로 나오는데요

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

그리고 저는 원핫인코딩으로 했는데 mse가 850점대로 나오네요.. 이러면 안되는거지요? import pandas as pd train=pd.read_csv("churn_train.csv") test=pd.read_csv("churn_test.csv") #데이터전처리 train=train.drop('customerID',axis=1) test=test.drop('customerID',axis=1) #타겟값 설정 target=train.pop("TotalCharges") #원핫인코딩 train=pd.get_dummies(train) test=pd.get_dummies(test) test.head(5) #데이터분할하기 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val= train_test_split(train, target, test_size= 0.2, random_state=100) #랜포 불러와서 모델링하기 from sklearn.ensemble import RandomForestRegressor model=RandomForestRegressor(n_estimators=500,max_depth=5,random_state=2022) model.fit(X_tr, y_tr) pred = model.predict(X_val) #성능평가MAE(Mean Absolute Error) from sklearn.metrics import mean_absolute_error mean_absolute_error(y_val,pred) pred = model.predict(test) result=pd.DataFrame({"pred" : pred}) result.to_csv("111.csv",index=False)

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이선희 댓글 2 좋아요 0 조회수 112

Dag 에러가 나는데 모르겠어요

미해결

Airflow 마스터 클래스

안녕하세요. Broken DAG: [/opt/airflow/dags/dags_python_with_op_ kyargs.py ] Traceback (most recent call last): File "/home/airflow/.local/lib/python3.12/site-packages/airflow/models/ baseoperator.py ", line 508, in apply_defaults result = func(self, kwargs, default_args=default_args) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/airflow/.local/lib/python3.12/site-packages/airflow/models/ baseoperator.py ", line 959, in init raise AirflowException( airflow.exceptions.AirflowException: Invalid arguments were passed to PythonOperator (task_id: regist2_t1). Invalid arguments were: kwargs: {'op_kyargs': {'email': '@ naver.com ', 'phone': '010'}} 이런 에러가 왜 난거져?

  • python
  • 데이터-엔지니어링
  • airflow
newl0.dev 댓글 2 좋아요 0 조회수 109

진짜에요..?

미해결

React Native with Expo: 제로초에게 제대로 배우기

flutter도 써봤고, react/next도 다 쓰고 있는데요... expo의 라우팅 구조가 진짜 번잡하고 혼란스럽다고 느껴지네요. 혹시 현업에서도 알려주신 라우팅 방법(group 폴더, index.tsx, layout.tsx 등 활용)이 최선인가요? 뭐랄까.. 이상한 스킬들로 겨우겨우 원하는 결과물을 만들어내는 느낌이에요 ㅠㅠ

  • react
  • react-native
  • 하이브리드-앱
  • typescript
  • expo
스타트업을 논하는 여우 댓글 3 좋아요 0 조회수 230

작업형2에서 질문 있습니다.

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

y_train을 Replace로 train = x train.pop('income').to_frame('income') y_train = y_train['income'].replace('>50K', 1).replace('<=50K', 0) 인코딩을 했는데요 화면에서는 '>50K', '<=50K' 각각 나타내어 지고 있습니다. [1,0]으로 보여져야 하는거 아닌가요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
Sungkyu Moon 댓글 2 좋아요 0 조회수 43

Figma 디자인 링크는 어디서 받을 수 있을까요? ☺️

미해결

[Bloc 응용] 실전 앱 만들기 (책 리뷰 앱) : SNS 로그인, Firebase 적용, Bloc 상태 관리, GoRouter

선생님, Figma 디자인 링크는 어디서 받을 수 있을까요? ☺ 강의에서 구현되지 않거나 추가로 개발해야하는 부분이 있다고 말씀해주셔서 혼자 공부하면서 디자인도 수정하거나 추가해보고 싶은데, Figma 디자인 링크 편집 권한도 받을 수 있을까요?

  • flutter
  • firebase
  • bloc
댓글 1 좋아요 0 조회수 107

검증 데이터 분할 질문 드립니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

작업형2 New 내용에서 검증 데이터 분할 시 화면에는 train, y_train, test로 데이터 명이 되어 있는데요. 각각 인코딩이 완료된 데이터로 분할하는거 맞는거죠?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
Sungkyu Moon 댓글 2 좋아요 0 조회수 70

expo-location 문제

미해결

React Native with Expo: 제로초에게 제대로 배우기

강의 내용을 진행하던 중 android 시뮬레이터에서 expo-location을 import할 수 없다는 에러가 뜨고 있습니다. expo-go를 통해서 진행하였습니다. 이전 질문도 같은 문제가 있어보여서 해결 방법으로 expo 버전을 조정해도 해결되지 않습니다..ㅠㅠ 버전은 아래와 같습니다. package.json { "name": "threads", "main": "expo-router/entry", "version": "1.0.0", "scripts": { "start": "expo start", "reset-project": "node ./scripts/reset-project.js", "android": "expo start --android", "ios": "expo start --ios", "web": "expo start --web", "lint": "expo lint" }, "dependencies": { "@expo/vector-icons": "^14.1.0", "@react-navigation/bottom-tabs": "^7.3.10", "@react-navigation/elements": "^2.3.8", "@react-navigation/native": "^7.1.6", "expo": "53.0.9", "expo-blur": "~14.1.4", "expo-constants": "~17.1.6", "expo-font": "~13.3.1", "expo-haptics": "~14.1.4", "expo-image": "~2.1.7", "expo-linking": "~7.1.5", "expo-router": "~5.0.6", "expo-splash-screen": "~0.30.8", "expo-status-bar": "~2.2.3", "expo-symbols": "~0.4.4", "expo-system-ui": "~5.0.7", "expo-web-browser": "~14.1.6", "react": "19.0.0", "react-dom": "19.0.0", "react-native": "0.79.2", "react-native-gesture-handler": "~2.24.0", "react-native-reanimated": "~3.17.4", "react-native-safe-area-context": "5.4.0", "react-native-screens": "~4.10.0", "react-native-web": "~0.20.0", "react-native-webview": "13.13.5", "expo-dev-client": "~5.1.8", "expo-location": "~18.1.5" }, "devDependencies": { "@babel/core": "^7.25.2", "@types/react": "~19.0.10", "typescript": "~5.8.3", "eslint": "^9.25.0", "eslint-config-expo": "~9.2.0" }, "private": true }

  • react
  • react-native
  • 하이브리드-앱
  • typescript
  • expo
cocococoa 댓글 2 좋아요 0 조회수 193

인기 태그

인프런 TOP Writers

주간 인기글