inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

묻고 답해요

172만명의 커뮤니티!! 함께 토론해봐요.

소수점 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

만약 각종 값을 구할 때 소수점이 필요하다면 그냥 model.params로 한번에 확인하고 수기로 제출해도 되나요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
현우 댓글 2 좋아요 0 조회수 54

평가지표 수치

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

검증 데이터와 평가지표를 통해 평가했을 때, 평균적으로 어느정도가 제출하기 이상적인 수치인지 질문 드려도 될까요..?? 질문이 이상하긴한데.. 궁금하네요 영상에서 0.6정도도 선생님께서 강의 흐름상 그냥 제출하신 것 같은데 그정도도 마음 놓고 제출해도 될지 궁금합니다!

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이정균 댓글 2 좋아요 0 조회수 53

쿠버네티스 이해도에 대한 질문

해결됨

쿠버네티스 어나더 클래스-Sprint 1, 2 (#실무기초 #설치 #배포 #Jenkins #Helm #ArgoCD)

안녕하세요! 현재 컴퓨터공학과 4학년에 재학 중인 대학생입니다. 일프로님의 자세한 설명 덕분에, 현재 섹션 7까지 문제 없이 잘 따라가고 있습니다. 감사합니다. 최근에 든 생각이 있습니다. 일프로님이 강의에서 설계하신 인프라 구조나 Object들이 서로 어떻게 연결되고 어떤 역할을 하는 지는 강의를 들으면 이해가 됩니다. 물론, 복습도 꾸준히 하고 있습니다. 하지만, 제가 그 구조를 어떠한 논리를 가지고 혼자서 설계를 하라면 못 할 것 같다는 것입니다. 아직 제가 강의 초반이라 그런 걸까요? 아니면, 제가 추가로 알아야 하거나 공부해야 될 지식이 있는 걸까요..? 강의 자체는 이해가 되고 따라하며 잘 진행하고 있지만, 정확히 어떤 마음가짐(?)이나 방식으로 공부해야 할 지 잘 모르겠습니다.. ㅜㅜ 쿠버네티스는 이번이 처음이라 주저리 너무 길었네요.. 혹시나 답변 남겨주시면 참고하여 다시 공부해보겠습니다! 감사합니다.

  • kubernetes
  • infrastructure
  • container
Howon Jeong 댓글 1 좋아요 1 조회수 88

작업형1 모의문제, 문제에서 데이타가 링크로 적혀있어요. 어떻게 불러와야 하나요?

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 작업형 모의문제1번부터... data:members.csv 를 사용해서 문제를 풀게 되어 있는데 코드에 이렇게 링크로 적혀있는데 어떻게 불러오나요?? import pandas as pd df = pd.read_csv("https://raw.githubusercontent.com/lovedlim/inf/main/p1/members.csv")

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
12 소슴이 댓글 2 좋아요 0 조회수 68

pyenv는 윈도우에서는 잘 안되나 보네요..

해결됨

실전! Django 활용

pyenv virtualenv 3.11.8 goodpang 하니까 no such command 'virtualenv' 라고 뜨고 구글 검색해보니까 인프런 q&a 에서 윈도우에서는 잘 동작하지 않는다고 되어 있습니다. 인프런 AI가 아래를 추천해주는군요. python -m venv myenv

  • python
  • django
  • postgresql
  • orm
  • 동시성
Edwards 댓글 1 좋아요 0 조회수 209

Argo Rollouts 에 대해 질문 드립니다.

미해결

쿠버네티스 어나더 클래스-Sprint 1, 2 (#실무기초 #설치 #배포 #Jenkins #Helm #ArgoCD)

강사님 Argo Rollouts 를 수업하실 때 두개의 서비스 active 와 preview 를 기동시키셨는데 이게 실제 real system 에도 이렇게 운용되는 건지요? 아니면 Active 만 운용하다가 blue/green 시점에 Appliacation 을 통해 preview를 배포하고 두개의 서비스를 등록하고 blue/green 배포를 실행하는 건지요? 아울러 일반적인 경우(롤링업데이트 포함)의 경우 deployment.yaml 을 사용하였고 이는 Helm과 연동됨을 확인하였습니다. 그렇다면 강사님께서 예로 드신 rollout.yaml 도 Helm과 연동시킬 수 있는 건지요? 예제에서는 Helm 이 전혀 보이질 않아서 여쭤 봅니다.

  • kubernetes
  • infrastructure
  • container
내일은 한걸음 더 나아갈거야 댓글 2 좋아요 1 조회수 88

LV1 설정

미해결

우리를 위한 프로그래밍 : 파이썬 중급 (Inflearn Original)

LV1부터 하나씩 듣고 있는데 가상환경설정 말고는 레벨1에서 설정한대로 두어도 되는 건가요?

  • python
  • django
yungyu391 댓글 2 좋아요 0 조회수 114

3강 그대로 따라했는데 코드가 아무 결과도 반납하지 않습니다.

해결됨

남박사의 파이썬으로 봇 만들기 with ChatGPT

코드를 그대로 따라서 작성하고 실행해보았는데 아무런 반환값이 나오지 않습니다. 구글과 네이버의 페이지 구조가 그동안 (처음 강의 올리신 후) 바뀌어서 그런걸까요?

  • python
  • 웹-크롤링
  • 챗봇
  • 객체지향
  • openai-api
minimings 댓글 2 좋아요 0 조회수 81

저는 원핫 인코딩으로 진행했는데 이런 코드로 짜보니 결국에는 마지막 에러가..

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

결국엔 마지막 에러가 '주구매상품_소형가전'이라고 뜨네요 제 코드에서 어디를 수정해야할까요? import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") #분류문제(랜포RandomForestClassifier) #print(train.shape),print(test.shape) #결측치 이상치 확인 train['환불금액']=train['환불금액'].fillna(0) test['환불금액']=test['환불금액'].fillna(0) train=train.drop('회원ID',axis=1) test=test.drop('회원ID',axis=1) #타겟값 지정 target=train.pop('성별') #원핫인코딩 train=pd.get_dummies(train) test=pd.get_dummies(test) #데이터분할하기 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size=0.2, random_state=2022) # print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) #모델함수 불러와서 에측하기 from sklearn.ensemble import RandomForestClassifier from sklearn.metrics import roc_auc_score model=RandomForestClassifier(n_estimators=1000,max_depth=7,random_state=2022) model.fit (X_tr, y_tr) pred = model.predict_proba(X_val) #성능평가 roc_auc from sklearn.metrics import roc_auc_score print(roc_auc_score(y_val,pred[:,1])) #실제 test로 예측값구하기 pred = model.predict_proba(test)

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이선희 댓글 2 좋아요 0 조회수 98

포트 중복 할당

미해결

비전공자도 이해할 수 있는 Docker 입문/실전

$ docker run -d -p 80:80 nginx 를 실행시켰을 때, localhost:80에서 nginx html이 실행되는 것을 볼 수 있었습니다. 하나의 포트에 호스트와 컨테이너 2개의 서비스가 할당되어 있는 것인지 궁금합니다.

  • docker
  • container
임재원 댓글 2 좋아요 0 조회수 96

결측치 채우는건 0혹은 중앙값? 어떤걸 추천하시는지요?

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

현재 구름환경 들어와서 2유형 풀어보고있는데요 혹시 결측치값은 어떤걸로 채우는걸 가장 추천하실런지요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이선희 댓글 2 좋아요 0 조회수 75

선생님~ 답변부탁드립니다 ㅠ저는 원핫인코딩으로 했더니 평가가 850대로 나오는데요

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

그리고 저는 원핫인코딩으로 했는데 mse가 850점대로 나오네요.. 이러면 안되는거지요? import pandas as pd train=pd.read_csv("churn_train.csv") test=pd.read_csv("churn_test.csv") #데이터전처리 train=train.drop('customerID',axis=1) test=test.drop('customerID',axis=1) #타겟값 설정 target=train.pop("TotalCharges") #원핫인코딩 train=pd.get_dummies(train) test=pd.get_dummies(test) test.head(5) #데이터분할하기 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val= train_test_split(train, target, test_size= 0.2, random_state=100) #랜포 불러와서 모델링하기 from sklearn.ensemble import RandomForestRegressor model=RandomForestRegressor(n_estimators=500,max_depth=5,random_state=2022) model.fit(X_tr, y_tr) pred = model.predict(X_val) #성능평가MAE(Mean Absolute Error) from sklearn.metrics import mean_absolute_error mean_absolute_error(y_val,pred) pred = model.predict(test) result=pd.DataFrame({"pred" : pred}) result.to_csv("111.csv",index=False)

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
이선희 댓글 2 좋아요 0 조회수 111

Argo 의 CRD 에 대해 질문 드리고 싶습니다.

미해결

쿠버네티스 어나더 클래스-Sprint 1, 2 (#실무기초 #설치 #배포 #Jenkins #Helm #ArgoCD)

Argo 의 경우 Application 이라는 새로운 CRD 를 이용하여 Deployment 등의 k8s 리소스를 관리하는 거 같습니다. CRD 의 경우 CRD 의 관리하에 생성된 리소스의 경우 CRD 가 삭제되면 같이 삭제되는 것으로 알고 있는데 Argo 의 Application 을 삭제하면 동일하게 동작하는게 아닌지요? 좋은 강의 잘 듣고 있습니다. 어디서도 들을 수 없었던 강의 내용에 감사드립니다. 아울러 강사님의 강의자료를 바탕으로 저 만의 노트를 200페이지 정도 만들었습니다. 다 강사님 덕분입니다. Helm 도 다 들었고, sprinter 3, 4 도 구매했습니다. 빨리 5가 나왔으면 하고 기다리고 있습니다.

  • kubernetes
  • infrastructure
  • container
내일은 한걸음 더 나아갈거야 댓글 3 좋아요 1 조회수 155

Dag 에러가 나는데 모르겠어요

미해결

Airflow 마스터 클래스

안녕하세요. Broken DAG: [/opt/airflow/dags/dags_python_with_op_ kyargs.py ] Traceback (most recent call last): File "/home/airflow/.local/lib/python3.12/site-packages/airflow/models/ baseoperator.py ", line 508, in apply_defaults result = func(self, kwargs, default_args=default_args) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/airflow/.local/lib/python3.12/site-packages/airflow/models/ baseoperator.py ", line 959, in init raise AirflowException( airflow.exceptions.AirflowException: Invalid arguments were passed to PythonOperator (task_id: regist2_t1). Invalid arguments were: kwargs: {'op_kyargs': {'email': '@ naver.com ', 'phone': '010'}} 이런 에러가 왜 난거져?

  • python
  • 데이터-엔지니어링
  • airflow
newl0.dev 댓글 2 좋아요 0 조회수 109

작업형2에서 질문 있습니다.

미해결

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

y_train을 Replace로 train = x train.pop('income').to_frame('income') y_train = y_train['income'].replace('>50K', 1).replace('<=50K', 0) 인코딩을 했는데요 화면에서는 '>50K', '<=50K' 각각 나타내어 지고 있습니다. [1,0]으로 보여져야 하는거 아닌가요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
Sungkyu Moon 댓글 2 좋아요 0 조회수 43

검증 데이터 분할 질문 드립니다.

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

작업형2 New 내용에서 검증 데이터 분할 시 화면에는 train, y_train, test로 데이터 명이 되어 있는데요. 각각 인코딩이 완료된 데이터로 분할하는거 맞는거죠?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
Sungkyu Moon 댓글 2 좋아요 0 조회수 69

작업형 2 이상치 제거 부분

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

영상보다가 처음에 결측치 제거 부분에서 실수로 "value"부분에서 따옴표를 넣어 test의 age컬럼이 object형식으로 저장되었습니다 그래서 이상치 파트에서 문자랑 정수가 섞여 조건문 작성시에 오류가 발생하였는데 다시 원래대로 결측치 있는 부분을 fillna(vlaue)로 저장시키는 방법은 없나요? test파일을 test = test_backup.copy() 이렇게 해놔야 하나요? value = int(train["age"].mean()) print("평균값: ", value) train["age"] = train["age"].fillna(value) test["age"] = test["age"].fillna("value")

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
김경원 댓글 1 좋아요 0 조회수 46

train_oh, test_oh 의미

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

train와 test의 데이터가 15개로 동일하지만 train_oh와 test_oh의 데이터는 왜 다른지 궁금합니다.. 제가 정확히 train_oh와 test_oh는 각각 train과 test의 문자데이터를 수치형 데이터로 변환하는것으로 이해했는데 그렇다면 train과 train_oh의 데이터 갯수는 동일해야 하는것이 아닌 의문이 들어 질문남깁니다 ㅠ

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
고동협 댓글 2 좋아요 0 조회수 77

기출1 작업형2 코드 질문

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

import pandas as pd train = pd.read _csv("data/customer_train.csv") test = pd.read _csv("data/customer_test.csv") #1 문제정의 #분류 (ROC_AUC ), TARGET = '성별' 제출할 데이터 2482개 # 사용자 코딩 #2EDA print(train.shape, test.shape) #제출할 데이터 2482개 print( train.info ()) print(train.isnull().sum()) print(test.isnull().sum()) #환불금액 결측치 2295개 #3 데이터 전처리 #결측치 처리 aa = train['환불금액'].mode()[0] print(aa) train['환불금액'] = train['환불금액'].fillna(aa) test['환불금액'] = test['환불금액'].fillna(aa) print(train.isnull().sum()) print(test.isnull().sum()) target = train.pop('성별') train = pd.get_dummies(train) test = pd.get_dummies(test) test = ★test.reindex(columns=train.columns, fill_value=0) #검증데이터 분리 from sklearn.model_selection import train_test_split X_tr, X_val, y_tr, y_val = train_test_split(train, target, test_size =0.2, random_state=0) print(X_tr.shape, X_val.shape, y_tr.shape, y_val.shape) #학습 및 예측 from sklearn.ensemble import RandomForestClassifier rf = RandomForestClassifier(random_state=0) rf.fit (X_tr, y_tr) pred = rf.predict_proba(X_val) from sklearn.metrics import roc_auc_score roc_auc = roc_auc_score(y_val, pred[:,1]) print(roc_auc) pred = rf.predict_proba(test) submit = pd.DataFrame({'pred':pred[:,1]}) submit.to _csv('result.csv', index=False) print( pd.read _csv('result.csv').head(3)) print( pd.read _csv('result.csv').shape) # 답안 제출 참고 # 아래 코드는 예시이며 변수명 등 개인별로 변경하여 활용 # pd.DataFrame변수.to _csv("result.csv", index=False) 기출1회작업형2번 문제 중 결측치를 최빈값으로 채운 뒤 코드 작성하였지만 오류가 떴습니다. 검색결과 train과 test의 컬럼 개수가 다르다고 합니다. Q. ★test.reindex(columns=train.columns, fill_value=0) 해당 코드를 추가하면 정상적으로 돌아가는데 해당 코드를 추가해도 답에 이상이 없을까요?

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
홍영준 댓글 3 좋아요 0 조회수 61

회귀 평가지표 관련해서 질문드립니다!

해결됨

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요! 질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요 먼저 유사한 질문이 있었는지 검색해보세요 안녕하세요 다름이 아니라 강의에서 회귀 중 MAPE, RMSE, RMSLE 등은 sklearn.metrics에 없다고 따로 외워야 한다고 하셨는데요 사이킷런 홈페이지 들어가봤는데 다 적혀있기는 해서, 혹시 이제는 metrics 통해 그대로 사용하면 되는 게 맞는지 여쭙습니다! 제가 확인한 사이트도 링크 첨부하였습니다. https://scikit-learn.org/stable/modules/generated/sklearn.metrics.mean_squared_log_error.html

  • python
  • 머신러닝
  • 빅데이터
  • pandas
  • 빅데이터분석기사
박재은 댓글 2 좋아요 0 조회수 88

인기 태그

인프런 TOP Writers

주간 인기글